Exploring Structures in Physics Problems: Can AI Agents Discover Statistical Mechanical M…
Explorar
Noticias de IA
21864 elementos — filtrados, clasificados y sin duplicados
CG-World: A Large-Scale World-State Dataset and Protocol for World Models
EvoPINN: Agentic Discovery of Executable Algorithms for Physics-Informed Neural Networks
Towards simultaneous decoding of kinetic and kinematic movement parameters during grasp a…
Plans Work in Mysterious Ways: Evaluating a Plan Mode for Spreadsheet Agents
Where Is the Cost of Third-Party API Routers in Agentic Software Development?
An Unofficial FastLAS Tutorial: A Programmer's Guide
FilmBench: A Film-Grade Benchmark for Cinematic Video Generation
Hearsay: Vision-Language Medical Diagnoses Without an Image
Exact Symmetry as Algebra: A Machine-Verified Tensor Calculus that Enforces Physical Sele…
REAP: Automatic Curation of Coding Agent Benchmarks from Interactive Production Usage
Adaptively Robust LLM Monitoring via Activation Watermarking
Gated Adaptation for Continual Learning in Human Activity Recognition
Making Implicit Premises Explicit in Logical Understanding of Enthymemes
Facial-Expression-Aware Prompting for Empathetic LLM Tutoring
The Rise of AI in Weather and Climate Information and its Impact on Global Inequality
PatchDenoiser: Parameter-efficient multi-scale patch learning and fusion denoiser for Low…
DialectLLM: A Dialect-Aware Dialog[ue] Generation Framework Beyond Standard American Engl…
ARC-Encoder: learning compressed text representations for large language models
GBPP: Grasp-Aware Base Placement Prediction for Robots via Two-Stage Learning
AI LEGO: Scaffolding Cross-Functional Collaboration in Industrial Responsible AI Practice…
Task and Skill Planning: Hierarchical Robot Planning with Black-Box Skills
When Should AI Follow? Task Structure and Joint Adaptation by Human and AI Agents
Equivariant Eikonal Neural Networks: Grid-Free, Scalable Travel-Time Prediction on Homoge…
The Reliability of LLMs for Medical Diagnosis: An Examination of Consistency, Manipulatio…
FPEdit: Robust LLM Fingerprinting through Localized Parameter Editing
One-Frame Calibration with Siamese Network in Facial Action Unit Recognition
Beyond Block Boundaries: Multi-Block Editing for Diffusion Large Language Models
The Cost of Knowing: A Resource-Aware Protocol for Benchmarking Hallucination Beyond Stat…
Measure what Matters: Psychometric Evaluation of AI with Situational Judgment Tests