Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Feedback That Backfires: Why Small Language Model Agents Repeat the Call They Just Watche…
arXiv cs.AI Research & Papers
From State to Action: OODA-Tool for Reliable Multi-Turn Tool Use
arXiv cs.AI Research & Papers
FedV-KGQA: Multi-Hop Question Answering over Vertically Partitioned Knowledge Graphs
arXiv cs.AI Research & Papers
Identifying Latent Declarative Representations of Code for Assisting Repository Migration
arXiv cs.AI Research & Papers
Method, Mind, and Morality: How People Make Sense of Artificial Intelligence
arXiv cs.AI Research & Papers
ExPhy: A Benchmark for Explicit Physical Property Learning in Multi-Object Trajectory For…
arXiv cs.AI Research & Papers
When Less Is More: An Empirical Study of Minimal Responses in Counseling Dialogues and th…
arXiv cs.AI Research & Papers
ChorusTIC: Training-Free Multivariate Time Series Classification via Chorus In-Context Le…
arXiv cs.AI Research & Papers
Restoring Without Forgetting: Continual Learning Across Image Degradations
arXiv cs.AI Research & Papers
Ensemble of Convolutional Neural Networks for StrokePrediction: Towards Improved Diagnost…
arXiv cs.AI Research & Papers
From Causal Plausibility to Causal Reliability: Evaluating LLMs as Calibrated Direct Caus…
arXiv cs.AI Research & Papers
PARTAB: Partition-Aware Reasoning with Structured Evidence for Scalable Table Understandi…
arXiv cs.AI Research & Papers
StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Ba…
arXiv cs.AI Research & Papers
Beyond Executable Models: The Pufibara Agent Harness and the Modelica Agent Workflow Benc…
arXiv cs.AI Research & Papers
Rebuild Dossier: Mechanically-Enforced Specs for Agentic App Rebuilds, and What Model-Tie…
arXiv cs.AI Research & Papers
Macro-Operator Generation and Predicate Selection for TAMP Operator Learning
arXiv cs.AI Research & Papers
CoWorld-VLA: Thinking in a Multi-Expert World Model for Autonomous Driving
arXiv cs.AI Research & Papers
Robust Motion Generation using Part-level Reliable Data from Videos
arXiv cs.AI Research & Papers
Quasar: A Programming Language Specialized for LLM Code Actions
arXiv cs.AI Research & Papers
PatientHub: A Unified Framework for Patient Simulation
arXiv cs.AI Research & Papers
Progressively Learning Heterogeneous Skills in a Unified Latent Space
arXiv cs.AI Research & Papers
REFINE: A Multi-Agent LLM Approach for Evidence-Guided Code Refactoring
arXiv cs.AI Research & Papers
When May an Agent Stop? Evidence-Carrying Termination for Tool-Using LLMs
arXiv cs.AI Research & Papers
The Limits of Automatic Evaluation of Creativity in Large Language Models
arXiv cs.AI Research & Papers
ESQ-Bench: A Multi-Tier Enterprise Oracle Benchmark for Evaluating NL2SQL Dialect General…
arXiv cs.AI Research & Papers
Revelation Control
arXiv cs.AI Research & Papers
Strictly Causal Streaming Video Anomaly Detection with a Theoretically-Grounded State-Spa…
arXiv cs.AI Research & Papers
Score-Based Ideal Observer Approximation via Denoising Score Matching for Signal-Known-Ex…
arXiv cs.AI Research & Papers
Can a Dynamic Internal Field Govern a Transformer's Cognition? Certifiability, not Superi…
arXiv cs.AI Research & Papers
MolEmb: Multimodal Large Language Models Can Be Strong Molecular Embedding Models