Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies
arXiv cs.AI Research & Papers
Think When It Matters: Conditional VLM Reasoning for Social Navigation with RL Policies
arXiv cs.AI Research & Papers
MMA-Former: Multi-Window Mixture-of-Head Attention Transformer for Adaptive PNI Predictio…
arXiv cs.AI Research & Papers
Compile, Then Page: Executable SOP Programs and a Capability-Gated Runtime for Procedural…
arXiv cs.AI Research & Papers
AutoVSR: Automatic Visual-to-Symbolic Reasoning for Symbolic Expression Generation from C…
arXiv cs.AI Research & Papers
EquiFusion: Kinematics-Agnostic Human Motion Prediction via Equivariant Latent Diffusion
arXiv cs.AI Research & Papers
The Singularity Space: A Generative Diffusion Framework for Signal Representation
arXiv cs.AI Research & Papers
Calibrated e-CUSUM Decoding for Quantized Reasoning Models: Why Token Log-Probability Is …
arXiv cs.AI Research & Papers
Efficient Test-Time Optimization for Multi-Agent Proof Autoformalization
arXiv cs.AI Research & Papers
The Nuts and Bolts of Natural Language to SQL Translation: A Systematic Analysis of Model…
arXiv cs.AI Research & Papers
GrandCode: Achieving Grandmaster Level in Competitive Programming via Agentic Reinforceme…
arXiv cs.AI Research & Papers
Valid $\ne$ Necessary: Diagnosing Latent Inefficiency in Chain-of-Thought
arXiv cs.AI Research & Papers
How Much Does Correctness Cost? Budgeted Placement of Strong Correctors in a Weak Multi-A…
arXiv cs.AI Research & Papers
Replicating Belief, Not Bits: Epistemic State Replication for Agentic Systems
arXiv cs.AI Research & Papers
The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Aut…
arXiv cs.AI Research & Papers
PREF-Gate: Provenance-Constrained Relational Evidence Fusion with Validation-Gated Select…
arXiv cs.AI Research & Papers
A Theory of Least Autonomy in AI
arXiv cs.AI Research & Papers
Open, Reliable, and Collective: A Community-Driven Framework for Tool-Using AI Agents
arXiv cs.AI Research & Papers
What We Talk About When We Talk About LLM Planning: Evidence for Two Distinct Planning Ab…
arXiv cs.AI Research & Papers
The Hidden Footprint: Making Storage a First-Class Metric for LLM Agent Evaluation
arXiv cs.AI Research & Papers
NextFund: A Unified Performance Tracking Platform for Agentic Portfolio Management
arXiv cs.AI Research & Papers
A Formal Hierarchical Architecture for Agentic Orchestration with Stack-Based Execution a…
arXiv cs.AI Research & Papers
NVAITC AI Scientist: A Governed End-to-End Research System -- A Hypertension GWAS Case St…
arXiv cs.AI Research & Papers
Are LLMs Ready for Scientific Discovery? A Capability-Oriented Benchmark for AI Scientists
arXiv cs.AI Research & Papers
AdvNav: Behavior-Guided Black-Box Adversarial Attacks on Vision-Language Navigation
arXiv cs.AI Research & Papers
QwenPaw-Data: Bridging Facts, Methodology, and Execution for Autonomous Enterprise Data A…
arXiv cs.AI Research & Papers
Context by Distinct Information: An Auditable Dirichlet-Process Working Memory for Long, …
arXiv cs.AI Research & Papers
Annotation-Free Furniture Codes: What They Encode, and How Far They Transfer
arXiv cs.AI Research & Papers
ARMOR: Stabilizing On-Policy LLM RL with Off-Policy Anchor Samples
arXiv cs.AI Research & Papers
Learning from Local Walks on Dynamic Graphs with Bandit Feedback