Explorar

Noticias de IA

21863 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Clustered Self-Assessment: A Simple yet Effective Method for Uncertainty Quantification i…
arXiv cs.AI Research & Papers
Agent libOS: A Library-OS-Inspired Runtime for Long-Running, Capability-Controlled LLM Ag…
arXiv cs.AI Research & Papers
Synthesize and Reward -- Reinforcement Learning for Multi-Step Tool Use in Live Environme…
arXiv cs.AI Research & Papers
Beyond Encoder Accumulation: Measuring Encoder Roles in Multi-Encoder VLMs
arXiv cs.AI Research & Papers
From 'What' to 'How' and 'Why': Sharing LLM-Generated Retrospective Summaries of Older Ad…
arXiv cs.AI Research & Papers
Using Reward Uncertainty to Induce Diverse Behaviour in Reinforcement Learning
arXiv cs.AI Research & Papers
FlashbackCL: Mitigating Temporal Forgetting in Federated Learning
arXiv cs.AI Research & Papers
QUBRIC: Co-Designing Queries and Rubrics for RL Beyond Verifiable Rewards
arXiv cs.AI Research & Papers
Agentic Chain-of-Thought Steering for Efficient and Controllable LLM Reasoning
arXiv cs.AI Research & Papers
Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking
arXiv cs.AI Research & Papers
Formalizing the Binding Problem
arXiv cs.AI Research & Papers
AlphaEval: A Comprehensive and Efficient Evaluation Framework for Formula Alpha Mining
arXiv cs.AI Research & Papers
Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assisti…
arXiv cs.AI Research & Papers
ProtocolBench: Which LLM MultiAgent Protocol to Choose?
arXiv cs.AI Research & Papers
RGMem: Renormalization Group-inspired Memory Evolution for Language Agents
arXiv cs.AI Research & Papers
MIND: Multi-rationale INtegrated Discriminative Reasoning Framework for Multi-modal Large…
arXiv cs.AI Research & Papers
Strongly Polynomial Time Complexity of Policy Iteration for $L_\infty$ Robust MDPs
arXiv cs.AI Research & Papers
A Scoping Review of the Ethical Perspectives on Anthropomorphising Large Language Model-B…
arXiv cs.AI Research & Papers
Towards a Science of AI Agent Reliability
arXiv cs.AI Research & Papers
Who Deserves the Reward? SHARP: Shapley Credit-based Optimization for Multi-Agent System
arXiv cs.AI Research & Papers
Towards Robust Sequential Decomposition for Complex Image Editing
arXiv cs.AI Research & Papers
Evaluating Relational Reasoning in LLMs with REL
arXiv cs.AI Research & Papers
ProEval: Proactive Failure Discovery and Efficient Performance Estimation for Generative …
arXiv cs.AI Research & Papers
$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy R…
arXiv cs.AI Research & Papers
Efficient Hyperparameter Optimization for LLM Reinforcement Learning
arXiv cs.AI Research & Papers
Efficient Temporal Datalog Materialisation for Composite Event Recognition
arXiv cs.AI Research & Papers
From Context to Skills: Can Language Models Learn from Context Skillfully?
arXiv cs.AI Research & Papers
Crystal: Characterizing Relative Impact of Scholarly Publications
arXiv cs.AI Research & Papers
Causal Neural Probabilistic Circuits
arXiv cs.AI Research & Papers
PnP-Corrector: A Universal Correction Framework for Coupled Spatiotemporal Forecasting