Explorar

Noticias de IA

22116 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Calibrated Selective Fact-Checking via Evidence Chain Evaluation
arXiv cs.AI Research & Papers
SysAdmin: Measuring Instrumental Power-Seeking in Frontier AI
arXiv cs.AI Research & Papers
Lifting Embodied World Models for Planning and Control
arXiv cs.AI Research & Papers
Why Do Vision Language Models Struggle To Recognize Human Emotions?
arXiv cs.AI Research & Papers
Robust Reasoning Benchmark
arXiv cs.AI Research & Papers
Team RAS in 11th ABAW Competition: Multimodal Ambivalence Recognition Approach
arXiv cs.AI Research & Papers
LakeQuest: A Three-Domain Benchmark for Grounded Question Answering across Data Lakes
arXiv cs.AI Research & Papers
Tunable MAGMAX: Preference-Aware Model Merging for Continual Learning
arXiv cs.AI Research & Papers
Global Automation Atlas
arXiv cs.AI Research & Papers
AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report
arXiv cs.AI Research & Papers
Operational Hallucination and Safety Drift in AI Agents
arXiv cs.AI Research & Papers
Deep Reinforcement Learning to Master the Asymmetric Strategy of Baghchal
arXiv cs.AI Research & Papers
Using LLMs for Explainable, Data-Driven Insight Generation from Time Series
arXiv cs.AI Research & Papers
Wisdom of LLM Crowds: Aggregation and Contamination in Language Model Ensembles
arXiv cs.AI Research & Papers
Large Language Models Explore by Latent Distilling
arXiv cs.AI Research & Papers
When Agents Disagree: The Selection Bottleneck in Multi-Agent LLM Pipelines
arXiv cs.AI Research & Papers
Fly0: Persistent Metric Anchoring for Zero-Shot Aerial Vision-Language Navigation
arXiv cs.AI Research & Papers
CompilerKV: Risk-Adaptive KV Compression via Offline Experience Compilation
arXiv cs.AI Research & Papers
LinguistAgent Technical Report: A Reflective Multi-Model Platform for Automated Linguisti…
arXiv cs.AI Research & Papers
State Compression in Two-Agent LLM Relays: A Closed-World Study of Constraint Preservation
arXiv cs.AI Research & Papers
MUX: Continuous Reasoning via Multiplexed Tokens
arXiv cs.AI Research & Papers
ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learni…
arXiv cs.AI Research & Papers
ProbSPARQL: Querying Knowledge Graphs with Multi-dimensional, Uncertain Numeric Data
arXiv cs.AI Research & Papers
FindStatBench: Evaluating Large Language Models on Combinatorial Code Synthesis
arXiv cs.AI Research & Papers
S2T-RLHF: Hierarchical Credit Assignment for Stable Preference-Based RLHF
arXiv cs.AI Research & Papers
Hyperdimensional Probe: Decoding LLM Representations via Vector Symbolic Architectures
arXiv cs.AI Research & Papers
PEARL: Solver-in-the-Loop Interactive Optimization Modeling from Natural Language
arXiv cs.AI Research & Papers
Cross-Dialect Generalization Without Retraining: Benchmarks and Evaluation of Schema-Deri…
arXiv cs.AI Research & Papers
Training and Simulation of Quadrupedal Robot in Adaptive Stair Climbing and Descending fo…
arXiv cs.AI Research & Papers
MILP-Evo: Closed-Loop Fully Automatic Design of MILP Solvers