Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
DAREBench: Deployment-Aware and Reliable Evaluation of Models as Agents
arXiv cs.AI Research & Papers
Agentic Pressure: The Endogenous Entropy of Reliable Autonomy
arXiv cs.AI Research & Papers
Exposing Weaknesses in Emotion Recognition in Conversations
arXiv cs.AI Research & Papers
Generator-Independent Runtime Assurance under Partial Observation
arXiv cs.AI Research & Papers
Generating Instance Generators in PDDL Planning
arXiv cs.AI Research & Papers
From Concentration to Differentiation and Back: Routing Effective Rank in MoE Reasoning C…
arXiv cs.AI Research & Papers
Learning Counterfactual World Models for Embodied Reasoning under Partial Observability
arXiv cs.AI Research & Papers
Beyond Final Decisions: A Process-Centric Benchmark for Transparent AI-Assisted Peer Revi…
arXiv cs.AI Research & Papers
AgentBrew: Offline Tool-Use Agent Learning from Raw Real-World Trajectories
arXiv cs.AI Research & Papers
When and Why LLM Causal Priors Help: Closed-Loop Prior Selection for Amortized Causal Inf…
arXiv cs.AI Research & Papers
Scoring Without the Engine: Validating a Deterministic, Manipulation-Resistant Content Sc…
arXiv cs.AI Research & Papers
Multiple Myeloma Lesion Segmentation on Whole-Body Diffusion-Weighted Imaging via Efficie…
arXiv cs.AI Research & Papers
CUSP: Decomposable Collective Uncertainty for Multi-Agent Multimodal Reasoning
arXiv cs.AI Research & Papers
Recovering Temporal and Geographic Signals from Language Model Embeddings
arXiv cs.AI Research & Papers
Learning to Focus: CSI-Free Hierarchical MARL for Reconfigurable Reflectors
arXiv cs.AI Research & Papers
Beyond Prompts: Measuring and Optimizing LLM Tool-Agent Harnesses
arXiv cs.AI Research & Papers
The convergent laboratory: when AI reasoning, autonomous experiments, high performance an…
arXiv cs.AI Research & Papers
Reducing Hallucinations in LLM-based Scientific Literature Analysis Using Peer Context Ou…
arXiv cs.AI Research & Papers
What LLM Trading Agents Actually Do in Production: A Six-Month, Population-Scale Record f…
arXiv cs.AI Research & Papers
The Normalization of Deviance in AI Development
arXiv cs.AI Research & Papers
From Monolithic Blending to Agentic Orchestration: Dynamic Response for Conversational As…
arXiv cs.AI Research & Papers
Deep belief networks are exact
arXiv cs.AI Research & Papers
EnvCraft: Synthesizing Executable Environments in Agentic RL for Claw-like Agent
arXiv cs.AI Research & Papers
Distilling Vision-Language Models for On-Device Fire Understanding
arXiv cs.AI Research & Papers
More Than Mimicking Reviewers: Evaluating LLMs for Pre-Submission Peer Review
arXiv cs.AI Research & Papers
Leveraging Cardiac Imaging to Improve ECG-Based Detection of Chagas Disease in Resource-C…
arXiv cs.AI Research & Papers
From Where to How: Continuous 4D Interaction Forecasting from Egocentric Video
arXiv cs.AI Research & Papers
Neptune: An AI model for Global Ocean Subseasonal Prediction
arXiv cs.AI Research & Papers
SynthRCT: Scalable Conditional Deformation Synthesis for Synthetic Repeat CT Generation
arXiv cs.AI Research & Papers
SciLitBench: Benchmark and Design Principles for LLM-Powered Systematic Literature Reviews