Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
When and Why LLM Causal Priors Help: Closed-Loop Prior Selection for Amortized Causal Inf…
arXiv cs.AI Research & Papers
Exposing Weaknesses in Emotion Recognition in Conversations
arXiv cs.AI Research & Papers
Quantile-Led Feature Extraction for Multi-Horizon Predictive Maintenance in Industrial Ma…
arXiv cs.AI Research & Papers
Beyond Final Decisions: A Process-Centric Benchmark for Transparent AI-Assisted Peer Revi…
arXiv cs.AI Research & Papers
Learning Counterfactual World Models for Embodied Reasoning under Partial Observability
arXiv cs.AI Research & Papers
AgentBrew: Offline Tool-Use Agent Learning from Raw Real-World Trajectories
arXiv cs.AI Research & Papers
Agentic Pressure: The Endogenous Entropy of Reliable Autonomy
arXiv cs.AI Research & Papers
The Normalization of Deviance in AI Development
arXiv cs.AI Research & Papers
Modus Tollens and Counterfactuals and Counterfactual Reasoning Based on Three Types of Ne…
arXiv cs.AI Research & Papers
Beyond Prompts: Measuring and Optimizing LLM Tool-Agent Harnesses
arXiv cs.AI Research & Papers
From Monolithic Blending to Agentic Orchestration: Dynamic Response for Conversational As…
arXiv cs.AI Research & Papers
Reducing Hallucinations in LLM-based Scientific Literature Analysis Using Peer Context Ou…
arXiv cs.AI Research & Papers
Learning to Focus: CSI-Free Hierarchical MARL for Reconfigurable Reflectors
arXiv cs.AI Research & Papers
CUSP: Decomposable Collective Uncertainty for Multi-Agent Multimodal Reasoning
arXiv cs.AI Research & Papers
Recovering Temporal and Geographic Signals from Language Model Embeddings
arXiv cs.AI Research & Papers
Distilling Vision-Language Models for On-Device Fire Understanding
arXiv cs.AI Research & Papers
More Than Mimicking Reviewers: Evaluating LLMs for Pre-Submission Peer Review
arXiv cs.AI Research & Papers
Generator-Independent Runtime Assurance under Partial Observation
arXiv cs.AI Research & Papers
Towards Embodied Air-Ground Cooperative Object Search: Benchmark, Dataset and Agentic Met…
arXiv cs.AI Research & Papers
DAREBench: Deployment-Aware and Reliable Evaluation of Models as Agents
arXiv cs.AI Research & Papers
Deep belief networks are exact
arXiv cs.AI Research & Papers
EnvCraft: Synthesizing Executable Environments in Agentic RL for Claw-like Agent
arXiv cs.AI Research & Papers
The convergent laboratory: when AI reasoning, autonomous experiments, high performance an…
arXiv cs.AI Research & Papers
The Failure Happens Before the Drift: The Social Dynamics of Values in LLM Agent Societies
arXiv cs.AI Research & Papers
Reasoning-Aware Compression: Identifying and Protecting Vulnerable Reasoning Circuits for…
arXiv cs.AI Research & Papers
Beyond "AI Helps Humans": Decision-Targeted Evaluation Design for Human-Agent Teams in th…
arXiv cs.AI Research & Papers
What LLM Trading Agents Actually Do in Production: A Six-Month, Population-Scale Record f…
arXiv cs.AI Research & Papers
Generating Instance Generators in PDDL Planning
arXiv cs.AI Research & Papers
SynthRCT: Scalable Conditional Deformation Synthesis for Synthetic Repeat CT Generation
arXiv cs.AI Research & Papers
From Where to How: Continuous 4D Interaction Forecasting from Egocentric Video