Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Beyond One-Shot Expansion: Contrastive Evidence Exploration for Multi-Hop Retrieval
arXiv cs.AI Research & Papers
FedRAW: Preserving Rare-Label Influence in Asynchronous Federated Learning
arXiv cs.AI Research & Papers
Query-Aware Token Budgeting for Efficient Late-Interaction Visual Document Retrieval
arXiv cs.AI Research & Papers
Generator-Independent Runtime Assurance under Partial Observation
arXiv cs.AI Research & Papers
Agentic Pressure: The Endogenous Entropy of Reliable Autonomy
arXiv cs.AI Research & Papers
DAREBench: Deployment-Aware and Reliable Evaluation of Models as Agents
arXiv cs.AI Research & Papers
Scratchy: Visual-Scratchpad Multimodal Reasoning for Cryptographic Proof Generation in Ea…
arXiv cs.AI Research & Papers
Generating Instance Generators in PDDL Planning
arXiv cs.AI Research & Papers
AgentBrew: Offline Tool-Use Agent Learning from Raw Real-World Trajectories
arXiv cs.AI Research & Papers
When and Why LLM Causal Priors Help: Closed-Loop Prior Selection for Amortized Causal Inf…
arXiv cs.AI Research & Papers
Modus Tollens and Counterfactuals and Counterfactual Reasoning Based on Three Types of Ne…
arXiv cs.AI Research & Papers
Exposing Weaknesses in Emotion Recognition in Conversations
arXiv cs.AI Research & Papers
SCIRIGOR:Evaluating Open-Ended Scientific Analysis Beyond Final Scores
arXiv cs.AI Research & Papers
Distilling Vision-Language Models for On-Device Fire Understanding
arXiv cs.AI Research & Papers
More Than Mimicking Reviewers: Evaluating LLMs for Pre-Submission Peer Review
arXiv cs.AI Research & Papers
From Monolithic Blending to Agentic Orchestration: Dynamic Response for Conversational As…
arXiv cs.AI Research & Papers
Beyond Final Decisions: A Process-Centric Benchmark for Transparent AI-Assisted Peer Revi…
arXiv cs.AI Research & Papers
The Normalization of Deviance in AI Development
arXiv cs.AI Research & Papers
Learning Counterfactual World Models for Embodied Reasoning under Partial Observability
arXiv cs.AI Research & Papers
Predicting Wind Turbine Power Using Machine Learning and Weather Forecasts
arXiv cs.AI Research & Papers
VST: Verifiable Structured Transport for Auditable Agent-to-Agent Alpha Discovery
arXiv cs.AI Research & Papers
Matryoshka Hash Representations for Model-Aware Compact Semantic Retrieval
arXiv cs.AI Research & Papers
The convergent laboratory: when AI reasoning, autonomous experiments, high performance an…
arXiv cs.AI Research & Papers
What LLM Trading Agents Actually Do in Production: A Six-Month, Population-Scale Record f…
arXiv cs.AI Research & Papers
CUSP: Decomposable Collective Uncertainty for Multi-Agent Multimodal Reasoning
arXiv cs.AI Research & Papers
Recovering Temporal and Geographic Signals from Language Model Embeddings
arXiv cs.AI Research & Papers
CIVI: A Framework for Diagnosing Search Agent Failures in Civic Information
arXiv cs.AI Research & Papers
The Failure Happens Before the Drift: The Social Dynamics of Values in LLM Agent Societies
arXiv cs.AI Research & Papers
Beyond "AI Helps Humans": Decision-Targeted Evaluation Design for Human-Agent Teams in th…
arXiv cs.AI Research & Papers
Deep belief networks are exact