Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
When Helping Hurts and How to Fix It: Multi-Agent Debate for Data Cleaning
arXiv cs.AI Research & Papers
From Answers to States: Verifiable Process-Level Evaluation of Chemical Reasoning in Larg…
arXiv cs.AI Research & Papers
The DeepSpeak-Agentic Dataset
arXiv cs.AI Research & Papers
Aletheia: What Makes RLVR For Code Verifiers Tick?
arXiv cs.AI Research & Papers
From Prompt to Service: An SLM-Based Agent Orchestration Gateway for AI-Driven Virtual Wo…
arXiv cs.AI Research & Papers
Cross-Lingual Token Arbitrage: Optimizing Code Agent Context Windows via Local LLM Prepro…
arXiv cs.AI Research & Papers
Gender-Dependent Diagnostic Substitution in LLM Medical Triage: Same Symptoms, Unequal Ur…
arXiv cs.AI Research & Papers
StepFinder: A Temporal Semantic Framework for Failure Attribution in Multi-Agent Systems
arXiv cs.AI Research & Papers
EntangleCodec: A Unified Discrete Audio Tokenizer via Semantic-Acoustic Entanglement
arXiv cs.AI Research & Papers
RelGT-AC: A Relational Graph Transformer for Autocomplete Tasks in Relational Databases
arXiv cs.AI Research & Papers
Enhancing Operational Safety via Agentic Dialogue Hazard Identification Analysis
arXiv cs.AI Research & Papers
See Less, Specify More: Visual Evidence Budgets for Generalizable VLAs
arXiv cs.AI Research & Papers
MedCUA-Bench: A Screenshot-Only Benchmark for Clinical Computer-Use Agents
arXiv cs.AI Research & Papers
Margin Play: A Multi-Agent System For Public Policy Analysis In The Brazilian Equatorial …
arXiv cs.AI Research & Papers
Samudra 2: Scaling Ocean Emulators across Resolutions
arXiv cs.AI Research & Papers
Building Better Activation Oracles
arXiv cs.AI Research & Papers
Code-on-Graph: Iterative Programmatic Reasoning via Large Language Models on Knowledge Gr…
arXiv cs.AI Research & Papers
TSQAgent: Rating Time Series Data Quality via Dedicated Agentic Reasoning
arXiv cs.AI Research & Papers
WISE-HAR: A Generalizable Ensemble Deep Learning Framework for WiFi-Based Human Activity …
arXiv cs.AI Research & Papers
What Benchmarks Don't Measure: The Case for Evaluating Abstention Competence in Autonomou…
arXiv cs.AI Research & Papers
A formal definition and meta-model for a machine theory of mind
arXiv cs.AI Research & Papers
Co-evolving Agent Architectures and Interpretable Reasoning for Automated Optimization
arXiv cs.AI Research & Papers
FRED: A Multi-Modal Autonomous Driving Dataset for Flooded Road Environments
arXiv cs.AI Research & Papers
ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning
arXiv cs.AI Research & Papers
SAGE: A Quantitative Evaluation of Socialized Evolution in Agent Ecosystems
arXiv cs.AI Research & Papers
Traj-Evolve: A Self-Evolving Multi-Agent System for Patient Trajectory Modeling in Lung C…
arXiv cs.AI Research & Papers
The Violation Situation Pattern: A Knowledge-Graph Pattern for Compliance Violations
arXiv cs.AI Research & Papers
InfoMem: Training Long-Context Memory Agents with Answer-Conditioned Information Gain
arXiv cs.AI Research & Papers
CP-Agent: Context-Aware Multimodal Reasoning for Cellular Morphological Profiling under C…
arXiv cs.AI Research & Papers
From Long News to Accurate Forecast: Importance-Aware Fusion and PRM-Guided Reflection fo…