Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Measure Before You Manage: Evaluating Agent Working Memory in Coding Agents
arXiv cs.AI Research & Papers
MA-RAG: Multi-Agent Retrieval-Augmented Generation for Query-Driven Summarization of Long…
arXiv cs.AI Research & Papers
Not All or None: Dynamic Construction of Target-aware Memory Graph for Conversational Sta…
arXiv cs.AI Research & Papers
HSRM: Hidden-State Reward Models for Test-Time Verification
arXiv cs.AI Research & Papers
Which Rules Matter Now? Policy-Centroid Routing Before an Intelligent System Acts
arXiv cs.AI Research & Papers
SkillZip Pro: Execution-Aware Dynamic Compression of Progressively Loaded Skills for Self…
arXiv cs.AI Research & Papers
CAER: Causal Action Effect Reweighting for World Model Training
arXiv cs.AI Research & Papers
ATLAS: Dual-Horizon Diagnostic Evaluation for Industrial Tool-Use Agents
arXiv cs.AI Research & Papers
Multimodal Adaptive Expert Selection with Text Routing and Ordinal Prototype Optimization…
arXiv cs.AI Research & Papers
Geometry of Divergence: Tracking Hidden-State Trajectories for Adaptive Multi-Turn Reason…
arXiv cs.AI Research & Papers
HiRS-Agent: A Hierarchical Multi-Agent System for Reliable Long-Horizon Remote Sensing Ta…
arXiv cs.AI Research & Papers
Automated Testing of LLM-Based Post Hoc Explainers Using Model Checking as an Oracle
arXiv cs.AI Models & Releases
TuringLLM: Efficiently Scaling Foundation Models Toward Physical AI
arXiv cs.AI Research & Papers
AdaPath: Query-Adaptive Path-Finding via Path-Bank for Multi-Hop Implicit Biomedical KGQA
arXiv cs.AI Research & Papers
Responsible Integration of AI in Cancer Genomics: Barriers, Risks, and Pathways to Trustw…
arXiv cs.AI Research & Papers
Designing an Auditable LLM-Supported Workflow for Qualitative Thematic Analysis
arXiv cs.AI Research & Papers
CHASE: How Content Ecosystems Are Reshaped When Ranking Is the Only Target
arXiv cs.AI Research & Papers
When Does Bigger Help? A Controlled Study of LLM Scale for Ontology Learning
arXiv cs.AI Research & Papers
DS-Lighting: Making Agent Harnesses Explicit for Data-Science Automation
arXiv cs.AI Research & Papers
Expert-validated STEM QA
arXiv cs.AI Research & Papers
Learning Action Models with Conditional and Quantified Effects via Uncertainty-Guided Exp…
arXiv cs.AI Research & Papers
MNIST-PRO: MNIST is Back as a Partially Observable World for AI Agents
arXiv cs.AI Research & Papers
CM2: Multimodal Cultural Reasoning via an Integrated Multi-Agent Framework
arXiv cs.AI Security & Safety
EvoSkill Injection: Red-Teaming Autonomous Skill Generation and Evolution in Self-Evolvin…
arXiv cs.AI Research & Papers
Action from Adjacent Set in Physical Space Outperforms the Best Prediction in World Models
arXiv cs.AI Research & Papers
Subtraction-Based Tumor Segmentation and Lesion-Centered pCR Prediction for the MAMA-MIA …
arXiv cs.AI Research & Papers
Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Hori…
arXiv cs.AI Research & Papers
Data Intelligence Agents: Interpreting, Modeling, and Querying Enterprise Data via Autono…
arXiv cs.AI Research & Papers
Augmenting Human Performance with an XR Agent Learning from Online Behavior and BCI Evide…
arXiv cs.AI Research & Papers
Answer Probing-Guided Search for Diverse Solution Exploration of LLMs