Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Proactive Service Agents: A Unified Decision Framework, Methods, and Evaluation
arXiv cs.AI Research & Papers
Analysis of Prompt Engineering for Drug Toxicity Prediction
arXiv cs.AI Research & Papers
SimSkill: A Lifelong Learning AI Agent for Autonomous Mastery of Traffic Simulation
arXiv cs.AI Research & Papers
Counterfactual Routing Using Integer Programming with Constraint Generation
arXiv cs.AI Research & Papers
Rethinking World Models for Safety-Critical Embodied Systems
arXiv cs.AI Research & Papers
GPS-Bench: A Governance Policy Benchmark for Automating Policy Analysis
arXiv cs.AI Research & Papers
HalluPeer: A Taxonomy-driven Benchmark for Detecting Hallucinations in Scientific Peer Re…
arXiv cs.AI Research & Papers
The Attention Triangle in Audio-Video Models
arXiv cs.AI Research & Papers
KC-Bench: A Dynamic Interactive Benchmark for Evaluating Knowledge Conflicts in LLM Agents
arXiv cs.AI Research & Papers
NeoRed: A Knowledge-Logic-Alignment Multimodal Large Language Model for Neonatal Respirat…
arXiv cs.AI Research & Papers
Feature Reconfiguration With Visual Prior for Medical Lesion Segmentation
arXiv cs.AI Research & Papers
DNative-Twin: Decision Graphs and Digital Twins for Reconstructable Agentic Decisions
arXiv cs.AI Research & Papers
CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning
arXiv cs.AI Research & Papers
AutoGraphForge: Towards Automated Graph Theory Discovery
arXiv cs.AI Research & Papers
PPO-STGNN: A Proximal Policy Optimization Approach with Spatio-Temporal Graph Neural Netw…
arXiv cs.AI Research & Papers
What Matters for Aggressive Decoding-Time KV Eviction? Temporal Aggregation and Ranking P…
arXiv cs.AI Research & Papers
Do GUI Agents Know When Not to Act? Enabling Conflict-Aware Termination for Multimodal GU…
arXiv cs.AI Research & Papers
Interface-Induced Trajectory Censoring
arXiv cs.AI Research & Papers
Beyond "Made with AI": Visualizing Provenance Density to Mitigate the Transparency Penalty
arXiv cs.AI Research & Papers
A Prompt-Engineering Approach to Develop Scalable, Flexible, and Real-Time Hybrid Micro-L…
arXiv cs.AI Research & Papers
Caught in the Story: Narrative Captivity in Multi-turn LLMs Conversation
arXiv cs.AI Research & Papers
DuplexSpeechBench-IFEval: Evaluating Implicit Instruction Following in Full-Duplex Voice …
arXiv cs.AI Research & Papers
GrowPage: On-Demand KV Budgeting for Efficient LLM Reasoning Serving
arXiv cs.AI Research & Papers
Fresh Memory, Stale Plans: Dependency-Scoped Validation for Distributed LLM-Agent Memory
arXiv cs.AI Research & Papers
MasterControl Seventeen Every Time
arXiv cs.AI Research & Papers
</think> Doesn't Stop Reasoning: Analysis of Spurious CoT Termination
arXiv cs.AI Security & Safety
A Blind Trust, the Bloody Thrust: When Attacker-Controlled Hook Updates Steer AI Agent Ha…
arXiv cs.AI Research & Papers
Masked Autoregressive Speech Enhancement with Continuous Neural Audio Codec Representatio…
arXiv cs.AI Research & Papers
Common-Witness Certificates and Sharp Feature Bounds for Counterfactual Image Auditing
arXiv cs.AI Research & Papers
FailBench: How Reliable are VLMs at Judging Robot Task Success?