Explorar

Noticias de IA

21813 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
LogitScope: A Framework for Analyzing LLM Uncertainty Through Information Metrics
arXiv cs.AI Research & Papers
OR-Agent: Bridging Evolutionary Search and Structured Research for Automated Algorithm Di…
arXiv cs.AI Research & Papers
AI-Based Sound Effect Generation: A Narrative Review of Generative Models Across Input Mo…
arXiv cs.AI Research & Papers
Adaptive Modality Reliability Diagnosis and Restoration for Robust Multimodal Intent Reco…
arXiv cs.AI Research & Papers
Route-Align-Verify for Functional Correctness in Code Generation
arXiv cs.AI Research & Papers
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
arXiv cs.AI Research & Papers
When Oracle Conditioning Misleads Deployment: Conditioning-Availability Bias in Echocardi…
arXiv cs.AI Research & Papers
FACTWASH: Catching AI Rewrites That Wash Hearsay into Fact
arXiv cs.AI Research & Papers
Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces
arXiv cs.AI Research & Papers
UniNav: A Unified World-Action Diffusion Model for Visual Navigation
arXiv cs.AI Research & Papers
Shaping Wind-Tunnel Airflow for Unmanned Aerial Vehicles using Online Learning
arXiv cs.AI Research & Papers
Evaluating LLM Trade-offs for Enterprise Automation: Lessons from Workflow Generation in …
arXiv cs.AI Research & Papers
CUADebug: Diagnosing and Repairing Computer-Use Agent Failures
arXiv cs.AI Research & Papers
From Wearable Data to Personalized and Actionable Health Insights
arXiv cs.AI Research & Papers
FinVerse: Financial Time-Series Benchmark
arXiv cs.AI Research & Papers
The Ignition Is Real, and It Lives at the Readout: Latent composition, difficulty-clocked…
arXiv cs.AI Research & Papers
Efficient Video Dataset Distillation via Cluster-Guided Prototype Blending
arXiv cs.AI Research & Papers
Fail-Fast, Restart-Smart: Early Failure Prediction and Restart for SWE Agentic Tasks
arXiv cs.AI Research & Papers
EduClaw-Bench: A Long-Horizon Benchmark for Pedagogical LLM Agents with Simulated Learners
arXiv cs.AI Research & Papers
EFX Allocation In (Multi)Hypergraphs
arXiv cs.AI Research & Papers
GROW: Group-Relative Advantage-Weighted On-Policy Reinforcement Learning of Autoregressiv…
arXiv cs.AI Research & Papers
Self-Supervised Representation-Guided Generative Dataset Distillation
arXiv cs.AI Research & Papers
The Agent Operating System (AOS): A Reference Operating Architecture for Distributed Agen…
arXiv cs.AI Research & Papers
The Tell-Tale Trace: Detecting Reasoning Failures in LLMs Using Chain-of-Thought Dynamics
arXiv cs.AI Research & Papers
Cross-Anesthetic ECoG State Decoding Fails at the Decision Threshold, Not the Representat…
arXiv cs.AI Research & Papers
Subjective Risk Decomposition: A New View for Uncertainty Quantification
arXiv cs.AI Research & Papers
MIMIC-MJX: Neuromechanical Emulation of Animal Behavior
arXiv cs.AI Research & Papers
A game theory for foundation models shows new paths to rational cooperation through simil…
arXiv cs.AI Research & Papers
In-Context Pure Exploration in Continuous Decision Spaces
arXiv cs.AI Research & Papers
Evaluating LLM-Based Goal Extraction in Requirements Engineering: Prompting Strategies an…