Explorar

Noticias de IA

21010 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
HYDRA: Hyperbolic Dynamic Representation Architecture for Kolmogorov-Arnold Networks
arXiv cs.AI Research & Papers
The Sleeping Agent: What Gist-Based Context Compression Loses and Why
arXiv cs.AI Research & Papers
Dynamics Models for Offline Hyperparameter Selection in Real-World RL
arXiv cs.AI Research & Papers
Let it Cook: Learning to Wait in Sequential Decision Making
arXiv cs.AI Research & Papers
Can Frontier LLMs Match Natively Multimodal Embeddings? A Comparison on Hard-Negative Tex…
arXiv cs.AI Research & Papers
VAKRA: Evaluating Multi-Hop Reasoning Across APIs and Retrieval Under Tool-Use Policies
arXiv cs.AI Research & Papers
Backdoor Decontamination Dynamics in LLM Agents
arXiv cs.AI Research & Papers
EnterpriseRAG: Benchmarking LLM Instruction Adherence and Robustness under Non-Ideal Ente…
arXiv cs.AI Research & Papers
Consolidator: Learning Persistent Routed Memory Across Context Boundaries
arXiv cs.AI Research & Papers
Distribird: Literature-Informed Prior Distribution Design for Bayesian Model Calibration
arXiv cs.AI Research & Papers
Benchmarking LLM Judges for Mobile Agent Evaluation
arXiv cs.AI Research & Papers
CTBench: Evaluating Troubleshooting Capabilities of AI Agents in Realistic Telecom Networ…
arXiv cs.AI Research & Papers
From Safety Documentation to Safety Knowledge Support: An Evidence-Grounded LLM Framework…
arXiv cs.AI Research & Papers
Every pooling rule has its world: matching probability combination rules to situations an…
arXiv cs.AI Research & Papers
Federated Learning for Distributed CNC Tool Wear Prediction
arXiv cs.AI Research & Papers
Learning from Online User Feedback for Shopping Agents
arXiv cs.AI Research & Papers
Variable Selection in the Context of AI Fairness
arXiv cs.AI Research & Papers
RecSys Factory: Bounding LLM Agent Autonomy to Decision Points in the Industrial Recommen…
arXiv cs.AI Research & Papers
VICBench: A Multi-Language Benchmark for Code Vulnerability Detection
arXiv cs.AI Research & Papers
High-dimensional Multi-objective Bayesian Optimization with Learned Variable Interactions
arXiv cs.AI Research & Papers
EvoGraph-Mem: Failure-Aware Editable Graph Memory for Long-Term Language Agents
arXiv cs.AI Research & Papers
Inverse Theory of Mind Modeling for Content Recommendation: From Web Browsing to Dynamic …
arXiv cs.AI Research & Papers
Social Meaning in Large Language Models: Structure, Magnitude, and Pragmatic Prompting
arXiv cs.AI Research & Papers
TRACE Bench: Task-driven Roleplay Agentic Checklist Evaluation
arXiv cs.AI Research & Papers
One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL
arXiv cs.AI Research & Papers
Adaptive Hybrid Particle Swarm Optimization with Gradient Descent
arXiv cs.AI Research & Papers
User-Assisted Collaborative Distributed Inference for Efficient QoS-Aware Autoscaling
arXiv cs.AI Research & Papers
Information Abundance Paradox: Long-Context Training Undermines Parametric Knowledge
arXiv cs.AI Research & Papers
Backtrader-Bench: Benchmarking LLM Agents on Algorithmic Trading with Self-Generated MCQs
arXiv cs.AI Research & Papers
No One to Blame: A Framework of Constitutive AI Unaccountability