Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Certified Policy Optimisation for Nested Causal Bandits via PAC-Bayes Risk
arXiv cs.AI Research & Papers
Unveiling Multi-regime Patterns in SciML: Distinct Failure Modes and Regime-specific Opti…
arXiv cs.AI Research & Papers
SAAS: Self-Aware Reinforcement Learning for Over-Search Mitigation in Agentic Search
arXiv cs.AI Research & Papers
A Minimal Bifurcation Model of Load Imbalance in a Softmax Mixture-of-Experts Router
arXiv cs.AI Research & Papers
When and How Long? The Readout-Mediator Angle in Temporal Reasoning
arXiv cs.AI Research & Papers
Test Time Training for Supervised Causal Learning
arXiv cs.AI Research & Papers
Do Proactive Agents Really Need an LLM to Decide When to Wake and What to Anchor?
arXiv cs.AI Research & Papers
On the Geometry of Games and their Solvers
arXiv cs.AI Research & Papers
Make LLM Learn to Synthesize from Streaming Experiences through Feedback
arXiv cs.AI Research & Papers
No More K-means:Single-Stage Sparse Coding for Efficient Multi-Vector Retrieval
arXiv cs.AI Research & Papers
A Predictive Law for On-Policy Self-Distillation From World Feedback
arXiv cs.AI Research & Papers
Accelerating Constrained Decoding with Token Space Compression
arXiv cs.AI Research & Papers
RAISE: RAG Design as an Architecture Search Problem
arXiv cs.AI Research & Papers
Teaching Values to Machines: Simulating Human-Like Behavior in LLMs
arXiv cs.AI Research & Papers
Same Question, Different Source, Different Answer: Auditing Source-Dependence in Medical …
arXiv cs.AI Research & Papers
Selective QA over Conflicting Multi-Source Personal Memory: A Diagnostic Testbed and Meth…
arXiv cs.AI Research & Papers
Anchorless Diversification for Parallel LLM Ideation
arXiv cs.AI Research & Papers
Temporal Stability and Few-Shot Prompting in Math Task Assessment
arXiv cs.AI Research & Papers
Entropy-KL Divergence-based Token Masking: A Novel Approach for Selective Fine-tuning of …
arXiv cs.AI Research & Papers
Modularizing Educational LLM-Agency for Fostering Responsible Learning Assistance
arXiv cs.AI Research & Papers
Agora: Toward Autonomous Bug Detection in Production-Level Consensus Protocols with LLM A…
arXiv cs.AI Research & Papers
Double-Edged Sword or Sharp Tool? Designing and Evaluating Triadic LLM-Teacher Collaborat…
arXiv cs.AI Research & Papers
Return-to-Go Is More Than a Number: Q-Guided Alignment for Return-Conditioned Supervised …
arXiv cs.AI Research & Papers
mcp-proto-okn: Natural-language access to open scientific knowledge graphs through the Mo…
arXiv cs.AI Research & Papers
MINDGAMES: A Live Arena for Evaluating Social and Strategic Reasoning in Multi-Agent LLMs
arXiv cs.AI Research & Papers
CRITIC-R1: Learning Structured Critics for Retrieval-Augmented Generation
arXiv cs.AI Research & Papers
Tiny but Trusted: Efficient Vision-Language Reasoning for Time-Series Anomaly Detection
arXiv cs.AI Research & Papers
Micro-Macro Retrieval: Reducing Long-Form Hallucination in Large Language Models
arXiv cs.AI Research & Papers
Towards Verifiable Multimodal Deep Research: A Multi-Agent Harness for Interleaved Report…
arXiv cs.AI Research & Papers
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models