Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Transformer Circuits Can Realize Clustering Algorithms
arXiv cs.AI Research & Papers
ArchAgent v2: A Case Study with the Data Prefetching Championship
arXiv cs.AI Research & Papers
MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning
arXiv cs.AI Research & Papers
CRUISE: Vision-Language Model-Guided Uncertainty-Aware Cross-Modal Sensor Fusion for Robu…
arXiv cs.AI Research & Papers
Towards Expert-level Medical AI for Real-time Video Consultations
arXiv cs.AI Research & Papers
WebChoreArena: Evaluating Web Browsing Agents on Realistic Tedious Web Tasks
arXiv cs.AI Research & Papers
From Alignment to Synthesis Contrastive Volumetric Grounding for Text-to-CT Generation
arXiv cs.AI Research & Papers
The Cell Must Go On: Agar.io for Continual Reinforcement Learning
arXiv cs.AI Research & Papers
Mismatch Matters: On-Policy Distillation Beyond Token Agreement
arXiv cs.AI Research & Papers
Transformer-Based Neural Quantum Digital Twins for Many-Body Spectral Reconstruction and …
arXiv cs.AI Research & Papers
SAKE: Structured Agentic Knowledge Extrapolation for Complex LLM Reasoning via Reinforcem…
arXiv cs.AI Research & Papers
Omni2LoRA: Coherence-Preserving Parametric Memory for Efficient Omni Language Models
arXiv cs.AI Research & Papers
Second-Order Muon Done Right: A Principled Marriage of Spectral Geometry and Curvature
arXiv cs.AI Research & Papers
TreeHop: Efficient Embedding-Level Query Rewriter
arXiv cs.AI Research & Papers
Structure-Preserving Uncertainty Propagation in First-Order Proof Search
arXiv cs.AI Research & Papers
CIDER: A Dataset of Contextual Disclosure Boundaries for Privacy Preference Alignment
arXiv cs.AI Research & Papers
TRACE: TRajectory Attribution for Automated Context Engineering
arXiv cs.AI Research & Papers
ChronoState: Hidden Elapsed-Time Conditioning for Temporal-State Action Selection in Froz…
arXiv cs.AI Research & Papers
MoRSE: Task-Oriented Multi-Agent System with Mixture of Role-Subtask Experts
arXiv cs.AI Research & Papers
RISE-RL: Rubric-Informed Selective Exploration for Open-Ended Reinforcement Learning
arXiv cs.AI Research & Papers
REMAC: Self-Reflective and Self-Evolving Multi-Agent Collaboration for Long-Horizon Robot…
arXiv cs.AI Research & Papers
RAVEN-Eval: Rubric-Guided Automatic Evaluation for AI Video Generation Models Based on LM…
arXiv cs.AI Research & Papers
Different Feedback, Different Updates: Selective Self-Learning from User Interactions for…
arXiv cs.AI Research & Papers
An Expectation-Maximization Perspective on Reinforcement Learning for LLM Reasoning
arXiv cs.AI Research & Papers
SafeSceneReason: A Multimodal Reasoning Benchmark Connecting Industrial Hazards with Acci…
arXiv cs.AI Research & Papers
CARD: Controlled Agentic Reddit Discussions for Credit Card Simulation
arXiv cs.AI Research & Papers
TSPORec: Token Selection via Preference Optimization for LLM-Based Sequential Recommendat…
arXiv cs.AI Research & Papers
LEED: Local Embedding Evolution Distance for over-smoothing estimation and virtual node s…
arXiv cs.AI Research & Papers
Neuronal Attention Circuit (NAC) for Representation Learning
arXiv cs.AI Research & Papers
MoNo: Multiscale Optimal Transport Neural Operator for Solving PDEs on General Geometries