Transformer Circuits Can Realize Clustering Algorithms
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
ArchAgent v2: A Case Study with the Data Prefetching Championship
MedCalc-R1: Knowledge-Guided Reward Framework for Medical Mathematical Reasoning
CRUISE: Vision-Language Model-Guided Uncertainty-Aware Cross-Modal Sensor Fusion for Robu…
Towards Expert-level Medical AI for Real-time Video Consultations
WebChoreArena: Evaluating Web Browsing Agents on Realistic Tedious Web Tasks
From Alignment to Synthesis Contrastive Volumetric Grounding for Text-to-CT Generation
The Cell Must Go On: Agar.io for Continual Reinforcement Learning
Mismatch Matters: On-Policy Distillation Beyond Token Agreement
Transformer-Based Neural Quantum Digital Twins for Many-Body Spectral Reconstruction and …
SAKE: Structured Agentic Knowledge Extrapolation for Complex LLM Reasoning via Reinforcem…
Omni2LoRA: Coherence-Preserving Parametric Memory for Efficient Omni Language Models
Second-Order Muon Done Right: A Principled Marriage of Spectral Geometry and Curvature
TreeHop: Efficient Embedding-Level Query Rewriter
Structure-Preserving Uncertainty Propagation in First-Order Proof Search
CIDER: A Dataset of Contextual Disclosure Boundaries for Privacy Preference Alignment
TRACE: TRajectory Attribution for Automated Context Engineering
ChronoState: Hidden Elapsed-Time Conditioning for Temporal-State Action Selection in Froz…
MoRSE: Task-Oriented Multi-Agent System with Mixture of Role-Subtask Experts
RISE-RL: Rubric-Informed Selective Exploration for Open-Ended Reinforcement Learning
REMAC: Self-Reflective and Self-Evolving Multi-Agent Collaboration for Long-Horizon Robot…
RAVEN-Eval: Rubric-Guided Automatic Evaluation for AI Video Generation Models Based on LM…
Different Feedback, Different Updates: Selective Self-Learning from User Interactions for…
An Expectation-Maximization Perspective on Reinforcement Learning for LLM Reasoning
SafeSceneReason: A Multimodal Reasoning Benchmark Connecting Industrial Hazards with Acci…
CARD: Controlled Agentic Reddit Discussions for Credit Card Simulation
TSPORec: Token Selection via Preference Optimization for LLM-Based Sequential Recommendat…
LEED: Local Embedding Evolution Distance for over-smoothing estimation and virtual node s…
Neuronal Attention Circuit (NAC) for Representation Learning
MoNo: Multiscale Optimal Transport Neural Operator for Solving PDEs on General Geometries