Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Rethinking the Role of Tensor Decompositions in Post-Training LLM Compression
arXiv cs.AI Research & Papers
QUBRIC: Co-Designing Queries and Rubrics for RL Beyond Verifiable Rewards
arXiv cs.AI Research & Papers
Agentic Chain-of-Thought Steering for Efficient and Controllable LLM Reasoning
arXiv cs.AI Research & Papers
Exploiting Verification-Generation Gap: Test-Time Reinforcement Learning with Confidence-…
arXiv cs.AI Research & Papers
Humanoid-GPT: Scaling Data and Structure for Zero-Shot Motion Tracking
arXiv cs.AI Research & Papers
Formalizing the Binding Problem
arXiv cs.AI Research & Papers
VidMsg: A Benchmark for Implicit Message Inference in Short Videos
arXiv cs.AI Research & Papers
ASAP: Exploiting the Satisficing Generalization Edge in Neural Combinatorial Optimization
arXiv cs.AI Research & Papers
AlphaEval: A Comprehensive and Efficient Evaluation Framework for Formula Alpha Mining
arXiv cs.AI Research & Papers
Assistax: A Multi-Agent Hardware-Accelerated Reinforcement Learning Benchmark for Assisti…
arXiv cs.AI Research & Papers
FlashMLA-ETAP: Efficient Transpose Attention Pipeline for Accelerating MLA Inference on N…
arXiv cs.AI Research & Papers
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning
arXiv cs.AI Research & Papers
ProtocolBench: Which LLM MultiAgent Protocol to Choose?
arXiv cs.AI Research & Papers
RGMem: Renormalization Group-inspired Memory Evolution for Language Agents
arXiv cs.AI Research & Papers
MIND: Multi-rationale INtegrated Discriminative Reasoning Framework for Multi-modal Large…
arXiv cs.AI Research & Papers
Introduction to optimization methods for training SciML models
arXiv cs.AI Research & Papers
An Exploration of Collision-based Enemy Morphology Generation
arXiv cs.AI Research & Papers
Strongly Polynomial Time Complexity of Policy Iteration for $L_\infty$ Robust MDPs
arXiv cs.AI Research & Papers
A Scoping Review of the Ethical Perspectives on Anthropomorphising Large Language Model-B…
arXiv cs.AI Research & Papers
Test-Time Optimization of Physical Query Plans with LLMs
arXiv cs.AI Research & Papers
Causal Neural Probabilistic Circuits
arXiv cs.AI Research & Papers
Towards a Science of AI Agent Reliability
arXiv cs.AI Research & Papers
Who Deserves the Reward? SHARP: Shapley Credit-based Optimization for Multi-Agent System
arXiv cs.AI Research & Papers
Crystal: Characterizing Relative Impact of Scholarly Publications
arXiv cs.AI Research & Papers
Evaluating Relational Reasoning in LLMs with REL
arXiv cs.AI Research & Papers
Efficient Hyperparameter Optimization for LLM Reinforcement Learning
arXiv cs.AI Research & Papers
Efficient Temporal Datalog Materialisation for Composite Event Recognition
arXiv cs.AI Research & Papers
From Context to Skills: Can Language Models Learn from Context Skillfully?
arXiv cs.AI Research & Papers
$R^2$-dLLM: Accelerating Diffusion Large Language Models via Spatio-Temporal Redundancy R…
arXiv cs.AI Research & Papers
PnP-Corrector: A Universal Correction Framework for Coupled Spatiotemporal Forecasting