Momentum for Reasoning: Dense Intrinsic Signals in Policy Optimization
Explorar
Noticias de IA
22114 elementos — filtrados, clasificados y sin duplicados
Contemporary AI lacks the imagination to diverge or negate in science
AeroSpectra Sentinel: An Auditable LLM Prompt-Chaining Decision-Support Workflow for Acut…
Can the Environment Speak for Itself? $T^{2}$-GRPO: A Turn-Trajectory Group Relative Poli…
Beyond Additivity: Causal Discovery in Location-Scale Noise Models with Hidden Variables
Frequency-Domain Latent Attention Gating for Cross-Domain Token Aggregation
Explaining Data Mixing Scaling Laws
LogNEO: A GPT-Neo Reinforcement Learning Framework for Accurate Real-Time Log Anomaly Det…
LCAM: A Framework for Diagnosing Interactional Alignment Failures in Con-versational AI
Ego-Pi: VLA Fine-Tuning for Ego-Centric Human and Robot Data
Continual Quadruped Robots Coordination via Semantic Skill Discovery
Aligned but Not Partner-Specific: Distinguishing How Multimodal LLM Agents Succeed in Ref…
Robust-U1: Can MLLMs Self-Recover Corrupted Visual Content for Robust Understanding?
EgoAERO: Learning Dexterous Manipulation from a Single Egocentric Video without Object As…
Sci-Rho: A Multilingual Visually-Grounded Symbolic Benchmark for STEM Problems
Graph2Idea:Retrieval-Augmented Scientific Idea Generation with Graph-Structured Contexts
CausShield: Sample Reconstruction-Resilient Vertical FL via Causal Representation Learning
IEA: Amateur-Friendly Conversational Image Editing Agent via Three Stages of Multitask Al…
Repair Before Veto, When Repair Is Hidden: Quantum-Accessible Features for Repair-Augment…
GVC-Seg: Training-Free 3D Instance Segmentation via Geometric Visual Correspondence
Rewrite to Translate, Translate to Reward: Reinforcement Learning for Source Rewriting in…
Enhancing AI Interpretability and Safety through Localised Architectures
MC-PDD: Masked Corpus-Level Pretraining Data Detection for Black-Box Large Language Models
PRISM: PRior-guided Imagination Sampling in world Models
A Regret Minimization Framework on Preference Learning in Large Language Models
IMUG-Bench: Benchmarking Unified Multimodal Models on Interleaved Understanding and Gener…
Neutrality Bites: Gender Representation in AI-Generated Animal Stories
Minibatch Selection via Partition Matroid Constrained Gradient Matching
Illusions of the Gold Standard: A Large-scale Analysis of Human Evaluation Protocols for …
Strained Coherence: A Pre-Failure Signal in Coding Agent Execution Trajectories