Dual-Anchoring: Addressing State Drift in Vision-Language Navigation
Explorar
Noticias de IA
29629 elementos — filtrados, clasificados y sin duplicados
Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
Cornerstones or Stumbling Blocks? Deciphering the Rock Tokens in On-Policy Distillation
TInR: Exploring Tool-Internalized Reasoning in Large Language Models
SCOPE: Signal-Calibrated On-Policy Distillation Enhancement with Dual-Path Adaptive Weigh…
Safe-FedLLM: Delving into the Safety of Federated Large Language Models
Frequency-Enhanced Diffusion Models: Curriculum-Guided Semantic Alignment for Zero-Shot S…
"I've Seen How This Goes": Characterizing Diversity via Progressive Conditional Surprise
MedSynapse-V: Bridging Visual Perception and Clinical Intuition via Latent Memory Evoluti…
Distributional Open-Ended Evaluation of LLM Cultural Value Alignment Based on Value Codeb…
CalM: A Self-Supervised Foundation Model for Population Dynamics in Calcium Imaging Data
FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation
How Can Reinforcement Learning Achieve Expert-level Placement?
Acoustic and perceptual differences between standard and accented speech and their voice …
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-…
EuraGovExam: A Multilingual Multimodal Benchmark from Real-World Civil Service Exams
Limits of Spatial Imagery Reasoning in Frontier LLM Models
Claudini: Autoresearch Discovers State-of-the-Art Adversarial Attack Algorithms for LLMs
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Rei…
You Can Learn Tokenization End-to-End with Reinforcement Learning
Failure of contextual invariance in large language models
AgentDS Technical Report: Benchmarking the Future of Human-AI Collaboration in Domain-Spe…
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway…
MineDraft: A Framework for Batch Parallel Speculative Decoding
Context Matters: Repository-Aware Security Analysis of the Agent Skill Ecosystem
ES-Merging: Biological MLLM Merging via Embedding Space Signals
ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning
Constitutional Black-Box Monitoring for Scheming in LLM Agents
LookWise: Knowing When and Where to Look for Fine-Grained Visual Reasoning in Multimodal …