Principled Synthetic Data Enables the First Scaling Laws for LLMs in Recommendation
Explorar
Noticias de IA
29655 elementos — filtrados, clasificados y sin duplicados
"Do Not Mention This to the User": Detecting and Understanding Malicious Agent Skills
Principle-Evolvable Scientific Discovery via Uncertainty Minimization
Inverse Depth Scaling From Most Layers Being Similar
Fixed Budget is No Harder Than Fixed Confidence in Best-Arm Identification up to Logarith…
Equilibrium Propagation for Non-Conservative Systems
The Alignment Curse: Modality Alignment Supercharges Audio Attacks via Text Transfer
AffordGen: Generating Diverse Demonstrations for Generalizable Object Manipulation with A…
Probabilistic Performance Guarantees for Multi-Task Reinforcement Learning
Zero-Shot Off-Policy Learning
When Does Predictive Inverse Dynamics Outperform Behavior Cloning?
How Much Progress Has There Been in NVIDIA Datacenter GPUs?
Demystifying Multi-Agent Debate: The Role of Confidence and Diversity
ASKD-Whisper: Adaptive Self-knowledge Distillation for Efficient and Low-Latency Automati…
ELF: A Family of Encoder-Free ECG-Language Models
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway…
You Can Learn Tokenization End-to-End with Reinforcement Learning
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-…
FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation
Safe-FedLLM: Delving into the Safety of Federated Large Language Models
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation
Uncovering Competency Gaps in Large Language Models and Their Benchmarks
Reinforcement Learning Position Control of a Quadrotor Using Soft Actor-Critic (SAC)
MGRegBench: A Novel Benchmark Dataset with Anatomical Landmarks for Mammography Image Reg…
Beware of the Batch Size: Hyperparameter Bias in Evaluating LoRA
Control of a Twin Rotor using Twin Delayed Deep Deterministic Policy Gradient (TD3)
InFerActive: Interactive Tree-Based Exploration of LLM Sampling for Safety Evaluation
From Segments to Scenes: Temporal Understanding in Autonomous Driving via Vision-Language…
SpeedAug: Policy Acceleration via Tempo-Enriched Policy and RL Fine-Tuning