Explorar

Noticias de IA

29655 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Principled Synthetic Data Enables the First Scaling Laws for LLMs in Recommendation
arXiv cs.AI Security & Safety
"Do Not Mention This to the User": Detecting and Understanding Malicious Agent Skills
arXiv cs.AI Research & Papers
Principle-Evolvable Scientific Discovery via Uncertainty Minimization
arXiv cs.AI Research & Papers
Inverse Depth Scaling From Most Layers Being Similar
arXiv cs.AI Research & Papers
Fixed Budget is No Harder Than Fixed Confidence in Best-Arm Identification up to Logarith…
arXiv cs.AI Research & Papers
Equilibrium Propagation for Non-Conservative Systems
arXiv cs.AI Security & Safety
The Alignment Curse: Modality Alignment Supercharges Audio Attacks via Text Transfer
arXiv cs.AI Research & Papers
AffordGen: Generating Diverse Demonstrations for Generalizable Object Manipulation with A…
arXiv cs.AI Research & Papers
Probabilistic Performance Guarantees for Multi-Task Reinforcement Learning
arXiv cs.AI Research & Papers
Zero-Shot Off-Policy Learning
arXiv cs.AI Research & Papers
When Does Predictive Inverse Dynamics Outperform Behavior Cloning?
arXiv cs.AI Research & Papers
How Much Progress Has There Been in NVIDIA Datacenter GPUs?
arXiv cs.AI Research & Papers
Demystifying Multi-Agent Debate: The Role of Confidence and Diversity
arXiv cs.AI Research & Papers
ASKD-Whisper: Adaptive Self-knowledge Distillation for Efficient and Low-Latency Automati…
arXiv cs.AI Research & Papers
ELF: A Family of Encoder-Free ECG-Language Models
arXiv cs.AI Research & Papers
Multi-Objective Reinforcement Learning for Tactical Decision Making for Trucks in Highway…
arXiv cs.AI Research & Papers
You Can Learn Tokenization End-to-End with Reinforcement Learning
arXiv cs.AI Security & Safety
SilentDrift: Exploiting Action Chunking for Stealthy Backdoor Attacks on Vision-Language-…
arXiv cs.AI Research & Papers
FastSLM: Hierarchical Temporal Abstraction for Efficient Long-Form Speech Adaptation
arXiv cs.AI Research & Papers
Safe-FedLLM: Delving into the Safety of Federated Large Language Models
arXiv cs.AI Research & Papers
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
arXiv cs.AI Research & Papers
Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation
arXiv cs.AI Research & Papers
Uncovering Competency Gaps in Large Language Models and Their Benchmarks
arXiv cs.AI Research & Papers
Reinforcement Learning Position Control of a Quadrotor Using Soft Actor-Critic (SAC)
arXiv cs.AI Research & Papers
MGRegBench: A Novel Benchmark Dataset with Anatomical Landmarks for Mammography Image Reg…
arXiv cs.AI Research & Papers
Beware of the Batch Size: Hyperparameter Bias in Evaluating LoRA
arXiv cs.AI Research & Papers
Control of a Twin Rotor using Twin Delayed Deep Deterministic Policy Gradient (TD3)
arXiv cs.AI Research & Papers
InFerActive: Interactive Tree-Based Exploration of LLM Sampling for Safety Evaluation
arXiv cs.AI Research & Papers
From Segments to Scenes: Temporal Understanding in Autonomous Driving via Vision-Language…
arXiv cs.AI Research & Papers
SpeedAug: Policy Acceleration via Tempo-Enriched Policy and RL Fine-Tuning