Efficient Adversarial Attacks on High-dimensional Offline Bandits
Explorar
Noticias de IA
21863 elementos — filtrados, clasificados y sin duplicados
Inference-Time Vulnerability Beyond Shallow Safety: Alignment Along Generation Trajectori…
Making Expert Reasoning Learnable with Self-Distillation
What Structural Inductive Bias Helps Transformers Reason Over Knowledge Graphs? A Study w…
AlgoVeri: An Aligned Benchmark for Verified Code Generation on Classical Algorithms
Adaptive Minds: Empowering Agents with LoRA-as-Tools
Constrained Adaptive Rejection Sampling
Unifying Model-Free Efficiency and Model-Based Representations via Latent Dynamics
Toward Autonomous O-RAN: A Multi-Scale Agentic AI Framework for Real-Time Network Control…
Bad Seeing or Bad Thinking? Rewarding Perception for Multimodal Reasoning
DSL-Topic: Improving Topic Modeling by Distilling Soft Labelsfrom Language Models
Exact Unlearning in Reinforcement Learning
Failed Reasoning Traces Tell You What Is Fixable (But Not by Reading Them)
Towards Efficient and Evidence-grounded Mobility Prediction with LLM-Driven Agent
Evaluating Zero-Shot and One-Shot Adaptation of Small Language Models in Leader-Follower …
SSSD: Simply-Scalable Speculative Decoding
Audio Interaction Model
Interfaze: The Future of AI is built on Task-Specific Small Models
M$^3$Eval: Multi-Modal Memory Evaluation through Cognitively-Grounded Video Tasks
ShareVerse: Multi-Agent Consistent Video Generation for Shared World Modeling
ZeroWBC: Learning Natural Whole-Body Humanoid Interaction from Human Egocentric Data
DeliChess: A Multi-party Dialogue Dataset for Deliberation in Chess Puzzle Solving
EvoPrompt: Guided Prompt Evolution for Vision-Language Models Adaptation
ContactExplorer: Contact Coverage-Guided Exploration for General-Purpose Dexterous Manipu…
Adaptive Calibration for Fair and Performant Facial Recognition
Geometry-Aware Distillation for Prompt Tuning Biomedical Vision-Language Models
Revisiting Model Stitching In the Foundation Model Era
'Your AI Text is not Mine': Redefining and Evaluating AI-generated Text Detection under R…
Learning Empirically Admissible Neural Heuristics for Combinatorial Search
DEFLECT: Temporal Counterfactual Preference Learning for Delay-Robust Asynchronous VLAs