Efficient Adversarial Attacks on High-dimensional Offline Bandits
Explorar
Noticias de IA
21863 elementos — filtrados, clasificados y sin duplicados
Making Expert Reasoning Learnable with Self-Distillation
What Structural Inductive Bias Helps Transformers Reason Over Knowledge Graphs? A Study w…
AlgoVeri: An Aligned Benchmark for Verified Code Generation on Classical Algorithms
Unifying Model-Free Efficiency and Model-Based Representations via Latent Dynamics
Toward Autonomous O-RAN: A Multi-Scale Agentic AI Framework for Real-Time Network Control…
DSL-Topic: Improving Topic Modeling by Distilling Soft Labelsfrom Language Models
Evaluating Zero-Shot and One-Shot Adaptation of Small Language Models in Leader-Follower …
ShareVerse: Multi-Agent Consistent Video Generation for Shared World Modeling
ZeroWBC: Learning Natural Whole-Body Humanoid Interaction from Human Egocentric Data
Revisiting Vul-RAG: Reproducibility and Replicability of RAG-based Vulnerability Detectio…
An Empirical Audit of Input Encoders for Multi-Channel Signal Transformers
NoRA: Evaluating Grounded Reasonableness in Visual First-person Normative Action Reasoning
SAM 3D: 3Dfy Anything in Images
Platonic Transformers: A Solid Choice For Equivariance
Physics-Informed Neural Engine Sound Modeling with Differentiable Pulse-Train Synthesis
On-the-fly Repulsion in the Contextual Space for Rich Diversity in Diffusion Transformers
Retrieval and competition: how a protein foundation model starts a protein
Extending Fair Null-Space Projections for Continuous Attributes to Kernel Methods
DEFLECT: Temporal Counterfactual Preference Learning for Delay-Robust Asynchronous VLAs
Learning While Acting: A Skill-Enhanced Test-Time Co-Evolution Framework for Online Lifel…
KITE: Kernelized and Information Theoretic Exemplars for In-Context Learning
Reproducing, Analyzing, and Detecting Reward Hacking in Rubric-Based Reinforcement Learni…
AgentJet: A Flexible Swarm Training Framework for Agentic Reinforcement Learning
Cascading Hallucination in Agentic RAG: The CHARM Framework for Detection and Mitigation
Not All Errors Are Equal: Consequence-Aware Reasoning Compute Allocation
Characterizing initial human-AI proof formalization workflows
DiverAge: Reliable Pluralistic Face Aging with Cross-Age Identity Relation Guidance
Signed Dual Attention: Capturing Signed Dependencies in Time Series Forecasting
Uncertainty-Aware End-to-End Co-Design of Neural Network Processors: From Training and Ma…