R$^3$L: Reflect-then-Retry Reinforcement Learning with Language-Guided Exploration, Pivot…
Explorar
Noticias de IA
29670 elementos — filtrados, clasificados y sin duplicados
The Surprising Difficulty of Search in Model-Based Reinforcement Learning
Moonwalk: Inverse-Forward Differentiation
Online Learning with Multiple Fairness Regularizers via Graph-Structured Feedback
Diffusion and Flow Matching Models for Tabular Data: A Survey
PLACE: Prompt Learning for Attributed Community Search in Large Graphs
Is Capability a Liability? More Capable Language Models Make Worse Forecasts When It Matt…
XAttnMark: Learning Robust Audio Watermarking with Cross-Attention
TwinRouterBench: Fast Static and Live Dynamic Evaluation for Realistic Agentic LLM Routing
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
Empowering 9-1-1 Calltaking Training with Generative AI: Experiences and Lessons Learned
Disentangling Interaction and Bias Effects in Opinion Dynamics of Large Language Models
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning
Proxy-Based Approximation of Shapley and Banzhaf Interactions
Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution
ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning
Multi-Gate Residuals
PaP-NF: Probabilistic Long-Term Time Series Forecasting via Prefix-as-Prompt Reprogrammin…
Score-Based One-step MeanFlow Policy Optimization
Enhancing Deep Neural Network Reliability with Refinement and Calibration
PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs
SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion
Security of LLM-generated Code: A Comparative Analysis
Dithering Defense: Adversarial Robustness of Vision Foundation Models via Multi-Level Flo…
Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models
CoReVAD: A Contextual Reasoning Framework for Training-Free Video Anomaly Detection
A Fine-Tuned BERT Classifier for Personal-Letter Titles in Late-Ming and Early-Qing Colle…
Preisach Attention: A Hysteretic Model of Sequential Memory
Towards Generalization of Block Attention via Automatic Segmentation and Block Distillati…