Explorar

Noticias de IA

29670 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
R$^3$L: Reflect-then-Retry Reinforcement Learning with Language-Guided Exploration, Pivot…
arXiv cs.AI Research & Papers
The Surprising Difficulty of Search in Model-Based Reinforcement Learning
arXiv cs.AI Research & Papers
Moonwalk: Inverse-Forward Differentiation
arXiv cs.AI Research & Papers
Online Learning with Multiple Fairness Regularizers via Graph-Structured Feedback
arXiv cs.AI Research & Papers
Diffusion and Flow Matching Models for Tabular Data: A Survey
arXiv cs.AI Research & Papers
PLACE: Prompt Learning for Attributed Community Search in Large Graphs
arXiv cs.AI Research & Papers
Is Capability a Liability? More Capable Language Models Make Worse Forecasts When It Matt…
arXiv cs.AI Research & Papers
XAttnMark: Learning Robust Audio Watermarking with Cross-Attention
arXiv cs.AI Research & Papers
TwinRouterBench: Fast Static and Live Dynamic Evaluation for Realistic Agentic LLM Routing
arXiv cs.AI Research & Papers
Distilling Linearized Behavior into Non-Linear Fine-Tuning for Effective Task Arithmetic
arXiv cs.AI Research & Papers
Empowering 9-1-1 Calltaking Training with Generative AI: Experiences and Lessons Learned
arXiv cs.AI Research & Papers
Disentangling Interaction and Bias Effects in Opinion Dynamics of Large Language Models
arXiv cs.AI Research & Papers
Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning
arXiv cs.AI Research & Papers
TABX: A High-Throughput Sandbox Battle Simulator for Multi-Agent Reinforcement Learning
arXiv cs.AI Research & Papers
Proxy-Based Approximation of Shapley and Banzhaf Interactions
arXiv cs.AI Research & Papers
Coloring the Noise: Adversarial Sobolev Alignment for Faithful Image Super Resolution
arXiv cs.AI Research & Papers
ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning
arXiv cs.AI Research & Papers
Multi-Gate Residuals
arXiv cs.AI Research & Papers
PaP-NF: Probabilistic Long-Term Time Series Forecasting via Prefix-as-Prompt Reprogrammin…
arXiv cs.AI Research & Papers
Score-Based One-step MeanFlow Policy Optimization
arXiv cs.AI Research & Papers
Enhancing Deep Neural Network Reliability with Refinement and Calibration
arXiv cs.AI Security & Safety
PoisonForge: Task-Level Targeted Poisoning Benchmark for Instruction-Tuned LLMs
arXiv cs.AI Research & Papers
SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion
arXiv cs.AI Security & Safety
Security of LLM-generated Code: A Comparative Analysis
arXiv cs.AI Research & Papers
Dithering Defense: Adversarial Robustness of Vision Foundation Models via Multi-Level Flo…
arXiv cs.AI Research & Papers
Agentic-VLA: Efficient Online Adaptation for Vision-Language-Action Models
arXiv cs.AI Research & Papers
CoReVAD: A Contextual Reasoning Framework for Training-Free Video Anomaly Detection
arXiv cs.AI Research & Papers
A Fine-Tuned BERT Classifier for Personal-Letter Titles in Late-Ming and Early-Qing Colle…
arXiv cs.AI Research & Papers
Preisach Attention: A Hysteretic Model of Sequential Memory
arXiv cs.AI Research & Papers
Towards Generalization of Block Attention via Automatic Segmentation and Block Distillati…