Browse

AI News

30934 items — filtered, classified, deduplicated

arXiv cs.AI Security & Safety
Turning Bias into Bugs: Bandit-Guided Style Manipulation Attacks on LLM Judges
arXiv cs.AI Research & Papers
On the Push-Based Asynchronous Federated Learning: A Bias-Correction Aggregation Approach
arXiv cs.AI Research & Papers
Planning Neural Dynamics with Lie Group Embedding through Supervised Projective Manifold …
arXiv cs.AI Research & Papers
GAC: Noise-Aware Adaptive Mixing for Hybrid SFT-RL Post-Training
arXiv cs.AI Research & Papers
Workflow Closure Is Not Scientific Closure in Auto-Research Systems
arXiv cs.AI Research & Papers
Quantized Keys Steal Attention: Bias Correction for KV-Cache Compression in Video Diffusi…
arXiv cs.AI Research & Papers
Semigroup Consistency as a Diagnostic for Learned Physics Simulators
arXiv cs.AI Research & Papers
Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent …
arXiv cs.AI Research & Papers
Ratio-Variance Regularized Policy Optimization
arXiv cs.AI Research & Papers
Credit-assigned Policy Gradient for Early Stage Retrieval in Two-stage Ranking
arXiv cs.AI Research & Papers
The Rescue Effect: Spatio-Semantic Early Exit Bypasses Quantization Collapse in CLIP
arXiv cs.AI Research & Papers
PolyFusionAgent: A Multimodal Foundation Model and Autonomous AI Assistant for Polymer Pr…
arXiv cs.AI Research & Papers
MobileExplorer: Accelerating On-Device Inference for Mobile GUI Agents via Online Explora…
arXiv cs.AI Research & Papers
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Dif…
arXiv cs.AI Research & Papers
Alignment Tuning for Large Language Models: A Data-Centric Lens on Alignment Data Pipelin…
arXiv cs.AI Research & Papers
Cross-scale Aligned Supervision for Training GANs
arXiv cs.AI Research & Papers
Verus-SpecGym: An Agentic Environment for Evaluating Specification Autoformalization
arXiv cs.AI Research & Papers
MedGuideX: Internalizing Decision Logic from Executable Guidelines into Large Language Mo…
arXiv cs.AI Research & Papers
Annotator Positionality as Signal: Psychometric Weighting for Anti-Autistic Ableism Detec…
arXiv cs.AI Research & Papers
UnityMAS-O: A General RL Optimization Framework for LLM-Based Multi-Agent Systems
arXiv cs.AI Research & Papers
Tail-Aware HiFloat4: W4A4 Post-Training Quantization for Wan2.2
arXiv cs.AI Research & Papers
Reconstructing Multi-Scale Physical Fields from Extremely Sparse Measurements with an Aut…
arXiv cs.AI Research & Papers
The Attribution Blind Spot: Detecting When Language Models Rely on Memory Rather Than Ret…
arXiv cs.AI Research & Papers
It's Not the Capability: Harness Sensitivity Is Non-Monotone Across LLM Agent Tiers
arXiv cs.AI Research & Papers
Towards Feedback-to-Plan Decisions for Self-Evolving LLM Agents in CUDA Kernel Generation
arXiv cs.AI Research & Papers
Linear and Neural Dueling Bandits with Delayed Feedback
arXiv cs.AI Research & Papers
Demystifying Video Reasoning
arXiv cs.AI Research & Papers
Certified Causal Attribution for Real-Time Attack Forensics in 6G Network Slicing
arXiv cs.AI Research & Papers
Prospective evaluation of multimodal respiratory failure prediction: Do chest X-rays impr…
arXiv cs.AI Models & Releases
The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence