Turning Bias into Bugs: Bandit-Guided Style Manipulation Attacks on LLM Judges
Browse
AI News
30934 items — filtered, classified, deduplicated
On the Push-Based Asynchronous Federated Learning: A Bias-Correction Aggregation Approach
Planning Neural Dynamics with Lie Group Embedding through Supervised Projective Manifold …
GAC: Noise-Aware Adaptive Mixing for Hybrid SFT-RL Post-Training
Workflow Closure Is Not Scientific Closure in Auto-Research Systems
Quantized Keys Steal Attention: Bias Correction for KV-Cache Compression in Video Diffusi…
Semigroup Consistency as a Diagnostic for Learned Physics Simulators
Communication Gain and Delay Cost Under Cross-Timestep Delays in Cooperative Multi-Agent …
Ratio-Variance Regularized Policy Optimization
Credit-assigned Policy Gradient for Early Stage Retrieval in Two-stage Ranking
The Rescue Effect: Spatio-Semantic Early Exit Bypasses Quantization Collapse in CLIP
PolyFusionAgent: A Multimodal Foundation Model and Autonomous AI Assistant for Polymer Pr…
MobileExplorer: Accelerating On-Device Inference for Mobile GUI Agents via Online Explora…
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Dif…
Alignment Tuning for Large Language Models: A Data-Centric Lens on Alignment Data Pipelin…
Cross-scale Aligned Supervision for Training GANs
Verus-SpecGym: An Agentic Environment for Evaluating Specification Autoformalization
MedGuideX: Internalizing Decision Logic from Executable Guidelines into Large Language Mo…
Annotator Positionality as Signal: Psychometric Weighting for Anti-Autistic Ableism Detec…
UnityMAS-O: A General RL Optimization Framework for LLM-Based Multi-Agent Systems
Tail-Aware HiFloat4: W4A4 Post-Training Quantization for Wan2.2
Reconstructing Multi-Scale Physical Fields from Extremely Sparse Measurements with an Aut…
The Attribution Blind Spot: Detecting When Language Models Rely on Memory Rather Than Ret…
It's Not the Capability: Harness Sensitivity Is Non-Monotone Across LLM Agent Tiers
Towards Feedback-to-Plan Decisions for Self-Evolving LLM Agents in CUDA Kernel Generation
Linear and Neural Dueling Bandits with Delayed Feedback
Demystifying Video Reasoning
Certified Causal Attribution for Real-Time Attack Forensics in 6G Network Slicing
Prospective evaluation of multimodal respiratory failure prediction: Do chest X-rays impr…
The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence