Browse

AI News

30934 items — filtered, classified, deduplicated

arXiv cs.AI Research & Papers
Beyond the Final Answer: Evaluating the Reasoning Trajectories of Tool-Augmented Agents
arXiv cs.AI Research & Papers
Language Models Need Sleep
arXiv cs.AI Research & Papers
PCGRLLM: Large Language Model-Driven Reward Design for Procedural Content Generation Rein…
arXiv cs.AI Research & Papers
Everything at Every Scale: Scale-Invariant Diffusion with Continuous Super-Resolution
arXiv cs.AI Research & Papers
Learning in Low-Dimensional Subspaces: Orthogonal Bottlenecks for Reinforcement Learning
arXiv cs.AI Research & Papers
Creative Quality Alignment: Expert Tacit Knowledge Transfer via Chain-of-Thought Fine-Tun…
arXiv cs.AI Research & Papers
VEN-VL: A Visual Ensemble MoE Framework for Effective and Efficient Multi-Modal Understan…
arXiv cs.AI Research & Papers
Quantitative Evaluation of the Severity of Posttraumatic Stress Disorder through Transfer…
arXiv cs.AI Research & Papers
Can LLMs Time Travel? Enhancing Temporal Consistency in Legal Agentic Search through Rein…
arXiv cs.AI Research & Papers
AI-Assisted Systematization for Evaluating GenAI Systems
arXiv cs.AI Research & Papers
TIAR: Trajectory-Informed Advantage Reweighting for LLM Abstention Learning
arXiv cs.AI Research & Papers
Learning to Reason Efficiently with A* Post-Training
arXiv cs.AI Research & Papers
When Search Becomes Memory: Turning Robot Design Trials into Transferable Skills
arXiv cs.AI Research & Papers
Clarify, Abstain or Answer? Strategising in Conversation with Belief-Augmented Generation
arXiv cs.AI Research & Papers
Fine-Tuning Over Architectural Complexity: Broad-Coverage PII Detection on PIIBench with …
arXiv cs.AI Research & Papers
Beyond Inference-Only Deployment: Comparing Weight-Based Consolidation Against Cascading …
arXiv cs.AI Research & Papers
MDGMIX: Boundary-Aware Subgraph Mixing for Multi-Domain Graph Pre-Training
arXiv cs.AI Research & Papers
Exploration of Perceptual Speech Features for Clinical Decision-Support in Mental Health …
arXiv cs.AI Research & Papers
Proper Scoring Rules for Agentic Uncertainty Quantification
arXiv cs.AI Research & Papers
Uncertainty Decomposition via Cyclical SG-MCMC and Soft-label Learning for Subjective NLP
arXiv cs.AI Research & Papers
CoRe-Code: Collaborative Reinforcement Learning for Code Generation
arXiv cs.AI Research & Papers
PANDO: Efficient Multimodal AI Agents via Online Skill Distillation
arXiv cs.AI Research & Papers
Test-Time Deep Thinking to Explore Implicit Rules
arXiv cs.AI Research & Papers
Stop Comparing LLM Agents Without Disclosing the Harness
arXiv cs.AI Models & Releases
DIVER-1: Scaling Intracranial EEG Foundation Models for Transferable Representations
arXiv cs.AI Models & Releases
AnatomiX, an Anatomy-Aware Grounded Multimodal Large Language Model for Chest X-Ray Inter…
arXiv cs.AI Security & Safety
RiskBridge: Turning CVEs into Business-Aligned Patch Priorities
arXiv cs.AI Research & Papers
Unifying Speech Editing Detection and Content Localization via Prior-Enhanced Audio LLMs
arXiv cs.AI Research & Papers
MEMOR-E: In-Context and Fine-Tuned LLM Personalization for Alzheimer's Assistive Robotics
arXiv cs.AI Research & Papers
Verified SHAP: Provable Bounds for Exact Shapley Values of Neural Networks