Browse

AI News

30934 items — filtered, classified, deduplicated

arXiv cs.AI Research & Papers
Towards Evaluation Engineering: An Empirical Study of ML Evaluation Harnesses in the Wild
arXiv cs.AI Research & Papers
A Comprehensive Dataset for Human vs. AI Generated Image Detection
arXiv cs.AI Research & Papers
Coupled Variational Reinforcement Learning for Language Model General Reasoning
arXiv cs.AI Research & Papers
Asking LLMs to Verify First is Almost Free Lunch
arXiv cs.AI Research & Papers
DeepEN: A Deep Reinforcement Learning Framework for Personalized Enteral Nutrition in Cri…
arXiv cs.AI Research & Papers
Auditing medical multi-agent AI reveals risks of false consensus
arXiv cs.AI Research & Papers
KAME: Tandem Architecture for Enhancing Knowledge in Real-Time Speech-to-Speech Conversat…
arXiv cs.AI Research & Papers
Spacetime Formation under Requirements: Contextual Realization and Form-Dependent Probabi…
arXiv cs.AI Research & Papers
Human-1 by Josh Talks: A Full-Duplex Conversational Modeling Framework in Hindi using Rea…
arXiv cs.AI Research & Papers
Rethinking the Comparison Unit in Sequence-Level Reinforcement Learning: An Equal-Length …
arXiv cs.AI Research & Papers
Music Interpretation and Emotion Perception: A Computational and Neurophysiological Inves…
arXiv cs.AI Research & Papers
Subspace Aggregation Query and Index Generation for Multidimensional Resource Space Model
arXiv cs.AI Research & Papers
Message-Passing GNNs Fail to Approximate Sparse Triangular Factorizations
arXiv cs.AI Research & Papers
Uncovering Autoregressive LLM Knowledge of Thematic Fit in Event Representation
arXiv cs.AI Research & Papers
HEAPr: Hessian-based Efficient Atomic Expert Pruning in Output Space
arXiv cs.AI Research & Papers
VisualOverload: Probing Visual Understanding of VLMs in Really Dense Scenes
arXiv cs.AI Research & Papers
SpecPrune-VLA: Accelerating Vision-Language-Action Models via Action-Aware Self-Speculati…
arXiv cs.AI Research & Papers
HiTeC: Hierarchical Contrastive Learning on Text-Attributed Hypergraph with Semantic-Awar…
arXiv cs.AI Research & Papers
Designing Singing Syllabi with Virtual Avatars: AI-Assisted Syllabus Reauthoring
arXiv cs.AI Security & Safety
MCPXKIT: The Unified Toolkit for Analyzing Model Context Protocol Security
arXiv cs.AI Developer Tooling
ToolRegistry: A Protocol-Agnostic Tool Management Library for Function-Calling LLMs
arXiv cs.AI Research & Papers
From Reasoning to Code: GRPO Optimization for Underrepresented Languages
arXiv cs.AI Research & Papers
Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training
arXiv cs.AI Research & Papers
ECUAS$_n$: A family of metrics for principled evaluation of uncertainty-augmented systems
arXiv cs.AI Research & Papers
Is VLA Reasoning Faithful? Probing Safety of Chain-of-Causation in Autonomous Driving Mod…
arXiv cs.AI Research & Papers
ScrapMem: A Bio-inspired Framework for On-device Personalized Agent Memory via Optical Fo…
arXiv cs.AI Research & Papers
Shepherd: A Runtime Substrate Empowering Meta-Agents with a Formalized Execution Trace
arXiv cs.AI Research & Papers
ClawTrace: Cost-Aware Tracing for LLM Agent Skill Distillation
arXiv cs.AI Research & Papers
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
arXiv cs.AI Research & Papers
WorldGUI: An Interactive Benchmark for Desktop GUI Automation from Any Starting Point