Browse

AI News

37834 items — filtered, classified, deduplicated

arXiv cs.AI Research & Papers
Learning Symbolic Constraint Representations from Examples: A Neuro-Symbolic Approach
arXiv cs.AI Research & Papers
T-GADE: Thermodynamical Generative-AI-Driven Evolution of LLM Artifacts
arXiv cs.AI Security & Safety
SoK: Rethinking Jailbreaking in the Era of Agentic AI: Attacks, Defenses, and Practical C…
arXiv cs.AI Research & Papers
CMA-OT: Hierarchical Expert Supervision for Dance-to-Music Generation
arXiv cs.AI Security & Safety
DropVLA: An Action-Level Backdoor Attack on Vision-Language-Action Models
arXiv cs.AI Research & Papers
Beyond ID Embeddings: Process-Grounded Language Modeling for Cognitive Diagnosis
arXiv cs.AI Research & Papers
Online Video Agent Harness for Long Video Understanding
arXiv cs.AI Research & Papers
LLM Compression by Block Removal with Constrained Binary Optimization
arXiv cs.AI Research & Papers
Can LLMs in Draft-Verify-Revise Pipelines Resolve Deictic Ambiguity?
arXiv cs.AI Research & Papers
GLARE: Generative Learning via Adversarial Reward Estimation For Social Dynamics Forecast…
arXiv cs.AI Research & Papers
RunningTensor: Generalizing Linear Attention to Higher-Order Recurrent States
arXiv cs.AI Research & Papers
Measuring Pragmatic Influence in Large Language Model Instructions
arXiv cs.AI Research & Papers
Skill Issue: Lessons from Optimizing Repository SKILLs for Coding Agents
arXiv cs.AI Research & Papers
WinSyn: An Automated Pipeline for Realistic Enterprise Question-Answering Evaluation
arXiv cs.AI Research & Papers
Pelican-Sim 1.0: A General World Model Simulator for Embodied Intelligence
arXiv cs.AI Research & Papers
SCOPE-OPSD: Fisher-Conditioned Privileged Subspaces for On-Policy Self-Distillation
arXiv cs.AI Research & Papers
ResoSeg: Resonance Tagger using Transformer and Segment Model
arXiv cs.AI Research & Papers
Harness or Model? Isolating the Harness Effect in Agentic Coding with a Contamination-Con…
arXiv cs.AI Research & Papers
Who Pays for Open Review? Visible Author Reputation and Its Effect on Ratings
arXiv cs.AI Research & Papers
How Good Are Frontier Models at Physics? Expert Re-Grading Reveals Broken Evaluations and…
arXiv cs.AI Research & Papers
Hierarchical Prototype Emergence in Modern Hopfield Models
arXiv cs.AI Research & Papers
Calibrated Ambiguity in Multimodal Language Models: Humans reach for cultural references,…
arXiv cs.AI Research & Papers
DU-NO: A Parameter-Efficient Double U-Shaped Neural Operator for Phase-Resolving Wave Mod…
arXiv cs.AI Research & Papers
AsyncFlow: An Asynchronous Streaming RL Framework for Efficient LLM Post-Training
arXiv cs.AI Research & Papers
What Drives Recovery in Agentic Text-to-Cypher? LAST-CQ: An LLM Agent Self-Refinement Fra…
arXiv cs.AI Research & Papers
Reinforcement Learning over Patient Trajectories for Clinical Reasoning in EHR Foundation…
arXiv cs.AI Security & Safety
A Graph-Based Approach for Mapping Kernel-Level Telemetry to MITRE ATT&CK
arXiv cs.AI Research & Papers
When Rubrics Fail: Hallucinations Reveal Blind Spots in Medical AI Evaluation
arXiv cs.AI Research & Papers
Countdown-Code: A Testbed for Studying The Emergence and Generalization of Reward Hacking…
arXiv cs.AI Research & Papers
Beyond Generation and Accuracy: Diagnosing and Enhancing Visual Chain-of-Thought for Geom…