Browse

AI News

37834 items — filtered, classified, deduplicated

arXiv cs.AI Research & Papers
Safety Signals to Verify NetOps Agents with Action-Level Granularity
arXiv cs.AI Research & Papers
When does a scaling result justify a different allocation? A critical review of resource-…
arXiv cs.AI Research & Papers
Tool Use Reduces Depth-Induced Collapse in OOD Reasoning
arXiv cs.AI Research & Papers
Diffusion-Based Generation of Gait Trajectories
arXiv cs.AI Models & Releases
Depth and Scale in the Sub-150M Regime: JugnuLM-53M vs JugnuLM-110M
arXiv cs.AI Research & Papers
AcquireBound: Runtime Authorization for Resources Acquired by AI Agents
arXiv cs.AI Research & Papers
AI Persuasion as a Threat to Human Control
arXiv cs.AI Research & Papers
Another Blueprint In The Wall: How to Ask Frontier AI Like a Kid?
arXiv cs.AI Research & Papers
Crypto Accounting Bench: Evaluating Frontier and Open-Weight Models on Crypto-Asset Accou…
arXiv cs.AI Research & Papers
Self-Orchestrating Language Models: Leveraging Semantic Dependence for Efficient Inference
arXiv cs.AI Research & Papers
Attention Is All You Need (to Avoid Spurious Oscillations)
arXiv cs.AI Research & Papers
When Tool Calls Succeed but Workflows Fail: Anomalies at the Agent-Tool Boundary
arXiv cs.AI Research & Papers
Domain Generalization for Smartphone-Based Human Activity Recognition: A Systematic Analy…
arXiv cs.AI Research & Papers
GGUF-Metadata Prediction of Single-Sequence llama.cpp Throughput Across Three Systems
arXiv cs.AI Research & Papers
Converting Sequenced Fuzzy Cognitive Maps to Causal Virtual Worlds with Large Video Gener…
arXiv cs.AI Research & Papers
Externalizing Requirement-to-Repair Artifacts as Observable Traces for LLM-Based Program …
arXiv cs.AI Research & Papers
MemRiskBench: Trace-Aware Risk-Preserving Evaluation for Long-Horizon LLM Agents
arXiv cs.AI Research & Papers
Geometric Flow enhanced Graph Coarsening
arXiv cs.AI Research & Papers
Semantic-TVM: Structure-Preserving Trustworthy Virtual Memory for Memory-Augmented and To…
arXiv cs.AI Research & Papers
Overflip: Repetition-Induced Label Flips in Guardrail Models
arXiv cs.AI Research & Papers
The average-farmer illusion in language-model simulations of agricultural decisions
arXiv cs.AI Research & Papers
Enabling Creative Exploration for Vibe Design Agents
arXiv cs.AI Research & Papers
STHMoE: Hypergraph-Enhanced Heterogeneous Dependency Coordination for LLM-Based Urban Tra…
arXiv cs.AI Research & Papers
VisInteract: Towards Dynamic Interactive Text-to-Visualization under Imperfect Queries
arXiv cs.AI Research & Papers
Empirical Evaluation of Open-Source Large Language Models for Retrieval-Augmented Generat…
arXiv cs.AI Research & Papers
ProIQA: A Process-Based Framework for Fine-Grained Math Item Quality Assessment
arXiv cs.AI Developer Tooling
A Voxel-Spacing-Aware Extension of PyRadiomics for Anisotropic Texture Analysis
arXiv cs.AI Research & Papers
Mizan: A National Benchmark for Evaluating Large Language Models on Iraqi Arabic and the …
arXiv cs.AI Research & Papers
HISPO: Hierarchical Importance-Sampling Policy Optimization with Entropy-Derived Segments
arXiv cs.AI Security & Safety
Corrupt Plans, Clean Traces: Evading Chain-of-Thought Monitoring with Plan Injection