Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Peer-Preservation in Frontier Models
arXiv cs.AI Research & Papers
S2P-Net: A Spectral-Spatial Polar Network for Rotation-Invariant Object Recognition in Lo…
arXiv cs.AI Research & Papers
Mapping License Plate Recoverability Under Extreme Viewing Angles for Opportunistic Urban…
arXiv cs.AI Research & Papers
Hierarchical Fault Detection and Diagnosis for Transformer Architectures
arXiv cs.AI Research & Papers
How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks?
arXiv cs.AI Research & Papers
What We are Missing in Multimodal LLM Evaluation?
arXiv cs.AI Research & Papers
OpenFinGym: A Verifiable Multi-Task Gym Environment for Evaluating Quant Agents
arXiv cs.AI Research & Papers
Data-driven Machine Learning Cannot Reach Symbolic-level Logical Reasoning -- The Limit o…
arXiv cs.AI Research & Papers
Clinical Harness for Governable Medical AI Skill Ecosystems
arXiv cs.AI Research & Papers
Humans Disengage, Reasoning Models Persist: Separating Difficulty Registration from Delib…
arXiv cs.AI Research & Papers
Data-Free Reservoir Features for Efficient Long-Horizon Cold-Start Continual Learning
arXiv cs.AI Research & Papers
Latent-Mark: An Audio Watermark Robust to Neural Codec Compression
arXiv cs.AI Research & Papers
Scalable AI-assisted Workflow Management for Detector Design Optimization Using Distribut…
arXiv cs.AI Research & Papers
Learning to Recover Task Experts from a Multi-Task Merged Model
arXiv cs.AI Research & Papers
Radical AI Interpretability
arXiv cs.AI Research & Papers
A Multi-Level Validation and Traceability Framework for AI-Generated Telescope Scheduling…
arXiv cs.AI Research & Papers
Autoformalization of Agent Instructions into Policy-as-Code
arXiv cs.AI Research & Papers
SKILL-DISCO: Distilling and Compiling Agent Traces into Reusable Procedural Skills
arXiv cs.AI Research & Papers
Where Do CoT Training Gains Land in LLM based Agents?
arXiv cs.AI Research & Papers
Einstein World Models
arXiv cs.AI Research & Papers
How to evaluate clustering with ground truth?
arXiv cs.AI Research & Papers
Joint Learning of Experiential Rules and Policies for Large Language Model Agents
arXiv cs.AI Research & Papers
TOPS: First-Principles Visual Token Pruning via Constructing Token Optimal Preservation S…
arXiv cs.AI Research & Papers
WatchAct: A Benchmark for Behavior-Grounded Robot Manipulation
arXiv cs.AI Research & Papers
A Process Harness for Uplifting Legacy Workflows to Agentic BPM: Design and Realization i…
arXiv cs.AI Research & Papers
Ask, Don't Judge: Binary Questions for Interpretable LLM Evaluation and Self-Improvement
arXiv cs.AI Research & Papers
A Multi-Layer AI Framework for Information Landscape Analysis
arXiv cs.AI Research & Papers
Scientific discovery as meta-optimization: a combinatorial optimization case study
arXiv cs.AI Research & Papers
The Capability Frontier: Benchmarks Miss 82% of Model Performance
arXiv cs.AI Research & Papers
TAVR-VLM: Risk-Conditioned Causal Grounding for Hallucination-Resistant Report Generation