Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
The Benchmark Trap: Structures of Power and Injustice in AI Evaluations
arXiv cs.AI Research & Papers
ReasonCast: Agentic Demand Forecasting with Selective Semantic Reasoning
arXiv cs.AI Research & Papers
Evo-Harness: Context-to-Harness Skill Compilation for Self-Evolving Agents
arXiv cs.AI Research & Papers
Towards Standardized Evaluation in Automated Domain Modeling: Introducing a Benchmark
arXiv cs.AI Research & Papers
ATLAS: Scaffold-Free Algorithm Synthesis by LLMs via Embedding-Guided Quality-Diversity S…
arXiv cs.AI Research & Papers
A Responsible Artificial Intelligence Framework for Groundwater Modeling
arXiv cs.AI Research & Papers
Second-Order Policy Effects as State Transitions: A Source-Linked Benchmark for Policy Si…
arXiv cs.AI Research & Papers
Bias-Corrected Ceilings of Emotion Predictability from Human Label Variation Based on Ins…
arXiv cs.AI Research & Papers
Small Models Scout Bottleneck Order for Large-Model Data Control
arXiv cs.AI Research & Papers
Trust Is Not Enough: Influence Calibration for On-Policy Self-Distillation in Agentic RL
arXiv cs.AI Research & Papers
Constitutive Priors for Machine Intelligence: A Legitimacy Theory of the Artificial Physi…
arXiv cs.AI Security & Safety
Synchronized Logit Steering: Real-world Steganography
arXiv cs.AI Research & Papers
When Uncertainty Isn't Enough: An Empirical Study of Self-Correction in Code Generation
arXiv cs.AI Research & Papers
What the Reranker Sees: Multi-Aspect Page Annotation for Long-Document Multimodal Questio…
arXiv cs.AI Research & Papers
A Comprehensive Survey of Wireless Foundation Models for AI-Native 6G Networks
arXiv cs.AI Research & Papers
Stop Indexing at Full Precision: Revisiting Clustering for Vector Embeddings
arXiv cs.AI Research & Papers
Toward Safe LLM Agents: A Survey of Specification, Verification, and Enforcement
arXiv cs.AI Research & Papers
Who Leads Now? Token-Level Modality Arbitration for Chart-to-Code Generation
arXiv cs.AI Research & Papers
Incoherent by Design? On the Moral Self-Consistency of LLMs
arXiv cs.AI Research & Papers
Evaluating Multimodal LLMs across Text and Audio Modalities for Accessible Disaster Assis…
arXiv cs.AI Research & Papers
CEDAR-GRPO: Process-Aware Reinforcement Learning for General Abductive Reasoning in LLMs
arXiv cs.AI Opinion & Editorial
Position: AI Lock-In Is in Progress, and We Must Be Prepared
arXiv cs.AI Opinion & Editorial
Position: Certified Correctness in Neural Constraint Reasoning Requires Symbolic Integrat…
arXiv cs.AI Research & Papers
Large Language Models Show Metacognitive Sensitivity in Medical Reasoning
arXiv cs.AI Research & Papers
Defake-o3: From Speculative Rationales to Verifiable Evidence for Explainable AIGI Detect…
arXiv cs.AI Research & Papers
Discovering High-Quality Chess Puzzles with Offline Reinforcement Learning
arXiv cs.AI Research & Papers
Platform Adaptation Under Governance Interventions: Actor Best-Response Modeling and an E…
arXiv cs.AI Research & Papers
FLOPs vs Real Work: The Importance of Replication in AI Efficiency Assessment
arXiv cs.AI Research & Papers
LongDocBench: Benchmarking TOC Hierarchy and Contextual Relationship Recovery in Long Doc…
arXiv cs.AI Research & Papers
From Errors to Proofs: Minimal-Core-Guided Repair for Neuro-Symbolic Constraint Solving