Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
What is Missing from AI Post-Training AI: An Empirical Analysis
arXiv cs.AI Research & Papers
Syntactic Simplification of OWL Class Expressions
arXiv cs.AI Research & Papers
\textsc{TestifAI}: Tomography-Based Testing for Deep Learning Systems
arXiv cs.AI Research & Papers
Self-prompting and cross-model consensus enable reproducible data extraction from scienti…
arXiv cs.AI Research & Papers
Robust Risk Under Evolving Uncertainty: A Wasserstein Counterpart of the Entropic Value-a…
arXiv cs.AI Research & Papers
Eureka: Task-Conditioned Meta-Agent Orchestration for Scientific Discovery
arXiv cs.AI Research & Papers
SkillGate: Training In-Policy Skill Selection in Long-Horizon Agents
arXiv cs.AI Research & Papers
DentAgent: Evidence-Centric Multi-Agent Coordination for Multimodal Dental Reasoning
arXiv cs.AI Research & Papers
Tuning the Stochastic Machine: A Systems Engineer's Operating Model for Human-AI Engineer…
arXiv cs.AI Research & Papers
Training-Free Inference-Time Self-Reflection and Cost-Bounded Early Stopping for Large La…
arXiv cs.AI Research & Papers
Pairwise Logical Selection of Enthymeme Completions under Semantic-Link Uncertainty
arXiv cs.AI Research & Papers
Candidate-Fate Accounting for Transparent Sensor Diagnostic Pipeline Search
arXiv cs.AI Research & Papers
Competence, Not Accuracy: A Diagnostic for Reference-Free Judge Gates in Skill Optimizati…
arXiv cs.AI Research & Papers
Metrics That Write Themselves: Evolving an Evaluator from Its Own Blind Spots
arXiv cs.AI Research & Papers
ORBITER: Conflict-Aware Decision-Making for Agentic Last-Mile Delivery
arXiv cs.AI Research & Papers
Grouping the Stochastic Machine: Precision, Not Capability, as the Frontier Metric for AI…
arXiv cs.AI Research & Papers
Pairwise Ranking Outperforms Single-Action RL for Offline Explanation Selection: A Practi…
arXiv cs.AI Research & Papers
FinRCA-Bench: Benchmarking Evidence Retrieval and Reasoning for Financial AI Systems
arXiv cs.AI Research & Papers
FACET: Preserving Source Intent and Executable State in Terminal Task Synthesis
arXiv cs.AI Research & Papers
Which Negatives Matter? Ask Your Text Encoder: Adaptive Similarity Margins for Dense-Capt…
arXiv cs.AI Research & Papers
Beyond the Transcript: Detecting Covert Co ordination in Latent Multi-Agent Communication
arXiv cs.AI Research & Papers
Coverage-Driven RTL Assertion Generation with Formal Exploration and Neuro-Symbolic Refin…
arXiv cs.AI Research & Papers
Graphical Design of Interpretable Architectures
arXiv cs.AI Research & Papers
FM-Bench: A Benchmark for Long-Horizon Management with Competing Agents
arXiv cs.AI Research & Papers
Preference Reasoning under Indeterminacy in Large Language Models
arXiv cs.AI Research & Papers
CTIFoundry: An Agent-Native Corpus Scaffold for Cyber Threat Intelligence
arXiv cs.AI Research & Papers
Discretizing Continuous Time Series for Imputation with Masked Diffusion Training
arXiv cs.AI Research & Papers
When Clean Signals Are Not Enough: Detecting Structural Ambiguity for Safe Wearable Stres…
arXiv cs.AI Research & Papers
ComponentBench: Diagnosing Component-Level Failures in Computer-Use Agents
arXiv cs.AI Research & Papers
SESSE: Sketch, Expand, Sort, Summarize, Evaluate -- LLM-as-Judge Evaluation via Structure…