Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
One Knob to Rule Them All: A Unified Optimal Transport View of Cold-Start Active Learning
arXiv cs.AI Research & Papers
Diversity is Not Ambiguity: Toward Accurate and Efficient Ambiguity Detection for Open-Do…
arXiv cs.AI Research & Papers
UniGD: A Unified Generative-Discriminative Framework for Industrial Retrieval
arXiv cs.AI Research & Papers
Don't Peek at the Answer: Outcome-Masked Group Relative Policy Optimization for Label-Fre…
arXiv cs.AI Research & Papers
When Teachers Mislead: Spurious-Signal-Aware On-Policy Distillation
arXiv cs.AI Research & Papers
Large language models for partial differential equation workflows
arXiv cs.AI Research & Papers
Policy Fragmentation or Institutional Alignment? Institutional Governance of AI in Univer…
arXiv cs.AI Research & Papers
HyperAgent: Planning and Acting over Tool-Schema Hypergraphs for Tool-Use LLM Agents
arXiv cs.AI Research & Papers
Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents
arXiv cs.AI Research & Papers
When Many Answers Are Valid, Voting Fails: Symbolic Verification for Best-of-K Causal Rea…
arXiv cs.AI Research & Papers
Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks
arXiv cs.AI Research & Papers
Towards Improving Sequential Decision-Making in LLM Agents via Experience Memory
arXiv cs.AI Research & Papers
STREAM-VAE: Dual-Path Routing for Slow and Fast Dynamics in Vehicle Telemetry Anomaly Det…
arXiv cs.AI Research & Papers
AI World Cup 2026: Benchmarking Large Language Models for End-to-End Football Tournament …
arXiv cs.AI Research & Papers
Enactive Artificial Intelligence: A Decision-Centric Architecture for Complex Systems
arXiv cs.AI Research & Papers
Dr. AGENTONOMICS: A Didactic Experiment of AGENTONOMICS
arXiv cs.AI Research & Papers
LLaDA MoE v2: Scaling Mixture-of-Experts Diffusion Language Models
arXiv cs.AI Research & Papers
UrbanAgent: A Tool-Augmented Agent for Cross-System Urban Tasks
arXiv cs.AI Research & Papers
Instruction Stacking Collapse: A Benchmark and the Capability-Dependent Value of Prompt C…
arXiv cs.AI Research & Papers
IR2Solve: Structured Intermediate Representations for Cost-Efficient Optimization Autofor…
arXiv cs.AI Research & Papers
WCM: World-Cognition Model for Generalizable Human-Robot Interaction
arXiv cs.AI Research & Papers
Neurosymbolic Reasoning with Incremental Knowledge for Sample Efficient Hierarchical Rein…
arXiv cs.AI Research & Papers
MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning
arXiv cs.AI Research & Papers
Hypercubes, Hyperplanes, and Constraint-Induced Complexity Collapse in Atomic Concept Lea…
arXiv cs.AI Research & Papers
Agentic Reinforcement Learning with Self-Distilled Reward Shaping
arXiv cs.AI Research & Papers
PRISM: Powerful Time Series to Image (TS2I) Representations for Multivariate Anomaly Dete…
arXiv cs.AI Research & Papers
TACT: Taxonomy-Aligned Post-Training for Pedagogically Adaptive English Tutoring
arXiv cs.AI Research & Papers
GraphCliff: Short-Long Range Gating for Modeling Critical Activity Changes Caused by Subt…
arXiv cs.AI Research & Papers
Separating quantum circuits from classical LLMs
arXiv cs.AI Research & Papers
Uncovering Spontaneous Physics Representations in In-Context Learning