Explorar

Noticias de IA

21813 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Evaluating OpenAI's Privacy Filter: Cross-Lingual, Cross-Domain PII Detection Across 42 B…
arXiv cs.AI Research & Papers
A Graph Signal Processing Perspective on Numerical Sequence Representations in LLM In-Con…
arXiv cs.AI Research & Papers
VIBE: A VAD-Informed Benchmark for Entity-Centered Affective Profiling of Large Language …
arXiv cs.AI Research & Papers
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
arXiv cs.AI Research & Papers
Assessing speech quality metrics for evaluation of neural audio codecs under clean speech…
arXiv cs.AI Research & Papers
UniNav: A Unified World-Action Diffusion Model for Visual Navigation
arXiv cs.AI Research & Papers
OliveGemma: A 3 Billion Visual Language Model for Recognising the Mediterranean & Europea…
arXiv cs.AI Research & Papers
Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents
arXiv cs.AI Research & Papers
AI World Cup 2026: Benchmarking Large Language Models for End-to-End Football Tournament …
arXiv cs.AI Research & Papers
Enactive Artificial Intelligence: A Decision-Centric Architecture for Complex Systems
arXiv cs.AI Research & Papers
Large language models for partial differential equation workflows
arXiv cs.AI Research & Papers
Evading Chain-of-Thought Monitoring Through Model Poisoning
arXiv cs.AI Research & Papers
PAIChecker: Uncovering and Checking PR-Issue Misalignment in SWE-Bench-Like Benchmarks
arXiv cs.AI Research & Papers
Traceable Multi-Agent System for Knowledge-Based Forecasting
arXiv cs.AI Research & Papers
GDPevo: Evaluating Agent Self-Evolution on Real Business Tasks
arXiv cs.AI Research & Papers
MMLongBench-Doc-V2: A Corrected-Annotation, Semantics-Aware Revision of MMLongBench-Doc
arXiv cs.AI Research & Papers
UniGD: A Unified Generative-Discriminative Framework for Industrial Retrieval
arXiv cs.AI Research & Papers
Dr. AGENTONOMICS: A Didactic Experiment of AGENTONOMICS
arXiv cs.AI Research & Papers
Neurosymbolic Reasoning with Incremental Knowledge for Sample Efficient Hierarchical Rein…
arXiv cs.AI Research & Papers
BODHI: Do LLMs Branch Out and Discover Heterogeneous Inferences?
arXiv cs.AI Research & Papers
Optimal Liability Design for Medical AI
arXiv cs.AI Research & Papers
Continue or Replan? Bernoulli-Continuation Policy Learning for Adaptive Horizon Execution
arXiv cs.AI Research & Papers
Pivot-Centric Trajectory Prediction: Bridging Long Horizons via Dynamical Guidance
arXiv cs.AI Research & Papers
Can Training Logs Make Model Comparisons More Precise?
arXiv cs.AI Research & Papers
When Should Graph Attention Be Sparse? Learning a Per-Edge Tsallis Index
arXiv cs.AI Research & Papers
Rectify Then Diffuse: Disentangling Concepts Before Denoising Trajectory Unfolds
arXiv cs.AI Research & Papers
Shorter Reasoning, Earlier Answers? An Evaluation of Reasoning Interfaces
arXiv cs.AI Research & Papers
FACTWASH: Catching AI Rewrites That Wash Hearsay into Fact
arXiv cs.AI Research & Papers
Improving Reproducibility in Evaluation through Multi-Level Annotator Modeling
arXiv cs.AI Research & Papers
Shaping Wind-Tunnel Airflow for Unmanned Aerial Vehicles using Online Learning