Explorar

Noticias de IA

22318 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Learning-Driven Adaptive Audit Scheduling: A Sequential Decision Approach to Off-Chain Da…
arXiv cs.AI Research & Papers
Beyond Semantic Equivalence: Logical Graphs for LLM Uncertainty Quantification
arXiv cs.AI Research & Papers
AgentBrew: Lifelong Knowledge Brewing from Strong Teachers to Weak LLM Agents
arXiv cs.AI Research & Papers
FST.ai 2.5: Explainable and Uncertainty-Aware AI for Olympic and Para-Taekwondo Decision …
arXiv cs.AI Research & Papers
Decision Making Needs Uncertainty Quantification [Lecture Notes]
arXiv cs.AI Research & Papers
AEVAL: From Anecdotal to Deterministic Testing for Agentic Skill Workflows
arXiv cs.AI Research & Papers
Democratizing AI with Small Language Models: Structured Benchmarking and Parameter-Effici…
arXiv cs.AI Research & Papers
Human Grounded Evaluation of Large Language Models for Optical Network Automation
arXiv cs.AI Research & Papers
A Benchmark for Early-stage Parkinson's Disease Detection from Speech
arXiv cs.AI Research & Papers
Zoom In, Reason Out: Efficient Far-field Anomaly Detection in Expressway Surveillance Vid…
arXiv cs.AI Research & Papers
FETS Benchmark: Foundation Models Enable Scalable and Generalizable Energy Time Series Fo…
arXiv cs.AI Research & Papers
DIB-OD: Preserving the Invariant Core for Robust Heterogeneous Graph Adaptation via Decou…
arXiv cs.AI Research & Papers
MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
arXiv cs.AI Research & Papers
BERT-as-a-Judge: A Robust Alternative to Lexical Methods for Efficient Reference-Based LL…
arXiv cs.AI Research & Papers
ClawBench: Can AI Agents Complete Everyday Online Tasks?
arXiv cs.AI Research & Papers
A Systematic Evaluation of Trajectory Data Curation for LoRA Fine-Tuning of Code Agents
arXiv cs.AI Research & Papers
HiCI: Hierarchical Construction-Integration for Long-Context Attention
arXiv cs.AI Research & Papers
CADENCE: Closing the Reasoning Gap via Coverage-Adaptive On-Policy Distillation
arXiv cs.AI Research & Papers
Do Language Models Dream of Binding Molecules? Benchmarking LLMs under Spatial Constraints
arXiv cs.AI Research & Papers
ConceptTree: Bringing Semantic Transparency to Black-Box Decision Making for Robotic Mani…
arXiv cs.AI Research & Papers
FIFA World Cup 2026 as a Contamination-Free Benchmark for LLM Forecasting Agents: Four Mo…
arXiv cs.AI Research & Papers
Integrating High-Level Requirements to Low-Level Tests with Machine-Readable V&V Specific…
arXiv cs.AI Research & Papers
Joint-Embedding Predictive Architecture for Sensor-based Activity Recognition
arXiv cs.AI Research & Papers
Privacy-Aware Synthetic Video Benchmarking and Relational Evaluation for Worker-Under-Sus…
arXiv cs.AI Research & Papers
Clarify Before Executing: A Self-Evolving Agent for Resolving Intent Asymmetry in 3D Tool…
arXiv cs.AI Research & Papers
A Predict-then-Correct Loop Based on Few-Shot Continuous Contextual Bandit for Demand For…
arXiv cs.AI Research & Papers
TypiCore: A Hybrid Active Query Strategy for Class-Incremental Learning on Time Series
arXiv cs.AI Research & Papers
Detection, Attribution, Narration: An End-to-End Pipeline for Explainable Money Mule Iden…
arXiv cs.AI Research & Papers
Predictive Training with Latent Imagination for Visual Quadruped Navigation
arXiv cs.AI Research & Papers
Oracle Gap and Signal Fidelity: A Fixed-Pool Diagnostic for Test-Time Collaboration