Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
UIC-AIHealth4All at ArchEHR-QA 2026: Answer-First Evidence Grounding for Clinical Questio…
arXiv cs.AI Research & Papers
Expert Knowledge & Machine Understanding: Bridging Reactome's Ontology with LLM Semantic …
arXiv cs.AI Research & Papers
Optimal Adversarial Testing: Extracting Honest Test Results from Dishonest Test Takers
arXiv cs.AI Research & Papers
VISTA: Verifier-Informed Student-to-Teacher Adaptation for On-Policy Self-Distillation
arXiv cs.AI Research & Papers
Multimodal Collaborative Debate for Zero-Shot Time Series Reasoning
arXiv cs.AI Research & Papers
Talk in Pieces, See in Whole: Disentangled and Hierarchical Representation Learning in La…
arXiv cs.AI Research & Papers
Learning a Size-Weight Frontier for Synthetic-Augmented Inference
arXiv cs.AI Research & Papers
Blog: Survey of Optimizers
arXiv cs.AI Research & Papers
Deriving Scaling Laws for OpenEuroLLM Models: Learning Rate, Batch Size and Loss
arXiv cs.AI Research & Papers
Layered LLM Defenses as an Ensemble: Access Tiers, Inference Cost, and the Measured Failu…
arXiv cs.AI Research & Papers
Describe-Then-Act: Proactive Agent Steering via Distilled Language-Action World Models
arXiv cs.AI Research & Papers
Cognitive Chain-of-Thought (CoCoT): Structured Multimodal Reasoning about Social Situatio…
arXiv cs.AI Research & Papers
A Probabilistic Interpretation of KV Cache Eviction
arXiv cs.AI Research & Papers
Steering Multimodal Large Language Models Decoding for Context-Aware Safety
arXiv cs.AI Research & Papers
A comprehensive and trustworthy benchmark of AI methods for change detection in Earth obs…
arXiv cs.AI Research & Papers
Video Generative Models as Geometry Learner
arXiv cs.AI Research & Papers
Conformal Uncertainty Quantification Guarantees for Neural Operators
arXiv cs.AI Research & Papers
On the Maintenance and Co-evolution of Agent Plugins: An Empirical Study of Claude Code P…
arXiv cs.AI Research & Papers
Evaluating the Performance of Large Language Models on GAOKAO Benchmark
arXiv cs.AI Research & Papers
Conformal Risk-Averse Decision Making with Optimized Certainty Equivalent Risk Control
arXiv cs.AI Research & Papers
When Saying No Makes Better Videos: Designing Dual Gatekeeping for Pedagogically Grounded…
arXiv cs.AI Research & Papers
How Proper Scoring Rules Shape LLM Forecasting
arXiv cs.AI Research & Papers
SEGRA: A Structured Experience Guided Reasoning Agent for Property Graph Question Answeri…
arXiv cs.AI Research & Papers
Understanding and Enforcing Weight Disentanglement in Task Arithmetic
arXiv cs.AI Research & Papers
CheXtriev: Anatomy-Centered Representation for Case-Based Retrieval of Chest Radiographs
arXiv cs.AI Research & Papers
Nested Byte-Level Vocabularies Are Cheap to Deploy and Expensive to Share: A Pre-Register…
arXiv cs.AI Research & Papers
PanelShield: Verifiable Closed-Loop Safe Planning for Robotic Industrial Panel Operation
arXiv cs.AI Research & Papers
When Linguistic and Internal Confidence Diverge in Large Language Models
arXiv cs.AI Research & Papers
VICT: Verifier-Instrumented Credit Tracing for Long-Horizon LLM Agent Reinforcement Learn…
arXiv cs.AI Research & Papers
Embedding Models for Stance-Aware Argument Retrieval