Explorar

Noticias de IA

21272 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strate…
arXiv cs.AI Research & Papers
GrowLoop: Self-Evolving Conversation Evaluation Seeded by Human
arXiv cs.AI Research & Papers
Relational In-Context Learning via Synthetic Pre-training with Structural Prior
arXiv cs.AI Research & Papers
Post-Training Language Models for Crosslingual Consistency
arXiv cs.AI Research & Papers
MiraBench: Evaluating Action-Conditioned Reliability in Robotic World Models
arXiv cs.AI Research & Papers
Hallucination Detection-Guided Preference Optimization for Clinical Summarization
arXiv cs.AI Research & Papers
Steering at the Source: Style Modulation Heads for Robust Persona Control
arXiv cs.AI Research & Papers
First head-to-head comparison of agentic AI applied to the analysis of simulated data of …
arXiv cs.AI Research & Papers
CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Langu…
arXiv cs.AI Research & Papers
AuthorMix: Modular Authorship Style Transfer via Layer-wise Adapter Mixing
arXiv cs.AI Research & Papers
LoRe: Adaptive Interaction-Evaluation Routing with Per-Step Interaction Budgets for Itera…
arXiv cs.AI Research & Papers
SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding
arXiv cs.AI Research & Papers
No Reader Left Behind: Multi-Agent Summaries Everyone Can Understand
arXiv cs.AI Research & Papers
The Cognitive Categorical Transformer: Category-Theoretic Inductive Biases for Language M…
arXiv cs.AI Research & Papers
BEAT: Tokenizing and Generating Symbolic Music by Uniform Temporal Steps
arXiv cs.AI Research & Papers
Rubric-Guided Process Reward for Stepwise Model Routing
arXiv cs.AI Research & Papers
UA-Legal-Bench: A Benchmark for Evaluating Large Language Models on Ukrainian Legal Reaso…
arXiv cs.AI Research & Papers
Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Mode…
arXiv cs.AI Research & Papers
Causal Disentanglement-Inspired Degradation Representation Learning for Full-Reference Im…
arXiv cs.AI Research & Papers
FHRFormer: A Self-Supervised Masked Transformer Framework for Fetal Heart Rate Time-Serie…
arXiv cs.AI Research & Papers
Notation Matters: A Benchmark Study of Token-Optimized Formats in Agentic AI Systems
arXiv cs.AI Research & Papers
Archon: A Unified Multimodal Model for Holistic Digital Human Generation
arXiv cs.AI Research & Papers
Explainable AI in Speaker Recognition -- Making Latent Representations Understandable
arXiv cs.AI Research & Papers
Diagnosing Harmful Continuation in Answer-Correct Long-CoT Training Traces
arXiv cs.AI Research & Papers
Small Agent Group is the Future of Digital Health
arXiv cs.AI Research & Papers
Prune-OPD: Efficient and Reliable On-Policy Distillation for Long-Horizon Reasoning
arXiv cs.AI Research & Papers
CalBench: Evaluating Coordination-Privacy Trade-offs in Multi-Agent LLMs
arXiv cs.AI Research & Papers
Intent-aligned Autonomous Spacecraft Guidance via Reasoning Models
arXiv cs.AI Research & Papers
Rel-MOSS: Towards Imbalanced Relational Deep Learning on Relational Databases
arXiv cs.AI Research & Papers
CaC: Advancing Video Reward Models via Hierarchical Spatiotemporal Concentrating