Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Heterogeneous Causal Discovery of Repeated Undesirable Health Outcomes
arXiv cs.AI Research & Papers
Reverse Probing: Supervised Token-level Uncertainty Quantification for Large Language Mod…
arXiv cs.AI Research & Papers
Zipping the Thought: When and How Compressed Reasoning Data Works in LLM Post-Training
arXiv cs.AI Research & Papers
BuddyBench: A Privacy-Constrained Multi-Task Benchmark for Pediatric Social-Communication…
arXiv cs.AI Research & Papers
Gradient Step Plug-and-Play Model for Dental Cone-Beam CT Reconstruction
arXiv cs.AI Research & Papers
Towards Reliable Multilingual LLMs-as-a-Judge: An Empirical Study
arXiv cs.AI Research & Papers
Bridging the Detection-to-Abstention Gap in Reasoning Models under Insufficient Informati…
arXiv cs.AI Research & Papers
MACReD: A Multi-Agent Collaborative Reasoning Framework for Reaction Diagram Parsing
arXiv cs.AI Research & Papers
Training Stratigraphy: Persistent Behavioral Artifacts in Large Language Models Observed …
arXiv cs.AI Research & Papers
Emerging Extrinsic Dexterity in Cluttered Scenes via Dynamics-aware Policy Learning
arXiv cs.AI Research & Papers
Mining Multi-Modality Spatio-Temporal Cues for Video Important Person Identification
arXiv cs.AI Research & Papers
Models That Know How Evaluations Are Designed Score Safer
arXiv cs.AI Research & Papers
Human-like in-group bias in instruction-tuned language model agents
arXiv cs.AI Research & Papers
CIVIC: End-to-End Sequence Compactness for Efficient Vision-Language Models
arXiv cs.AI Research & Papers
A Multi-dimensional Framework for Evaluating Generalization in EEG Foundation Models
arXiv cs.AI Research & Papers
Stochastic Gradient Descent with Momentum is Algorithmically Stable
arXiv cs.AI Research & Papers
OR-Space: A Full-Lifecycle Workspace Benchmark for Industrial Optimization Agents
arXiv cs.AI Research & Papers
ProvMind: Provenance-grounded reasoning for materials synthesis
arXiv cs.AI Research & Papers
Localizing Input Uncertainty Quantification for Large Language Models via Shapley Values
arXiv cs.AI Research & Papers
The Cases LJP Never Sees: Prosecution Decision Prediction for More Complete Criminal Liab…
arXiv cs.AI Research & Papers
Multi-Agent LLM-based Metamorphic Testing for REST APIs
arXiv cs.AI Research & Papers
PIRS: Physics-Informed Reward Shaping for SAC-Based Building Energy Management
arXiv cs.AI Research & Papers
Entropy Distribution as a Fingerprint for Hallucinations in Generative Models
arXiv cs.AI Research & Papers
Do LLMs Build World Models From Text? A Multilingual Diagnostic of Spatial Reasoning
arXiv cs.AI Research & Papers
ResearchLoop: An Evidence-Gated Control Plane for AI-Assisted Research
arXiv cs.AI Research & Papers
Hurwitz Quaternion Multiplicative Quantization for KV Cache Compression
arXiv cs.AI Research & Papers
Learning the Error Patterns of Language Models
arXiv cs.AI Research & Papers
The Principles of Diffusion Models
arXiv cs.AI Research & Papers
EAGer: Entropy-Aware GEneRation for Adaptive Inference-Time Scaling
arXiv cs.AI Research & Papers
Visualizing Latent Phase Structures in Locomotion Policies: A Multi-Environment Study wit…