Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Length-Adaptive Decoding for Masked Diffusion Machine Translation
arXiv cs.AI Research & Papers
Hierarchy-Aware Supervised Uncertainty Estimation for Black-box LLM Taxonomic Reasoning
arXiv cs.AI Research & Papers
Automating Multi-Hop RAG Evaluation via TRIAD: From Context Extraction to Validated Datas…
arXiv cs.AI Research & Papers
LLM-Based Adversarial Persuasion Attacks on Fact-Checking Systems
arXiv cs.AI Research & Papers
Silent Alarm: A J-Space Protocol for Comparing Danger Recognition Across Models and Quant…
arXiv cs.AI Security & Safety
On Predicting Vulnerability Severity Using In-Context Learning: An Industrial Case Study
arXiv cs.AI Research & Papers
Composable Trust Infrastructure for Manufacturing Knowledge Graphs: Cross-System Provenan…
arXiv cs.AI Research & Papers
There Is No Neutral Harness: Modern LLM Leaderboards Are Manufactured by Config-Fragile I…
arXiv cs.AI Research & Papers
Automated Construction of FAIR Digital Object Knowledge Graphs from Flat Cultural Heritag…
arXiv cs.AI Research & Papers
RIACT: A Responsible AI System for Personalized Study Habit Tracking and Early Burnout Si…
arXiv cs.AI Research & Papers
What Process Evaluation of Coding Agents Actually Measures: Action, Task, and Step Are Th…
arXiv cs.AI Research & Papers
OVIBench: Benchmarking Online Video Question Answering under Interruption
arXiv cs.AI Research & Papers
Is Next-Chunk Reasoning RL Really Better than SFT? Revisiting Training Strategies under n…
arXiv cs.AI Research & Papers
One-Step Evolution for Long-Time Extrapolation: An Error-Bound-Informed and Prior-Guided …
arXiv cs.AI Research & Papers
WildHandBench: A Benchmark for Handwritten Text Understanding that Challenges MLLMs and H…
arXiv cs.AI Research & Papers
FigmaTrace: Capturing Creative Nuances in Human Figma Design Workflows
arXiv cs.AI Research & Papers
The Emergence of Relevance Through Axiomatic Attention Patterns During LoRA Fine-Tuning
arXiv cs.AI Research & Papers
SkillAlchemy: Open-World Agent Skill Creation
arXiv cs.AI Research & Papers
Cross-Subject Generalization in Decoding Perceived Speech from Non-Invasive Brain Recordi…
arXiv cs.AI Research & Papers
Minimal Local Simulation Foundations for LLM- and VLM-Driven Agents in 2D and 3D Environm…
arXiv cs.AI Research & Papers
Future Querying: Can LLMs Serve as Implicit Medical World Models?
arXiv cs.AI Research & Papers
GameXpert-Bench: How Far Are Coding Agents from Expert Game Development?
arXiv cs.AI Research & Papers
How to Train a Critic Stably and Efficiently
arXiv cs.AI Research & Papers
How AI Assistance Affects Human Skill Development: A Study of Learning with Logic Puzzles
arXiv cs.AI Research & Papers
ProBel: Propaganda Detection with Techniques, Spans, and Explanations
arXiv cs.AI Research & Papers
WAM-OPD: On-Policy Distillation for World Action Models
arXiv cs.AI Research & Papers
AdaR: A Framework for Equipping LLMs with Adaptive Reasoning
arXiv cs.AI Research & Papers
What LLMs explain is not what they believe: Evaluating explanation sufficiency under mode…
arXiv cs.AI Research & Papers
Rank Reversal in Multilingual LLM Judges: A Label-Free Double-Centering Calibrator
arXiv cs.AI Research & Papers
GenCoord: Skill-Path Commitments under Private Information