Explorar

Noticias de IA

22116 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
LLM-Based Code Documentation Generation and Multi-Judge Evaluation
arXiv cs.AI Research & Papers
The Interlocutor Effect: Why LLMs Leak More Personal Data to Agents Than Humans
arXiv cs.AI Research & Papers
Whisfusion: Parallel ASR Decoding with Masked Diffusion
arXiv cs.AI Research & Papers
Janus: A Benchmark for Goal-Conditioned Information Distortion in LLMs
arXiv cs.AI Research & Papers
Fast and Highly Expressive Policy Learning for Offline Reinforcement Learning via Bootstr…
arXiv cs.AI Research & Papers
More Human or More AI? Visualizing Human-AI Collaboration Disclosures in Journalistic New…
arXiv cs.AI Research & Papers
Geometrically Averaged Hard Target Updates for Linear Q-Learning
arXiv cs.AI Research & Papers
An LLM-Native Psychometric Instrument Does Not Predict LLM Behavior: Evidence Across 25 M…
arXiv cs.AI Research & Papers
Self-EmoQ: Plutchik-Guided Value-based Planning to Drive Streaming Emotional TTS
arXiv cs.AI Research & Papers
On the Condition Number Dependency in Bilevel Optimization
arXiv cs.AI Research & Papers
AI-Driven Analytics of Team-Teaching Talk: Acoustic Patterns across Experience, Cohorts a…
arXiv cs.AI Research & Papers
CollabSkill: Evaluating Human-Agent Collaboration On Real-World Tasks
arXiv cs.AI Research & Papers
When the Chain of Thought Knows Better: Failure Modes in Multi-Turn Reasoning Models
arXiv cs.AI Research & Papers
Dep-LLM: Training-Free Depression Diagnosis via Evidence-Guided Structured Multi-factor w…
arXiv cs.AI Research & Papers
Spatial-Omni: Spatial Audio Understanding Integration in Multimodal LLMs via FOA Encoding
arXiv cs.AI Research & Papers
CleanPatrick: A Benchmark for Image Data Cleaning
arXiv cs.AI Research & Papers
Expert-Level Crisis Detection in Mental Health Conversations
arXiv cs.AI Research & Papers
ActiveMem: Distributed Active Memory for Long-Horizon LLM Reasoning
arXiv cs.AI Research & Papers
One Token per Multimodal Evidence: Latent Memory for Resource-Constrained QA
arXiv cs.AI Research & Papers
Infini Memory: Maintainable Topic Documents for Long-Term LLM Agent Memory
arXiv cs.AI Research & Papers
The Arbiter Agent: Continually Monitoring Multi-Agent Conversations to Detect Emergent Mi…
arXiv cs.AI Research & Papers
AutoPDE: Reliable Agentic PDE Solving via Explicitly Represented Solver Strategies
arXiv cs.AI Research & Papers
Accelerating NeurASP with vectorization and caching
arXiv cs.AI Research & Papers
Moonshine: An Autonomous Mathematical Research Agent Centered on Conjecture Generation
arXiv cs.AI Research & Papers
Do VLMs Reason Like Engineers? A Benchmark and a Stage-wise Evaluation
arXiv cs.AI Research & Papers
Large-scale semantic mapping of learner agency and autonomy reveals what measurement and …
arXiv cs.AI Research & Papers
Role-Agent: Bootstrapping LLM Agents via Dual-Role Evolution
arXiv cs.AI Research & Papers
Detecting Knowledge Gaps from Conversational AI Interactions Using Curriculum Prerequisit…
arXiv cs.AI Research & Papers
HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning
arXiv cs.AI Research & Papers
Frontier Coding Agents Use Metaprogramming to Adapt to Unfamiliar Programming Languages