Explorar

Noticias de IA

37834 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
TROVE: Adaptive Agent Skill Orchestration via Trace-Grounded Route Validation and Editing
arXiv cs.AI Research & Papers
Do LLMs Exhibit Coherent Knowledge Structures in Mathematical Reasoning? A Perspective fr…
arXiv cs.AI Research & Papers
Quality-diversity in dissimilarity spaces
arXiv cs.AI Research & Papers
Why We Care About Understanding: Competence through Predictive Compression
arXiv cs.AI Research & Papers
A Tree-based RAG Framework for Evidence-Intensive QA via Adaptive Planning and Topology-A…
arXiv cs.AI Research & Papers
Artificial Intelligence in Equity and Crypto Markets: Progress, Profitability Evidence, a…
arXiv cs.AI Research & Papers
Language models judge war differently when tested for alignment
arXiv cs.AI Research & Papers
Compact-Memory LLM Agents via Online Max-Member Clustering and Atom-Aware Packing
arXiv cs.AI Research & Papers
Don't Drop Dropout: Optimizing Layer Sparsity for Efficient LLM Training and Inference
arXiv cs.AI Research & Papers
From Language Models to World-Acting Systems: Progress and Limits of Agentic AI across Di…
arXiv cs.AI Research & Papers
CoSkill: Joint Reinforcement Learning of Reasoning and Meta-Skill Agents for Hierarchical…
arXiv cs.AI Research & Papers
The History Is the Detector: Executing CVE Patch History, End-to-End
arXiv cs.AI Research & Papers
From Interaction Traces to Persistent Skills: Online Evolution for Computer-Use Agents
arXiv cs.AI Research & Papers
AutoLR: Automating the Path from Research to Launch Review in Industrial Recommender Syst…
arXiv cs.AI Research & Papers
Diffusion TV: Experiencing Diffusion Models through Tangible, Embodied Interaction
arXiv cs.AI Research & Papers
Long Horizon Transformer Quantile Fault Prediction for Multi Site Industrial Predictive M…
arXiv cs.AI Research & Papers
ElderBench: Benchmarking Autonomous Mobile Agents for Older Adults
arXiv cs.AI Research & Papers
CHAMP: Cross-domain Hybrid Architecture for Matchmaking and Prediction in Online Multi-Pl…
arXiv cs.AI Research & Papers
PetQA: Benchmarking Veterinary Knowledge and Clinical Reasoning
arXiv cs.AI Research & Papers
Whose record is this? Diagnosing and authorizing record use in personalized multimodal mo…
arXiv cs.AI Research & Papers
Hierarchical Possession-Aware Graph Pointer Network for Pass Receiver Selection
arXiv cs.AI Research & Papers
Diffusion Language Models for Mobile Edge Agentic AI: Foundations, Applications, and Chal…
arXiv cs.AI Research & Papers
Aplaud: Adaptive Personalized Low-Rank Decomposition for User-Specific LLM
arXiv cs.AI Research & Papers
Shadow Queries for Private Retrieval in Vector Databases
arXiv cs.AI Research & Papers
When Financial Fine-tuning Fails: A Three-Level Detectability Analysis of Numerical Hallu…
arXiv cs.AI Research & Papers
Predicting Spatiotemporal Mobile Sensing-Based PM2.5 Concentrations Using Low-Rank Adapte…
arXiv cs.AI Research & Papers
Model Retirement Creates Reproducibility Risk in Biomedical AI Publications
arXiv cs.AI Research & Papers
FinalityBench: An Effect-Level Benchmark for Agent Decisions Under Delayed and Conflictin…
arXiv cs.AI Research & Papers
Commonsense Reasoning in Computer Vision: Foundations, Recent Advancements, and Future Di…
arXiv cs.AI Research & Papers
Harness-agnostic detection and immunization of reward hacking in self-evolving language m…