Explorar

Noticias de IA

27413 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
Leveraging System-Level Observations to Inform Bayesian Learning of Model Parameters for …
arXiv cs.AI Research & Papers
Mechanism of Task-oriented Information Removal in In-context Learning
arXiv cs.AI Research & Papers
Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent
arXiv cs.AI Research & Papers
Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?
arXiv cs.AI Research & Papers
TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning
arXiv cs.AI Research & Papers
OR-Agent: Bridging Evolutionary Search and Structured Research for Automated Algorithm Di…
arXiv cs.AI Research & Papers
Modeling Matches as Language: A Generative Transformer Approach for Counterfactual Player…
arXiv cs.AI Research & Papers
Assessing the Effect of Cross-Domain Mapping on Creativity in Humans and Large Language M…
arXiv cs.AI Research & Papers
LogitScope: A Framework for Analyzing LLM Uncertainty Through Information Metrics
arXiv cs.AI Research & Papers
AI Assistance Reduces Persistence and Hurts Independent Performance
arXiv cs.AI Research & Papers
An empirical evaluation of the risks of AI model updates using clinical data: stability, …
arXiv cs.AI Research & Papers
CAPT: A Multi-task Continuous Autoregressive Transformer enabling Cross-dataset and Cross…
arXiv cs.AI Research & Papers
The Geometric Nature and a Free Proxy for Flow-Matching Uncertainty
arXiv cs.AI Research & Papers
GDPevo: Evaluating Agent Self-Evolution on Real Business Tasks
arXiv cs.AI Research & Papers
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech …
arXiv cs.AI Research & Papers
Self-Organising Digital Circuits
arXiv cs.AI Research & Papers
ISEE: Interactive Semantic Enrichment for Database Fields
arXiv cs.AI Research & Papers
Verified Tool Calls Improve LLM Agent Reliability Under Non-Atomic Failures
arXiv cs.AI Research & Papers
Test-Time Scaling for Safe Text-Guided Image Generation via Intermediate Clean Estimates
arXiv cs.AI Research & Papers
Structure-Aware Robust Fine-Tuning: Defending Vision-Language-Action Robots Against Physi…
arXiv cs.AI Research & Papers
Learning Molecular Representations from Cellular Phenotypes with Structure Preservation
arXiv cs.AI Research & Papers
When Policies Change Probabilities: Modular Decision-Making for LLM Code Review
arXiv cs.AI Research & Papers
KnowHal: A Knowledge-Driven Benchmark for Comprehensive Multimodal Hallucination Evaluati…
arXiv cs.AI Research & Papers
Multi-Camera Trajectory Forecasting with Trajectory Tensors
arXiv cs.AI Research & Papers
Implementing Causal Perception: Competing SCMs and Situated Fairness
arXiv cs.AI Research & Papers
ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities?
arXiv cs.AI Research & Papers
Taming the Implicit: Dual-Channel Risk-Aware Reinforcement Fine-Tuning for Continual Mult…
arXiv cs.AI Research & Papers
Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algo…
arXiv cs.AI Research & Papers
Less Traffic, Better Outcomes: Competition-Aware Request Dispatch in Real-Time Ad Exchang…
arXiv cs.AI Research & Papers
LiveEvalBench: Toward Open-World Evaluation for Web Generation