Explorar

Noticias de IA

29627 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
AI Assistance Reduces Persistence and Hurts Independent Performance
arXiv cs.AI Research & Papers
VeriTrace: Human-Like Temporal Exploration Completes Agentic Action Space
arXiv cs.AI Research & Papers
LogitScope: A Framework for Analyzing LLM Uncertainty Through Information Metrics
arXiv cs.AI Research & Papers
Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility
arXiv cs.AI Research & Papers
TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning
arXiv cs.AI Security & Safety
Toward Understanding the Transferability of Adversarial Suffixes in Large Language Models
arXiv cs.AI Research & Papers
Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?
arXiv cs.AI Research & Papers
CVPO: Enhancing LLM Reinforcement Learning Reasoning via Value-Variance Adaptation and Dy…
arXiv cs.AI Research & Papers
UniGD: A Unified Generative-Discriminative Framework for Industrial Retrieval
arXiv cs.AI Research & Papers
Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algo…
arXiv cs.AI Research & Papers
Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent
arXiv cs.AI Research & Papers
Equivariant Music Transformer
arXiv cs.AI Research & Papers
Aligning Large Vision-Language Models at Test Time: A Trajectory-Guided Structured Sampli…
arXiv cs.AI Research & Papers
Logic Before Language: Pre-pretraining on Formal Derivations Fosters Skill Acquisition an…
arXiv cs.AI Research & Papers
Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning
arXiv cs.AI Research & Papers
Separating quantum circuits from classical LLMs
arXiv cs.AI Research & Papers
Designing a Good Virtual Node: Addressable and Cardinality-Preserving Global Memory for M…
arXiv cs.AI Research & Papers
Evaluating LLM-Based Goal Extraction in Requirements Engineering: Prompting Strategies an…
arXiv cs.AI Research & Papers
TraceCAD: Trace-Guided Repair for Agentic CAD Generation
arXiv cs.AI Research & Papers
MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning
arXiv cs.AI Research & Papers
Distilled Roads: Generalisable Road Network Extraction Across Sensors, Resolutions, and R…
arXiv cs.AI Research & Papers
SciRet: A Compute-Aware Empirical Study of Retrieval and Reranking for Scientific RAG
arXiv cs.AI Research & Papers
Interpretable Adaptive Sampling for LLM Test-Time Scaling
arXiv cs.AI Research & Papers
A Unified Framework for Human AI Collaboration in Security Operations Centers with Truste…
arXiv cs.AI Research & Papers
HyperAgent: Planning and Acting over Tool-Schema Hypergraphs for Tool-Use LLM Agents
arXiv cs.AI Research & Papers
DiffImaginE: Imagine to Verify Entity Types with Diffusio
arXiv cs.AI Research & Papers
In-Context Pure Exploration in Continuous Decision Spaces
arXiv cs.AI Research & Papers
FlowForm: Synergizing Fluid Physics with Topological Consistency for Satellite Flood Synt…
arXiv cs.AI Research & Papers
Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potentia…
arXiv cs.AI Research & Papers
Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Lo…