AI Assistance Reduces Persistence and Hurts Independent Performance
Explorar
Noticias de IA
29627 elementos — filtrados, clasificados y sin duplicados
VeriTrace: Human-Like Temporal Exploration Completes Agentic Action Space
LogitScope: A Framework for Analyzing LLM Uncertainty Through Information Metrics
Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility
TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning
Toward Understanding the Transferability of Adversarial Suffixes in Large Language Models
Can Large Language Models Recover Semantic Optimization Opportunities That Compilers Miss?
CVPO: Enhancing LLM Reinforcement Learning Reasoning via Value-Variance Adaptation and Dy…
UniGD: A Unified Generative-Discriminative Framework for Industrial Retrieval
Is Inter-Seed Cross-Play Enough? Evaluating the Robustness of Zero-Shot Coordination Algo…
Video-DeepResearch: Towards the Next-Generation Multimodal Deepresearch Agent
Equivariant Music Transformer
Aligning Large Vision-Language Models at Test Time: A Trajectory-Guided Structured Sampli…
Logic Before Language: Pre-pretraining on Formal Derivations Fosters Skill Acquisition an…
Enhancing VLM Reward Models Through Structure-Aware Fine-Tuning
Separating quantum circuits from classical LLMs
Designing a Good Virtual Node: Addressable and Cardinality-Preserving Global Memory for M…
Evaluating LLM-Based Goal Extraction in Requirements Engineering: Prompting Strategies an…
TraceCAD: Trace-Guided Repair for Agentic CAD Generation
MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning
Distilled Roads: Generalisable Road Network Extraction Across Sensors, Resolutions, and R…
SciRet: A Compute-Aware Empirical Study of Retrieval and Reranking for Scientific RAG
Interpretable Adaptive Sampling for LLM Test-Time Scaling
A Unified Framework for Human AI Collaboration in Security Operations Centers with Truste…
HyperAgent: Planning and Acting over Tool-Schema Hypergraphs for Tool-Use LLM Agents
DiffImaginE: Imagine to Verify Entity Types with Diffusio
In-Context Pure Exploration in Continuous Decision Spaces
FlowForm: Synergizing Fluid Physics with Topological Consistency for Satellite Flood Synt…
Evaluating LLMs in Database Scenarios: A Lifecycle Benchmark for Assessing Their Potentia…
Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Lo…