Is Progressive Disclosure All You Need for Long-Context Agents?
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orienta…
FlowBlock: Wavefront-Parallel Decoding for Self-Correcting Diffusion Language Models
Verify, Repair, Repeat, or Stop? Robust Stopping for Noisy Verify-Repair Loops in LLM Age…
A Dual-Hypothesis Reasoning Framework for LLM Guardrails
Reinforcement Learning: From Algorithms To Foundation Models
Retain or Consolidate? Budget-Dependent Operator Selection for Language Agent Memory
The Curvature Shadow: An Apparent Failure of Maximum-Entropy Equilibrium Selection is a R…
Can AI Agents Really Complete RTL-to-GDS? Lessons from Benchmarking Tool-Interactive EDA …
Pailitao-MMSearch: Building Native E-Commerce Multimodal Search Foundation
Panache: One-Pass Motif Discovery at Every Window Length
Empirical Grounding Improves the Realism of LLM Agents Simulating Human Behavior During D…
Intermittent Control Is Not Diluted Control: A Switching Effect in Artificial Agency
Quantifying Diversity of Thought: A Predictive Law of Weighted LLM Ensemble Lift
Lossless but Not Free: An Empirical Anatomy of Speculative Decoding on Consumer Hardware
An Explicit World Model Based on Data-First Ontology: DaoQL Multimodal Storage Validation…
Coordinated Disentanglement with Iterative Mode Discovery Under Hidden Correlations
LenGuard-GPC: Length Guarding with Guided-Prompt Consistency for Spatial Reasoning Reinfo…
Constrained Path Reasoning: Measuring When Committed Stages Earn Their Cost
Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, …
Is Your Model Thinking or Just Stagnating? PUMA: Diagnosing Reasoning Pathology via Phase…
A Diagnostic Framework for AI Agent Behavior
Fourier Geometric Wind Power Forecasting with Numerical Weather Prediction
Bridging the Information Gap: Semantic Densification and Hindsight Distillation for Cold-…
When LLMs Over-Answer: Measuring and Mitigating Quality Issues in LLM-Based Hardware Desc…
Reward-Driven LLM Agent Workflows: Synthesizing POMDP Routing and Self-Correction for Aut…
PriorProof: A Point-in-Time Measure of Technique Novelty for Formal Proofs
Expected Free Energy as Belief-Dependent Utility for rho-POMDPs
Lomekwi: Resource-Bounded Tool Discovery in LLM Agents
Environment-free Synthetic Data Generation for API-Calling Agents