PMMC: Prospective Multimodal Memory Compilation for Long-Term LVLM Agents
Explorar
Noticias de IA
29670 elementos — filtrados, clasificados y sin duplicados
Escaping Confidence Trap: Evolutionary Decoding for Mathematical Reasoning in Diffusion L…
Rewriting or Reweighting? A Geometric Account in Language Models
ReasonCast: Towards Explainable Time Series Forecasting with Reasoning
Formally Verifying Analog Neural Networks Under Process Variations Using Polynomial Zonot…
Mastering PokeGym: Graph-Guided Multimodal Evolution at Test Time
Meritocratic Fairness via $K$-Shapley Values in Budgeted Combinatorial Bandits with Full-…
Asymmetric Generative Recommendation via Kronecker Residual Bridge and Multi-Faceted Hier…
Infinite Trace Objectives with Finite Trace Techniques: Translating LTL to LTLf+
Cross-Task Dissociation in Frontier Vision-Language Model Theory of Mind
Rethinking LLM-Judged Helpfulness as a Pedagogy Signal: A Pre-Registered Audit Across Tut…
Stop When Memory Suffices: Evidence-Conditioned Progressive Execution for LLM Agents
Mask-Based Priors Are More Persistent than Query-Key Initializations
SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Co…
MemArbiter: Decision-Time Memory Arbitration for Long-Horizon LLM Agents
Key-Value Means: Transformers with Expandable Block-Recurrent Compressed Memory
Where Reasoning Diverges: Localized Multi-Agent Debate
Cloud to Edge: Benchmarking LLM Inference On Hardware-Accelerated Single-Board Computers
Talking to Digital Twins: Selective Disclosure and Belief Measurement in Financial Social…
402Pilot: An x402 Decision Layer for Autonomous Agent Micropayments
RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models
Real-Time Detection and Repair of LLM Agent Failures
Is More Privileged Information Better? From Solution Traces to Problem-Solving Structure …
Beyond Solution-Centric Search: Adaptive Inquiry and Knowledge Revision for Autonomous ML…
Counterfactual Reasoning for Causal Responsibility Attribution in Probabilistic Multi-Age…
Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing…
A Contractualist Argumentation Framework for Moral Decision-Making
Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memo…
MineGrad: Gradient Inversion Attacks on LoRA Fine-Tuning
Cochise: A Reference Harness for Autonomous Penetration Testing