Explorar

Noticias de IA

29670 elementos — filtrados, clasificados y sin duplicados

arXiv cs.AI Research & Papers
PMMC: Prospective Multimodal Memory Compilation for Long-Term LVLM Agents
arXiv cs.AI Research & Papers
Escaping Confidence Trap: Evolutionary Decoding for Mathematical Reasoning in Diffusion L…
arXiv cs.AI Research & Papers
Rewriting or Reweighting? A Geometric Account in Language Models
arXiv cs.AI Research & Papers
ReasonCast: Towards Explainable Time Series Forecasting with Reasoning
arXiv cs.AI Research & Papers
Formally Verifying Analog Neural Networks Under Process Variations Using Polynomial Zonot…
arXiv cs.AI Research & Papers
Mastering PokeGym: Graph-Guided Multimodal Evolution at Test Time
arXiv cs.AI Research & Papers
Meritocratic Fairness via $K$-Shapley Values in Budgeted Combinatorial Bandits with Full-…
arXiv cs.AI Research & Papers
Asymmetric Generative Recommendation via Kronecker Residual Bridge and Multi-Faceted Hier…
arXiv cs.AI Research & Papers
Infinite Trace Objectives with Finite Trace Techniques: Translating LTL to LTLf+
arXiv cs.AI Research & Papers
Cross-Task Dissociation in Frontier Vision-Language Model Theory of Mind
arXiv cs.AI Research & Papers
Rethinking LLM-Judged Helpfulness as a Pedagogy Signal: A Pre-Registered Audit Across Tut…
arXiv cs.AI Research & Papers
Stop When Memory Suffices: Evidence-Conditioned Progressive Execution for LLM Agents
arXiv cs.AI Research & Papers
Mask-Based Priors Are More Persistent than Query-Key Initializations
arXiv cs.AI Research & Papers
SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Co…
arXiv cs.AI Research & Papers
MemArbiter: Decision-Time Memory Arbitration for Long-Horizon LLM Agents
arXiv cs.AI Research & Papers
Key-Value Means: Transformers with Expandable Block-Recurrent Compressed Memory
arXiv cs.AI Research & Papers
Where Reasoning Diverges: Localized Multi-Agent Debate
arXiv cs.AI Research & Papers
Cloud to Edge: Benchmarking LLM Inference On Hardware-Accelerated Single-Board Computers
arXiv cs.AI Research & Papers
Talking to Digital Twins: Selective Disclosure and Belief Measurement in Financial Social…
arXiv cs.AI Research & Papers
402Pilot: An x402 Decision Layer for Autonomous Agent Micropayments
arXiv cs.AI Research & Papers
RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models
arXiv cs.AI Research & Papers
Real-Time Detection and Repair of LLM Agent Failures
arXiv cs.AI Research & Papers
Is More Privileged Information Better? From Solution Traces to Problem-Solving Structure …
arXiv cs.AI Research & Papers
Beyond Solution-Centric Search: Adaptive Inquiry and Knowledge Revision for Autonomous ML…
arXiv cs.AI Research & Papers
Counterfactual Reasoning for Causal Responsibility Attribution in Probabilistic Multi-Age…
arXiv cs.AI Research & Papers
Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing…
arXiv cs.AI Research & Papers
A Contractualist Argumentation Framework for Moral Decision-Making
arXiv cs.AI Research & Papers
Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memo…
arXiv cs.AI Security & Safety
MineGrad: Gradient Inversion Attacks on LoRA Fine-Tuning
arXiv cs.AI Research & Papers
Cochise: A Reference Harness for Autonomous Penetration Testing