Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing…
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
When Memory Becomes Authority: Benchmarking Authority Collapse at the Memory Consolidatio…
TCPO: Turn-Level Credit Policy Optimization
A New Theory of Value for Post-AGI Economics
Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics
RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models
Request-Level Energy Attribution for Batched LLM Serving
CoT-Core: Accelerating LLM Evaluation via CoT-Aware Coreset Selection
Enhancing LLMs with Context-Specific Knowledge for Mitigating Misinformation in SMEs: A R…
High-Stakes Decisions with Language Models: Insights from Emergency Triage
402Pilot: An x402 Decision Layer for Autonomous Agent Micropayments
Learning What to Remember and What to Internalize in LLM Self-Evolution via Adaptive Memo…
Large language models improve physician accuracy but lead to false reliance
FinDeepIndicator: Benchmarking Deep Research Agents in End-to-End Financial Indicator Con…
Behavioral Grammar: Detecting Adaptive Malware via Tiny Language Model Priors and Second-…
DGA$_2$D: Directed Graph-Guided Automated Algorithm Design with Large Language Models
Evolutionary Curriculum Learning Improves Biological Sequence Modeling
When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task …
Role-Decoupled Attention Residuals: Separating Matching and Content Retrieval Across Depth
Don't Offer What Can't Be Done: Deterministic Executability Gating for LLM Skill Selectio…
SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Co…
Search-GRT: Guided Retrieval Training of Search Agents to Optimize for Complex Question A…
PMMC: Prospective Multimodal Memory Compilation for Long-Term LVLM Agents
Similarity Weighted Aggregation with Global Differential Privacy for Federated Brain Lesi…
Isotropy Cliffs: The Geometric Signature of Decision-Making in Large Language Models
Escaping Confidence Trap: Evolutionary Decoding for Mathematical Reasoning in Diffusion L…
TaPR: Test-Aware Policy Refinement for Feedback-Conditioned Code Generation
Ekova: A Personality-Support Agent for Self-Discovery Dialogue
Mask-Based Priors Are More Persistent than Query-Key Initializations
ObjectStream: Latent Objects as Memory Anchors for Streaming Video Understanding