CoT-Core: Accelerating LLM Evaluation via CoT-Aware Coreset Selection
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Request-Level Energy Attribution for Batched LLM Serving
RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models
Meritocratic Fairness via $K$-Shapley Values in Budgeted Combinatorial Bandits with Full-…
MEGRAG: Multi-Granular Evidence Graphs for Answer-Aware Multi-Hop RAG
Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics
A New Theory of Value for Post-AGI Economics
TCPO: Turn-Level Credit Policy Optimization
When Memory Becomes Authority: Benchmarking Authority Collapse at the Memory Consolidatio…
Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing…
Where Reasoning Diverges: Localized Multi-Agent Debate
MineGrad: Gradient Inversion Attacks on LoRA Fine-Tuning
V-Mem: Modality-Routed Retrieval for Long-Term Multimodal Agentic Memory
Post-Training on Office Work Improves Software Engineering: A Behavioral Account of Cross…
Salami Attack: Stealthy Collusive Memory Poisoning against OpenClaw
FRAMES: Guarded and Dual-Objective Skill Evolution for Agents in Policy-Governed Enterpri…
Rewriting or Reweighting? A Geometric Account in Language Models
Computing with Agentic Oracles
Physics-Informed Neural Networks for Complex Eigenfrequency Identification and Mode Struc…
ReasonCast: Towards Explainable Time Series Forecasting with Reasoning
Beyond Single-Use Tokens: Durable Authorization State for Replay-Resistant LLM Agent Acti…
LaCache: Robust Semantic Caching for LLM Serving
DAPD: Dual-Anchored Policy Distillation
From Simple QA to Deep Research: A Verifiable Benchmark Constructed through Iterative Tas…
A Contractualist Argumentation Framework for Moral Decision-Making
HALT: Verification-Aware Stopping for Retrieval-Augmented Search Agents
Before Reasoning Fails: Pre-Evidence Procedural Failures in Agentic RAG
HPFA: Hypergraph-Based Paired Failure Attribution for LLM Reasoning
Conservation laws determine what physical learning remembers
GRAIN: Molecules Are Not the Right Granularity -- Active-Ingredient Modeling for Safe Med…