CompilerKV: Risk-Adaptive KV Compression via Offline Experience Compilation
Explorar
Noticias de IA
30724 elementos — filtrados, clasificados y sin duplicados
LinguistAgent Technical Report: A Reflective Multi-Model Platform for Automated Linguisti…
ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learni…
Hyperdimensional Probe: Decoding LLM Representations via Vector Symbolic Architectures
Training and Simulation of Quadrupedal Robot in Adaptive Stair Climbing and Descending fo…
Toward Learning POMDPs Beyond Full-Rank Actions and State Observability
PRISP: Privacy-Safe Few-Shot Personalization via Lightweight Adaptation
Saving the legacy of Hero Ibash: Evaluating Four Language Models for Aminoacian
Benchmarking Multimodal Large Language Models for Scientific Visualization Literacy
RetroAgent: Harnessing LLMs to Search Over Structured Memory for Agentic Retrosynthesis P…
FormalAnalyticGeo: A Neural-Symbolic Based Framework for Multimodal Analytic Geometry Pro…
FinRAG-12B: A Production-Validated Recipe for Grounded Question Answering in Banking
Animating Petascale Time-varying Data on Commodity Hardware with LLM-assisted Scripting
LLM-Grounded Explainable AI for Supply Chain Risk Early Warning via Temporal Graph Attent…
Fluid Reasoning Representations
RoboInspector: Unveiling the Unreliability of Policy Code for LLM-enabled Robotic Manipul…
Chi-Square Wavelet Graph Neural Networks for Heterogeneous Graph Anomaly Detection
A Self-Supervised Framework for Space Object Behaviour Characterisation
SENTINEL: A Multi-Level Formal Framework for Safety Evaluation of Foundation Model-based …
Appearance Pointers -- Multimodal Region Control of Diffusion Transformers
ISO: An RLVR-Native Optimization Stack
Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information
Riemannian Deep Learning:Modules, Networks, and Geometries
Dr. Zero: Self-Evolving Search Agents without Training Data
Learning to Make Friends: Coaching LLM Agents toward Emergent Social Ties
Benchmarking Generalization in Financial Statement Fraud Detection: robust evaluation and…
The Price of Reasoning: Cost-Quality Tradeoffs in Reinforcement Learning for Neural Machi…
Beyond Score Prediction: LLM-Based Essay Scoring and Feedback Generation via Reinforcemen…
Free energy landscape of Dense Associative Memory
Resist and Update: Counterfactual Report Coordinates for Incentive-Compatible LLMs