Sticky Routing: Training MoE Models for Memory-Efficient Inference
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
Signed Symmetric Quantization for Few-Bit Integers
REAL: REtrieval-reAsoning and Logic-constructed Attention Behaviors for Long-Context KV C…
A Descriptive and Normative Theory of Human Beliefs in RLHF
Scalable Visual Pretraining for Language Intelligence
Semantic Pareto-DQN: A Multi-Objective Reinforcement Learning Framework for Financial Ano…
Lean-QIT: Towards a Formal Infrastructure for Quantum Information Theory
Task-Specific Multimodal Question Answering Agents via Confidence Calibration and Increme…
PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers
Heterogeneous Information-Bottleneck Coordination Graphs for Multi-Agent Reinforcement Le…
A Self-Evolving Agentic Framework for Metasurface Inverse Design
TCLA: Training-Free Class-wise Logit Adaptation for Medical Vision-Language Models
Seeing is Free, Speaking is Not: Uncovering the True Energy Bottleneck in Edge VLM Infere…
Conceptual Networks for Cross-Linguistic Idiomatic Expressions:A Feature-Based Graph Appr…
LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making
OpenProver: Agentic and Interactive Theorem Proving with Lean 4
Toward Auditable AI Scientists: A Hypothesis Evolution Protocol for LLM Agents
CtrlVTON: Controllable Virtual Try-On via Visual-Instance-Prompt Segmentation
KV-PRM: Efficient Process Reward Modeling via KV-Cache Transfer for Multi-Agent Test-Time…
MedRealMM: A Real-World Multimodal Benchmark for Chinese Online Medical Consultation
Long-Horizon-Terminal-Bench: Testing the Limits of Agents on Long-Horizon Terminal Tasks …
Interval Certifications for Multilayered Perceptrons via Lattice Traversal
When Routes Run Out: Adversarial Co-Learning and Explainable Robustness in Quantum Repeat…
Fully Trainable Deep Differentiable Logic Gate Networks and Lookup Table Networks
Ceci n'est pas une pipe: AI systems as semantic abstractions
SVF-CR: Synchronized Visual-Facial Cross-Refinement for Multimodal Ambivalence and Hesita…
Shared Selective Persistent Memory for Agentic LLM Systems
Knowledge Graphs and Explainable AI as Complementary Resources for Urban Mining
Agora: Enhancing LLM Agent Reasoning Via Auction-Based Task Allocation
CogniConsole: Externalizing Inference-Time Control as a Formal Abstraction for Reliable L…