When Model Merging Breaks Routing: Training-Free Calibration for MoE
Explorar
Noticias de IA
21863 elementos — filtrados, clasificados y sin duplicados
Grasp-Then-Plan with Failure Attribution: A Closed Two-Stage Framework for Precise and Ge…
scTranslation: A Comprehensive Benchmark for Single-Cell Multi-Omics Modality Translation
PrimeSVT: An Automated Memory-aware Pruning Framework with Prioritized Compression Policy…
SPADE: Sketch-guided Path Planning Augmented with Diffusion Experts
Efficient Transformer-Based Localized Patch Sampling for Choroid Plexus Segmentation in M…
When Should the Teacher Move? Temporal Coupling and Stability in Self On-Policy Distillat…
When RLHF Fails: A Mechanistic Taxonomy of Reward Hacking, Collapse, and Evaluator Gaming
Testing LLM Arithmetic Reasoning Generalization with Automatic Numeric-Remapping Attacks
CauTion: Knowing When to Trust LLMs for Ensemble Causal Discovery
PHASER: Phase-Aware and Semantic Experience Replay for Vision-Language-Action Models
How Quantization Changes Interpretable Features: A Sparse Autoencoder Analysis of Languag…
Are we really tilting? The mechanics of reward guidance in flow and diffusion models
AnchorMoE: Interpretable Time Series Classification via Anchor-Routed MoE
Building Reliable Long-Form Generation via Hallucination Rejection Sampling
TurtleAI: Benchmarking Multimodal Models for Visual Programming in Turtle Graphics
Hallucinations as Orthogonal Noise: Inference-Time Manifold Alignment via Dynamic Context…
Collab-REC: An LLM-based Agentic Framework for Balancing Recommendations in Tourism
Staying Alive: Uncensored Survival Analysis with Tabular Foundation Models
AUGUSTE: Online-Learning dApp for Predictive URLLC Scheduling
MemVerse: Multimodal Memory for Lifelong Learning Agents
PURGE: Projected Unlearning via Retain-Guided Erasure
Trading Human Curation for Synthetic Augmentation in RLVR
Signed Spiking Neuron Enabled by an Orthogonal-Easy-Axis Magnetic Tunnel Junction
E2LLM: Towards Efficient LLM Serving in Heterogeneous Edge/Fog Environments
FutureWeaver: Planning Test-Time Compute for Multi-Agent Systems with Modularized Collabo…
VeRO: A Harness for Agents to Optimize Agents
Conditional Latent Diffusion Model with Fourier-based Motion Modelling for Virtual Popula…
Consistency Training Can Entrench Misalignment
Taiji: Pareto Optimal Policy Optimization with Semantics-IDs Trade-off for Industrial LLM…