Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
Explorar
Noticias de IA
21271 elementos — filtrados, clasificados y sin duplicados
LEC: Linear Expectation Constraints for Selection-Conditioned Risk Control in Selective P…
Adversarial Training for Robust Coverage Network under Worst-case Facility Losses
EmoDistill: Offline Emotion Skill Distillation for Language Model Agents in Adversarial N…
ContextGuard: Structured Self-Auditing for Context Learning in Language Models
PHALAR: Phasors for Learned Musical Audio Representations
EEG-FM-Audit: A Systematic Evaluation and Analysis Pipeline for EEG Foundation Models
Modernising Reinforcement Learning-Based Navigation for Embodied Semantic Scene Graph Gen…
Recon: Reconstruction-Guided Reasoning Synthesis for User Modeling
ReasonOps: A Unified Operational Paradigm for Trustworthy Verified LLM Reasoning
Less is More: Early Stopping Rollout for On-Policy Distillation
ReMoE: Boosting Expert Reuse through Router Fine-Tuning in Memory-Constrained MoE LLM Inf…
High-Quality Synthetic Financial Time-Series using a GAN-Diffusion Framework
Deep-layer limit and stability analysis of the basic forward-backward-splitting induced n…
Learning When to Think While Listening in Large Audio-Language Models
Assessing Per-Sample Membership Inference Vulnerability without Retraining
Beyond Fixed Benchmarks and Worst-Case Attacks: Dynamic Boundary Evaluation for Language …
AI Agent for Reverse-Engineering Legacy Finite-Difference Code and Translating to Devito
ScenePilot: Controllable Boundary-Driven Critical Scenario Generation for Autonomous Driv…
EHRSummarizer: A Privacy-Aware, FHIR-Native Reference Architecture for Source-Grounded EH…
ParsVoice: A Large-Scale Multi-Speaker Persian Speech Corpus for Text-to-Speech Synthesis
Identifiable Token Correspondence for World Models
ReVEL: Multi-Turn Reflective LLM-Guided Heuristic Evolution via Structured Performance Fe…
LR-SGS: Robust LiDAR-Reflectance-Guided Salient Gaussian Splatting for Self-Driving Scene…
The Two Boundaries: Why Behavioral AI Governance Fails Structurally
How Reliable are LLMs for Reasoning on the Re-ranking task?
Searching the Internet for Challenging Benchmarks at Scale
Exploiting Local Dynamics Regularity for Reusable Skills in Offline Hierarchical RL
TSFMAudit: Data Contamination Auditing in Forecasting Time Series Foundation Models
CogAdapt: Transferring Clinical ECG Foundation Models to Wearable Cognitive Load Assessme…