Distilling Drifting Transformers with Representation Autoencoders
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
EcoBin: A Two-Stage Deep Convolutional Neural Network for Contamination-Aware Waste Class…
AP-GRPO: Anchor-Gated Phonetic Alignment with Policy Optimization for Pathological Speech…
Privacy-Preserving Text Sanitization for Distributed Agents Collaboration via Disentangle…
AQ4SViT: An Automated Quantization Framework with Search Gating Policy for Compressing Sp…
Mutual Distillation of Dual-Foundation Models for Semi-Supervised PET/CT Segmentation
Exploring Starts Are Not Enough: Counterexamples and a Fix for Monte Carlo Exploring Star…
Spokes: Optimizing for Diverse Pretraining Data Selection
Controlled Dynamics Attractor Transformer
Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models
AI Contagion in Social Networks
Closing the Auto-Research Loop: An AI Co-Scientist for Production Search Ranking
A Learning Method with Gap-Aware Generation for Heterogeneous DAG Scheduling
Mitigating Object Hallucinations in LVLMs via Attention Imbalance Rectification
HoloRec: Holistic Encoding and Interleaved Reasoning for Generative Recommendation
Evidence of an Emergent "Self" in Continual Robot Learning
Epileptic Seizure Detection in Separate Frequency Bands Using Feature Analysis and Graph …
Towards End-to-End Automation of AI Research
Who Drifted: the System or the Judge? Anytime-Valid Attribution in LLM Evaluation Pipelin…
Hierarchical Modeling of ICD Codes in EHR Foundation Models
S1-DeepResearch: Beyond Search, Toward Real-World Long-Horizon Research Agents
ChatPlanner: A Large Language Model Framework for Personalized Public Transit Routing
Forced Deferral: Manipulating Routing Decisions in Multimodal LLM Cascades
CODA-BENCH: Can Code Agents Handle Data-Intensive Tasks?
StarOR: Synergizing Tree Search and Test-Time Reinforcement Learning for Optimization Mod…
FreeSonic: Training-Free Temporal-Aware Decoupled Attention for Precise Audio Editing
FastMix: Fast Data Mixture Optimization via Gradient Descent
Beyond Correctness: Enhancing Architectural Reasoning in Code LLMs via Scalable Labeling …
Policy Regret for Embedding Model Routing: Contextual Bandits with Low-Rank Experts
An Empirical Study on Learning Latent Representations for Emotional Speech Synthesis