Speech Meets ELF: Audio Conditional Continuous-Target Diffusion for Speech Recognition an…
Explorar
Noticias de IA
22116 elementos — filtrados, clasificados y sin duplicados
Beyond Single-Model Optimization: Preserving Plasticity in Continual Reinforcement Learni…
Importance-Aware Scheduling for High-Dimensional Hyperparameter Optimization
GCA Framework: A GCC Countries-Grounded Dataset and Agentic Pipeline for Climate Decision…
Beyond Uniform Token-Level Trust Region in LLM Reinforcement Learning
People-Centred Medical Image Analysis via Fairness-Aware Human-AI Cooperation
Communication Dynamics Neural Networks: FFT-Diagonalized Layers for Improved Hessian Cond…
RAG over Thinking Traces Can Improve Reasoning Tasks
Bittensor Agent Arenas as a Trajectory Primitive: Distilling a Shopping Agent from Shoppi…
DeRA-MOS: Optimizing Text-to-Music Evaluation via Decoupled Listwise Ranking and Modality…
Optimality of FSQ Tokens for Continuous Diffusion for Categorical Data with Application t…
3SPO: State-Score-Supervised Policy Optimization for LLM Agents
Event-Driven Reinforcement Learning Enables Long-Horizon Control in Semiconductor Fabrica…
LLM-Guided Neural Architecture Search for Robust Co-Design of Physical Neural Networks
Divide and Cooperate: Role-Decomposed Multi-Agent LLM Training with Cross-Agent Learning …
Conformal Prediction for Neural Operators: Distribution-Free Uncertainty Quantification i…
K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling
Earth-OneVision: Extending Remote Sensing Multimodal Large Language Models to More Sensor…
Beyond APIs: Probing the Limits of MLLMs in Physical Tool Use
Boosting ECG Classification Performance by Pre-training with Synthesized Data
In Defense of Information Leakage in Concept-based Models
Non-Parametric Structural Priors for Geometry Theorem Prediction
IDP-Bench: Benchmarking ability of LLMs to protect personal information in interdependent…
The Whale That Outswam Evolution: Swarm Intelligence Maximises Memory in Connectome Reser…
Dropout-GRPO: Variational Stochasticity for Continuous Latent Reasoning
Less Context, More Accuracy: A Bi-Temporal Memory Engine for LLM Agents Where a Lean Retr…
From Data Heterogeneity to Convergence: A Data-Centric Review of Federated Learning
When Attribution Patching Lies: Diagnosis and a Second-Order Correction
Deployment-Time Memorization in Foundation-Model Agents
Representation Curriculum: Stagewise Training for Robust Ranking and Allocation