The Seriality Gap in Video Diffusion Models
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
A Shortcut to Statistically Steady-State Turbulence with Flow Matching
FlowWAM: Optical Flow as a Unified Action Representation for World Action Models
Audio-Native Speech Recognition with a Frozen Discrete-Diffusion Language Model
DermDepth: Toward Monocular Metric Scale 3D Reconstruction Models for Dermatology
Controllable Generation of Diverse Dermatological Imagery for Fair and Efficient Malignan…
Resist and Update: Counterfactual Report Coordinates for Incentive-Compatible LLMs
Ensemble Controlled-Flow Filtering for Implicit Data Assimilation
The Illusion of Robustness: Aggregate Accuracy Hides Prediction Flips under Task-Irreleva…
Robustness of Deep Learning Models for PV Power Forecasting under NWP Forecast Errors: A …
Exact and Calibrated Diffusion Reconstruction for Digital Breast Tomosynthesis
LatentFlow: A General Framework for Conditioning Stochastic Processes
Contrastive-Collapsed Loss for Flexible and Geometrically Optimal Embeddings and Faster C…
Rank-1 Identity Consensus Predicts Gallery Enrollment in 1:N Face Matching More Accuratel…
Accelerated Mixing Time of Randomized Hamiltonian Monte Carlo
Energy-Based Physics-Informed Form Finding for Clustered Tensegrity Structures
Statistical Non-linear Reconstruction Loss for Image Anomaly Detection
Toward Localizing and Repairing Bias in Transformer Attention Heads
Unveiling Complex Collective Behaviors from Simple Rewards
ChartGenEval: Corruption-Tested Multi-Dimensional Feedback for Rhythm-Game Chart Generati…
Can LLMs Write Reliable Rubrics? A Meta-Evaluation for Experiment Reproduction
Solution of the Hempel's statistical ambiguity problem and Causal AI
Visual Access Boundaries in Vision-Language Model Reasoning
Autonomous Tracking and Terminal Guidance of Moving Targets for Fixed-Wing UAVs
UniVR: Thinking in Visual Space for Unified Visual Reasoning
The One-Word Census: Answer-Choice Conformity Across 44 Language Models
Who Grades the Grader? Co-Evolving Evaluation Metrics and Skills for Self-Improving LLM A…
Do We Really Need Multimodal Emotion Language Models Larger Than 1B Parameters?
CoRe: A Comprehensive Framework for Cross-Image Comparative Reasoning in Vision-Language …
Directional Constraints for Efficient Exploration in Safe Reinforcement Learning