Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
Explorar
Noticias de IA
29627 elementos — filtrados, clasificados y sin duplicados
Beyond Visual Fidelity: Benchmarking Super-Resolution Models for Large-Scale Remote Sensi…
Genie 4D: Semantic-Prior-Guided 4D Dynamic Scene Reconstruction
Incentives, Equilibria, and the Limits of Healthcare AI: A Game-Theoretic Perspective
Automated Conjecture Resolution with Formal Verification
Multi-Modal Learning meets Genetic Programming: Analyzing Alignment in Latent Space Optim…
Escaping the BLEU Trap: A Signal-Grounded Framework with Decoupled Semantic Guidance for …
ExpertGen: Scalable Sim-to-Real Expert Policy Learning from Imperfect Behavior Priors
Learning Discriminative and Generalizable Anomaly Detector for Dynamic Graph with Limited…
Scaling Search Relevance: Augmenting App Store Ranking with LLM-Generated Judgments
You Don't Need All That Attention: Surgical Memorization Mitigation in Text-to-Image Diff…
SWE-MiniSandbox: Container-Free Reinforcement Learning for Building Software Engineering …
DenseMLLM: Standard Multimodal LLMs for Dense Prediction
Are LLMs Ready for Neural-integrated Mechanistic Modeling? A Benchmark and Agentic Framew…
When and How Much to Imagine: Adaptive Test-Time Scaling with World Models for Visual Spa…
Predicting Future Utility: Global Combinatorial Optimization for Task-Agnostic KV Cache E…
Rethinking Scientific Modeling: Toward Physically Consistent and Simulation-Executable Pr…
Better Source, Better Flow: Learning Condition-Dependent Source Distribution for Flow Mat…
Global Geometry Is Not Enough for Vision Representations
Med-Scout: Curing MLLMs' Geometric Blindness in Medical Perception via Geometry-Aware RL …
Physics-Encoded Inverse Modeling for Arctic Snow Depth Prediction
Prototypicality Bias Reveals Blindspots in Multimodal Evaluation Metrics
Paradoxical noise preference in RNNs
Dynamic Entropy Tuning in Reinforcement Learning Low-Level Quadcopter Control: Stochastic…
Calibrating Uncertainty for Zero-Shot Adversarial CLIP
VocSim: A Training-free Benchmark for Zero-shot Content Identity in Single-source Audio
ShelfAware: Real-Time Semantic Localization in Quasi-Static Environments with Low-Cost Se…
Latent Reasoning in TRMs is Secretly a Policy Improvement Operator
Optimal Bayesian Stopping for Efficient Inference of Consistent LLM Answers
CARES: Context-Aware Resolution Selector for VLMs