Prefilling-dLLM: Predictive Prefilling for Long-Context Inference in Diffusion Language M…
Explorar
Noticias de IA
22115 elementos — filtrados, clasificados y sin duplicados
Cross-Modal Knowledge Distillation without Paired Data: Theoretical Foundation and Algori…
3D-CoS: A New 3D Reconstruction Paradigm Based on VLM Code Synthesis
Geometric Coastline Localization using Vision-Language Models
[AINews] FrontierCode: Benchmarking for Code Quality over Slop
SpenseGPT: Practical One-shot Pruning Enabling Sparse and Dense GEMMs for LLM Inference
Vision-Assisted Foundation Model for Solving Multi-Task Vehicle Routing Problems
FOGO: Forgetting-aware Orthogonalization Optimizer
STAGE-Claw: Automated State-based Agent Benchmarking for Realistic Scenarios
Evaluating AI Investment Strategies
RadOT-Eval: Auditable Structured-Evidence Transport for Radiology Report Evaluation
APEX4: Efficient Pure W4A4 LLM Inference via Intra-SM Compute Rebalancing
Deep Active Re-Labeling: Toward Noise-Resilient Annotation Efficiency
Lost in the Flow with Code Talkers: Unveiling the Instruction-Tuning Tax of Large Languag…
BioVid: Autoregressive Video Generation with Biological Behavior Semantic Comprehension
Latent Diffusion Policy: Shaping Latent Spaces for Diffusion-Based Robotic Manipulation
FiberTune: Preserving Action-Fiber Visual Residuals in Vision-Language-Action Fine-Tuning
Reinforcement Learning for Flow-Matching Policies with Density Transport
Auditable Graph-Guided Root Cause Analysis for Kubernetes Incidents
Calibration of Structured Ignorance Certificates for Diagnosing Unknown Unknowns in Reaso…
EinSort: Sorting is All We Need for Tensorizing LLM
When Video Misreads: Closed-Loop Distillation of Reading Heuristics for Exploratory Manip…
ActProbe: Action-Space Probe for Early Failure Detection of Generative Robot Policies
STELLAR: Spatio-Temporal Environmental Learning with Latent Alignment and Refinement for …
PIPE-Cypher: Automatic Enterprise Benchmark Generation for Text-to-Cypher Systems
Adaptive Loss Balancing for Noise-Robust GRPO in Generative Recommendation
FlashCP: Load-Balanced Communication-Efficient Context Parallelism for LLM Training
A retrieval conditioned rebinding circuit for dynamic entity tracking in large language m…
Sycophancy as a Multilingual Alignment Failure: How Safety Degrades Across Languages, Top…
Sparrow: Sparse Rollout for Stable and Efficient Long-context RL of Large Language Models