Reward-Gated On-Policy Distillation
Explorar
Noticias de IA
30934 elementos — filtrados, clasificados y sin duplicados
Foundations of Equivariant Deep Learning: Unifying Graph and Sheaf Neural Networks
CineMobile: On-Device Image-to-Video Diffusion for Cinematic Camera Motion Generation
CGGS: Consistency-Augmented Geometric Gaussian Splatting for Ego-centric 3D Scene Generat…
DualView: Preventing Indirect Prompt Injection in Personal AI Agents
Q-TriM: Question-Guided Tri-Modal Attention for Audio-Visual Question Answering
How Do Diffusion Classifiers Decide? A Bias-Centric Evaluation
When Simpler Is Better: Evaluating Translation Pipelines for Medieval Latin Manuscripts
High-Fidelity One-Step Generative Visuomotor Policy via Recursive Correction, Frequency C…
GeoSelect: Spatial-Program Execution for Training-Free Referring Remote Sensing Image Seg…
Consistent but Miscalibrated: Evaluating LLM Limitations for Risk Communication in Natura…
Fine-Grained Computation Offload for Off-the-Shelf Servers in Tens of Lines
Advanced Topic Modeling Techniques for Categorizing Software Vulnerabilities
Why3-py: A Tool for Formal Verification of Hypothesis Testing and Meta-Analysis in Python
The Remarkable Effectiveness of Providing AI Agents with Natural Language Tools: A Replic…
TokAN: Accent Normalization Using Self-Supervised Speech Tokens
Probe, Don't Prompt: A Hidden-State Probe for Metadata Filtering in Multi-Meta-RAG
Worldscape-MoE: A Unified Mixture-of-Experts World Model for Scalable Heterogeneous Actio…
Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Age…
Order-based Causal Discovery for Multistage Processes
BanglaMemeEvidence: A Multimodal Benchmark Dataset for Explanatory Evidence Detection in …
NouveauVoice: Generating Novel Pseudo Speakers for Voice Anonymization
Full Glyph Images Beat Token Embeddings: A Controlled Study for Transformers
Separating Representation from Reconstruction Enables Scalable Text Encoders
Finite Reliability Representations: Noise-Calibrated Belief-Space Covers for Reliable Dec…
A Unified Algebraic Framework for Classification Performance Evaluation
OmniOpt: Taxonomy, Geometry, and Benchmarking of Modern Optimizers
The "I Don't Know" Filter: Enhancing Agentic Reliability in Function Calling
Telescope: Improving Zero Shot Detection of LLM Generated Content By Measuring Token Repe…
Enhancing Implicit Neural Representations with Image Feature Embedding for Unsupervised C…