Deferred Audio Pruning with Local Audio-Visual Dynamics for Omni-LLMs
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
ZetaGPT: A Reference Implementation of Positional--Encoding--Free State--Space--Attention…
Multimodal Model Diffing for Feature Discovery and Control
Carnot: Interpretable, Interactive, and Optimized Execution of Deep Research Queries
TCS-BENCH: Benchmarking State-of-the-Art Generative AI Theoretical Computer Science Resea…
Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs
From Semantic Grounding to Decision Optimization: A Unified Framework for Long-Horizon UA…
Illusion or Integrity? Geometrical Consistency Metric for AIGC Video Quality Evaluation
Measuring the Wrong Thing: Internal Harmfulness Scores Anti-Rank Successful Jailbreaks
Communication-efficient distributed hazard difference estimation for heterogeneous multi-…
DUET: A Diversity-Quality Duet of Distillation Experts for Two-Step Video Generation
Predictive safety filter enhanced curriculum learning control for efficient vehicle dynam…
Evaluating Generative Time-Series Models on Data with Point Masses
How Do Large Language Models Judge Social Attraction? Evidence from Theory-Grounded Perso…
ColluSkill: Adversarial Cross-Skill Composition for Evading Agent Skill Scanners
Sign Language Recognition Using Original and Synthetic Depth Image Based Point Cloud Data…
Flow-by-Flow:Content-Judgment Bypass for Governing AI Output in High-Loss Domains
Automating Deception: Scalable Multi-Turn LLM Jailbreaks
In-context superposition: human-like working memory interference in large language models
Autorubric: A Unifying Framework for Rubric-Based LLM Evaluation on Non-Verifiable Tasks
Interpreting Video Representations with Spatio-Temporal Sparse Autoencoders
FoMoH: A clinically meaningful foundation model evaluation for structured electronic heal…
Beyond Pixels: Benchmarking and Reward-Based Assessing Framework for Visual Spatial Aesth…
PolypSteer: Counterfactual Endoscopic Synthesis via Training-Free Activation Steering
Adversarial Latent-State Training for Robust Policies in Partially Observable Domains
X2C: A Dataset Featuring Nuanced Facial Expressions for Realistic Humanoid Imitation
SuperCoder: Assembly Program Superoptimization with Large Language Models
Shattered Compositionality: Counterintuitive Learning Dynamics of Transformers for Arithm…
Attn-QAT: 4-Bit Attention With Quantization-Aware Training
SMAC: Score-Matched Actor-Critics for Robust Offline-to-Online Transfer