DAVE: A Decoupled Audio-Visual Enhancement Framework for Real-World Speech Separation
Explorar
Noticias de IA
21227 elementos — filtrados, clasificados y sin duplicados
Test-Time Augmentation for LLMs: When Input Diversity Beats Output Diversity at Matched C…
Evaluating Generative Time-Series Models on Data with Point Masses
PolicyKG: An Agentic LLM Pipeline for Translating Institutional Policies into SHACL Knowl…
Predictive safety filter enhanced curriculum learning control for efficient vehicle dynam…
How Do Large Language Models Judge Social Attraction? Evidence from Theory-Grounded Perso…
A Rigorous Turing Test: a Foundation for Evaluating Artificial General Intelligence
ELBench: A Multi-Dimensional Benchmark for Education-Facing Large Language Models
Integrated Multimodal AI System for Retrieval-Augmented Reasoning, Object Sensing, and Da…
Illusion or Integrity? Geometrical Consistency Metric for AIGC Video Quality Evaluation
Confusion-Geometry Rebalancing for Long-Tailed Adversarial Training
Not an A11y: How Android Accessibility Exposes Mobile AI Agents to Indirect Prompt Inject…
Measuring the Wrong Thing: Internal Harmfulness Scores Anti-Rank Successful Jailbreaks
The Collaboration Gap: Exploration and Benchmarking of Open-World Agentic Cooperation
WorldSimProbe: Diagnosing Simulator Faithfulness in Action-Conditioned World Models for E…
Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs
From Semantic Grounding to Decision Optimization: A Unified Framework for Long-Horizon UA…
LLM Reasoning for Subjective Tasks: Failure Modes, Mitigation, and Dynamic Reasoning Rout…
Towards Realistic Guarantees: A Probabilistic Certificate for SmoothLLM
TCS-BENCH: Benchmarking State-of-the-Art Generative AI Theoretical Computer Science Resea…
TSPORec: Token Selection via Preference Optimization for LLM-Based Sequential Recommendat…
Structure-Enhanced Features and Quality-Aware Dynamic Anchor Scoring for Robust Lane Dete…
DUET: A Diversity-Quality Duet of Distillation Experts for Two-Step Video Generation
LF${}^{2}$AR: Accounting for Layerwise Dynamics to Improve Multimodal Adaptation of Langu…
Adversarial Latent-State Training for Robust Policies in Partially Observable Domains
Can Coding Agents Solve Repository-Level Issues with Rendered Code? An Exploratory Study …
Multimodal Federated Learning under Dual-Axis Modality Missingness
GRASP: Granularity-Aware Region Alignment and Semantic Prototype Learning for Fine-Graine…
Privileged Solutions or Context-Induced Teacher Behavior? Dissecting On-Policy Self-Disti…
GLocFM: A Geometry-Aware Foundation Model for 3D Indoor Wireless Localization