Toward Scalable Audio Description Quality Control: A Workflow for Evaluating Human and VL…
Explorar
Noticias de IA
37834 elementos — filtrados, clasificados y sin duplicados
Equivariant Sheaf Neural Networks: Learning Geometric Transport on Graphs
Locked at the Entrance, Open Inside: Where RLVR Narrows the Solution Space
CoFiRec: Coarse-to-Fine Tokenization for Generative Recommendation
FigMirror: Ground It, Code It, Plot It
Error-Driven Scene Editing for 3D Grounding in Large Language Models
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
The Halt Vector: Internalizing a Causal Steering Intervention for Efficient Reasoning
A Large-scale Evaluation of Text-guided Models for Facial Editing
TAAL: Mitigating Early Beam Pruning in Generative Recommendation via Temporal Autoregress…
Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-R…
Defending Wearable VLMs Against Private Attribute Inference
RoboPhys-3D: A Comprehensive Embodied World Model Evaluation via 3D Reconstruction
Personalized Treatment Outcome Prediction from Scarce Data via Dual-Channel Knowledge Dis…
Variable-Length Audio Fingerprinting
M2K: Making the Model-Kernel Interface Explicit for Reliable CUDA Kernel Verification
ASTRA - Agentic System for Ticket Resolution and Analysis
Toward Generalizable Deep Learning Based Peatland Fire Detection via Walsh Hadamard Trans…
Measuring Similarity between Artistic and AI Generated Images using Siamese Neural Networ…
MIND: Unified Inquiry and Diagnosis RL with Criteria Grounded Clinical Supports for Psych…
ORDDAR: Observation-Driven Reasoning for Distortion-Resilient Decision, Action, and Cogni…
Test-Time Scaling for Scientific Equation Discovery
Can Large Language Models Identify Meaningful Touchpoints in Conversion Attribution?
PermitGPT: A Unified Generative-AI Pipeline for Construction Hazard Forecasting, Permit P…
Beyond Static Visual Tokens: Structured Sequential Visual Chain-of-Thought Reasoning
PromptKWS: A Novel Prompt-Guided Open-Vocabulary Keyword Spotting Framework
Triggering Chain-of-Thought via Latent Feature Interventions in Large Language Models
AgenTRIM: Tool Risk Mitigation for Agentic AI
SUB-PLAY: Adversarial Policies against Partially Observed Multi-Agent Reinforcement Learn…
Do Language Models Reason Across Languages?