Dual Latent Memory for Visual Multi-agent System
Explorar
Noticias de IA
29372 elementos — filtrados, clasificados y sin duplicados
MHA-RAG: Improving Efficiency, Accuracy, and Consistency by Encoding Exemplars as Soft Pr…
Model Context Protocols in Adaptive Transport Systems: A Survey
Hierarchical Certified Semantic Commitment for Byzantine-Resilient LLM-Agent Collaboration
EVA: Evolving Semantic Adversaries for Red-Teaming GUI Agents Against Environmental Injec…
ChemQuests: A Curated Chemistry Question-Answer Database Extracted from ChemRxiv papers
DualGate-Net: A Prior-Gated Dual-Encoder Framework for Histopathology Cell Detection
UrduMMLU: A Massive Multitask Benchmark for Urdu Language Understanding
REMEDI: A Benchmark for Retention and Unlearning Evaluation in Multi-label Clinical Disea…
DIFFRACT: Neuralized Utility Maximization for Wireless Networks by Differentiable Program…
On the Geometry of On-Policy Distillation
Do Coding Agents Deceive Us? Detecting and Preventing Cheating via Capped Evaluation with…
Mitosis Detection in the Wild: Multi-Tumor and Context-Aware Generalization in the MIDOG …
SleepExplain: Explainable Non-Rapid Eye Movement and Rapid Eye Movement Sleep Stage Class…
PaperFlow: Profiling, Recommending, and Adapting Across Daily Paper Streams
CULTURESCORE: Evaluating Cultural Faithfulness in Video Generation Models
Acoustic Cue Alignment in Audio Language Models for Speech Emotion Recognition
Beyond Waypoints: A Trajectory-Centric Waypointing Paradigm for Vision-Language Navigation
The Fine-Tuning Trap: Evaluating Negative Transfer and the Role of PEFT in Sub-1B Mathema…
TEVI: Text-Conditioned Editing of Visual Representations via Sparse Autoencoders for Impr…
The Masked Advantage: Uncovering Local-Language Access to Cultural Knowledge in LLMs
SpectCount: Spectrotemporal Counting via Synthetic Signals Improves Large Audio Language …
Beyond Skeletons: Learning Animation Directly from Driving Videos with Same2X Training St…
FreeAnimate: Training-Free Human Image Animation with Preview-Guided Denoising
OGA-AID: Clinician-in-the-loop AI Report Drafting Assistant for Multimodal Observational …
Think Like a Pilot: Fine-Grained Long-Horizon UAV Navigation
Modality Gap-Driven Subspace Alignment Training Paradigm For Multimodal Large Language Mo…
Progress-SQL: Improving Reinforcement Learning for Text-to-SQL via Progressive Rewards
SV-Detect: AI-generated Text Detection with Steering Vectors
SCALE: Scalable Cross-Attention Learning with Extrapolation for Agentic Workflow Scheduli…