RVN-Bench: A Benchmark for Reactive Visual Navigation
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
VehAnchor: Metadata-Free Metric Scale Recovery from Vehicle Cues in Aerial Imagery
Context-Dependent Affordance Computation in Vision-Language Models
Quantum Circuit Vision: Cost-Aware Evaluation of Visual AI Agents for Quantum Code Genera…
MUGEN: Evaluating and Improving Multi-audio Understanding of Large Audio-Language Models
Towards Robust Speech Deepfake Detection via Human-Inspired Reasoning
Evolutionarily Stable Stackelberg Equilibrium
Beyond Bayesian Nash: Learning Minimax-Regret Equilibria for Adversarial Team Games under…
A Production-Oriented Framework for Evaluation of SFX Generation
Workload-Driven Optimization for On-Device Real-Time Subtitle Translation
A Knowledge-Based Multi-Agent Framework for Security Control Recommendation
Critical Damping as a Momentum Schedule: Multi-Seed Validation, a Hybrid Recipe, and an E…
StanceMoE: Mixture-of-Experts Architecture for Stance Detection
How Annotation Trains Annotators: Competence Development in Social Influence Recognition
SMETA-ZSL:Semantic Meta-Alignment for Zero-Shot Threat Classification
Faithful by Design: Evaluating and Improving LLM-Generated Clinical Trial Summaries for M…
Pickalo: Leveraging 6D Pose Estimation for Low-Cost Industrial Bin Picking
MG$^2$-RAG: Multi-Granularity Graph for Multimodal Retrieval-Augmented Generation
Tool-MCoT: Tool Augmented Multimodal Chain-of-Thought for Content Safety Moderation
Private Seeds, Public LLMs: Realistic and Privacy-Preserving Synthetic Data Generation
SegWithU: Uncertainty as Perturbation Energy for Single-Forward-Pass Risk-Aware Medical I…
Learning in Blocks: A Multi Agent Debate Assisted Personalized Adaptive Learning Framewor…
PivotMerge: Bridging Heterogeneous Multimodal Pre-training via Post-Alignment Model Mergi…
Next-Dense-Stride Prediction for Multimodal Autoregressive Visual Modeling
Remembering Distinct Items, Not Tokens: A Learnable Dirichlet-Process Cache Between State…
Toward a Scientific Discovery Engine for Weather and Climate Data: A Visual Analytics Wor…
IntentVLA: Short-Horizon Intent Modeling for Aliased Robot Manipulation
Prompting-MammAlps: Fine-Grained Text-to-Video Retrieval for Camera-Trap Data
Towards Objective Dysgraphia Detection: A Multi-Branch Deep Learning Approach for Online …
More Structure, Not More Capacity: Object-Centric Representations for Visuomotor Imitatio…