Robustness of Robotic Manipulation: Foundations and Frontiers
Explorar
Noticias de IA
22318 elementos — filtrados, clasificados y sin duplicados
Team MKC at CLPsych 2026: Capturing and Characterizing Mental Health Changes through Soci…
UniTac: A Unified Multimodal Model for Cross-Sensor Tactile Understanding and Generation
Temporal Preservation over Processing: Diagnosing and Designing Spatiotemporal Single-Sta…
Visual Semantic Entropy: Do Vision Language Models Recognize Visual Ambiguity?
Resolving superposition in AI for interpretability and cross-modal alignment in patient-n…
Stage-Transition Dense Reward Modeling for Reinforcement Learning
From Materials Database to Materials Bank: Assetizing Data for AI Driven Materials Innova…
PGUDA: Pressure-Guided Unsupervised Domain Adaptation with Cross-Modal Knowledge Distilla…
3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models t…
From Idea to Prototype in an Afternoon: Scaffolded, AI-Assisted Rapid VA Prototyping
Minimizing Quantized Semantic Age of Information (QSAoI) in Foundation Model-Based Semant…
Learning from Failure: Inference-Time Self-Improvement for Computer-Use Agents
TDGT: A Tabular Data Generation Toolkit supporting adaptive GPU-accelerated Bayesian mixt…
Probing Stylistic Appropriation using Large Language Models: An Evaluation Framework for …
Information-Aided DVL Calibration
Distilling Temporal Coherence into 2D Networks for Transrectal Ultrasound Prostate Video …
Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Esti…
AETDICE: Unified Framework and Offline Optimization for Nonlinear Multi-Objective RL
ComplianceGate: Classifier-Gated Multi-Tier LLM Routing for Inference in Regulated Indust…
PPT-Eval: A Benchmark for Computer-Use Agents on PowerPoint Tasks
PruneGround: Plug-and-play Spatial Pruning for 3D Visual Grounding
UniSAE: Unified Speech Attribute Editing on Speaker, Emotion and Low-Level Content via Di…
SkillSpotter: Pose-Aware Multi-View Skilled Action Detection and Grading in Ego-Exo Videos
What Probing Reveals about Autonomous Driving: Linking Internal Prediction Errors to Ego …
Beyond But-for Test: Counterfactual Explanation in Abstract Argumentation via Actual Caus…
Triospect: A Three-Dimensional Framework for Robust Statistical AI-Generated Text Detecti…
Learning Video Dynamics with Predictive Differentiable Rendering
Knowledge Distillation from Large Reasoning Models to Compact Student Models: A Case Stud…
OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models