Hide-and-Seek in Trajectories: Discovering Failure Signals for VLA Runtime Monitoring
Explorar
Noticias de IA
30288 elementos — filtrados, clasificados y sin duplicados
PRISM: Self-Pruning Intrinsic Selection Method for Training-Free Multimodal Data Selection
SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes
Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inp…
PatchWorld: Gradient-Free Optimization of Executable World Models
Reward Learning from Best-of-$N$ Preference Data: Targets, Tradeoffs, and Design Principl…
De-attribute to Forget for LLM Unlearning
Reading Between the Citations: A Typed Claim Network for Scientific Literature
VLM3: Vision Language Models Are Native 3D Learners
AnchorSteer: Self-Discovered Concept Injection for Structure-Preserving Music Editing
Variational Adapter for Cross-modal Similarity Representation
Does Visual Information Play a Decisive Role in Vision-Language-Action Model Driving Beha…
Memory-Bound but Not Bandwidth-Limited: The Physical AI Inference Gap in Batch-1 LLM Deco…
On Revisiting Entropy for Identifying Mislabeled Images
SpecDB: LLM-Generated Customized Databases via Feature-Oriented Decomposition
Design and Evaluation of Multi-Agent AI Oracle Systems for Prediction Market Resolution
Chatterbox-Flash: Prior-Calibrated Block Diffusion for Streaming Zero-Shot TTS
Linear Ordering Problem: Time for a Change
Prior Availability in Industrial Visual Sim-to-Real: A Review of CAD-Guided and CAD-Unava…
From Evidence to Design: Developing an AI-Augmented UX Research Point of View for Digital…
Developing a UXR Point of View for Cognitive Accessibility in Mobile Learning with Genera…
D$^3$: Dynamic Directional Graph-Constrained Data Scheduling for LLM Training
Robust Lightweight Crack Classification for Real-Time UAV Bridge Inspection
Symmetry Reveals Layerwise Dynamics: How Transformers Perform In-Context Classification
Steering LLMs? Actually, Sparse Autoencoders can outperform simple baselines
Comparing LLM-Based Conversational and Graphical Interfaces for Industrial Decision Tasks…
EchoRL: Reinforcement Learning via Rollout Echoing
Beyond Classification: Dynamic Adapter Routing for Continual Multimodal Retrieval
ImmigrationQA: A Source-Grounded Dataset and Small-Model Adaptation for U.S. Immigration …
FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection