Calibration Without Comprehension: Diagnosing the Limits of Fine-Tuning LLMs for Vulnerab…
Explorar
Noticias de IA
30353 elementos — filtrados, clasificados y sin duplicados
Contagion Networks: Evaluator Bias Propagation in Multi-Agent LLM Systems
UltraQuant: 4-bit KV Caching for Context-Heavy Agents
Repurposing a Speech Classifier for Guided Diffusion-Based Speech Generation
LLM agent safety, multi-turn red-teaming, jailbreak benchmarks, adversarial robustness, s…
DataMagic: Transforming Tabular Data into Data Insight Video
CRAX: Fast Safe Reinforcement Learning Benchmarking
Robust $Q$-learning for mean-field control under Wasserstein uncertainty in common noise
ELVA: Exploring Ranking-Driven Universal Multimodal Retrieval
Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think
SPOT-E: Test-Time Entropy Shaping with Visual Spotlights for Frozen VLMs
Learner-based Concept Drift Detection: Analysis and Evaluation
Before the Pull Request: Mining Multi-Agent Coordination
HilDA: Hierarchical Distillation with Diffusion for Advancing Self-Supervised LiDAR Pre-t…
MedRLM: Recursive Multimodal Health Intelligence for Long-Context Clinical Reasoning, Sen…
From Texts to Scores: Tracing the Emergence of Essay Quality Representations in Large Lan…
RIVET: Robust Idempotent Voice Attribute Editing
Token Factory: Efficiently Integrating Diverse Signals into Large Recommendation Models
Hybrid ANN-SNN Pipeline with Local Plasticity
Frequency-Aware Flow Matching for Continuous and Consistent Robotic Action Generation
Sensorimotor World Models: Perception for Action via Inverse Dynamics
Evaluation of EEG Foundation Models for Event-Based Burst-Suppression Detection in ICU
IHUBERT: Vector-Based Semantic Deduplication and Domain-Balanced Pretraining for Persian …
The Hidden Evolution of Disguised Visual Context inside the VLM
See-and-Reach: Precise Vision-Language Navigation for UAVs within the Field of View
A Neuromorphic Reinforcement Learning Framework for Efficient Pathfinding in Robotic Mobi…
When Lower Privileges Suffice: Investigating Over-Privileged Tool Selection in LLM Agents
Hard or Just Unreached? Diagnosing the Sampling Blind Spot in Math-Reasoning Difficulty E…
StreamKL: Fast and Memory-Efficient KL Divergence for Boosting Attention Distillation
Tri-Info: Generalizable, Interpretable Failure Prediction for VLA Models via Information …