SkillsMetric: Mapping the Detection Boundary of Static Analysis for Malicious Agent Skills
Explorar
Noticias de IA
21270 elementos — filtrados, clasificados y sin duplicados
MasDrift: Benchmarking Authorization Preservation Across Multi-Agent Architectures
FSTC-Encoder: Feature--Spatial--Temporal Correlation Learning for Generalizable RF Sensing
Abstracted Away: Resisting Alienation and Ungrounded Abstraction in AI Research Communiti…
Calling the Bluff: Detecting Ever-Shifting Harmful Chat Dialogue via Ordered Reasoning Ch…
PRISM: A Predictive Protocol for Permutation Optimization via Landscape Diagnostics
Imaginative Generative AI: Crossing the Entropy Wall into Worlds Beyond Imitation
Entropy-based Code Adversarial Translation for Real-world Repository Migration
Beyond "I Can't Help With That": How Child Safety Experts Evaluate AI Chatbot Safety
Frequency-Domain Dual-Branch Fusion for Medical Visual Question Answering
Do Evaluation Metrics Detect Errors in Classical Chinese to English Translations?
EMMR: Emotion-Mediated Multimodal Reasoning for Personality Assessment in Asynchronous Vi…
Open-World Semantic Segmentation with Sensitivity Modeling
Privacy-Preserving Data Drift Detection and Recovery for Large-Scale LLM Applications via…
How sensitive do we want AI to be? Socio-communicative competencies of large language mod…
MOSAIC: Adversarial Co-evolution of Specialist Heuristics and Problem Instances for LLM-b…
Reproducing and Stress-Testing Two Approaches to LLM Reasoning Reliability: Test-Time Pro…
Adaptive Sequential Test Planning for Multi-Mechanism Reliability Qualification via Bayes…
CDGC-Net: 3D Medical Image Segmentation with Cooperative Dual-Scale Self-Attention and Gr…
FreSH: Frequency-Segmented Hierarchical Multi-Expert Framework for Multivariate Time Seri…
VTO: Visual Tool Orchestration for Video Anomaly Detection
Walking through Discussions: A Mobile Visual Analytics System for In-Situ Group Discussio…
Generalizing deep reinforcement learning across cable-driven parallel robot configuration…
COMEX: A Composition-Grounded Benchmark and Learning Framework for Explainable Aesthetic …
From Relevance to Execution Utility: Reward-Aware Dynamic Execution Gating for Skill-Base…
Can LLM Agents Stick to the Script? A Benchmark for Long-Horizon Consistency in Interacti…
$\texttt{DisMorph}$: learning to disentangle technical distortions from true biological c…
From Sweep to Seam: Interleaved Cross-Block Post-Training Quantization
Bridging the Evaluation Gap: Standardized Benchmarks for Multi-Objective Search
Hierarchical Multi-Task Federated Learning in VANETs