Structured but Fragile: On the Limits of LLMs in Cybersecurity Decision-Making
Explorar
Noticias de IA
27413 elementos — filtrados, clasificados y sin duplicados
WA-JEPA: Rethinking the Video JEPA Paradigm for World-Action Modeling in Autonomous Drivi…
Quantization-Aware Healing: A Practical Recipe for Recovering Compressed, 4-Bit LLMs
Neural-Primitive: An Efficient End-to-end Local Planner with Primitive-based Imitation Le…
BC-Bench: Evaluating Agentic Engineering in a Domain-Specific Language for ERP
SEISMO: Explanation-Aware, Trajectory-Conditioned LLM Agents for Sample-Efficient Molecul…
Categorical AI phenomenology: A first-person approach
Making Deployments Safe at Meta: Health Checks for Continuous Change-Safety
PSK at WMT 2026 MIST: Task-Specialized QLoRA Adapters for Multilingual Summarization and …
Do SpeechLMs Hear Their Own Opinions? Diagnosing and Mitigating Previous-Belief Contamina…
Identity-Aware Human-Object Interaction Motion Captioning
CertVLA: Certified Defense against Physical Visual Attacks for Vision-Language-Action Mod…
CARD: Diagnosing Belief to Action Routing Failures in Vision Language Models
RiskTraf: Risk-Extrapolated Residual Learning for Multi-Variate Traffic Flow Prediction
Temporal Validity on Real Software Histories: Eliminating Stale-Fact Errors in Code-Assis…
When Generated Images Look Right and Retrieve Wrong: Coverage-Guided Cross-Scale Re-Index…
STAR-OPD: Structured Aspect-Cascade-Aware On-Policy Reward Distillation for ABSA Quadrupl…
Provable Edge-of-Stability for Adam on a One-Dimensional Quadratic
C-Score: Beyond Accuracy for Robustness Assessment in Semi-Supervised Learning under Open…
Explainable Deepfake Detection with Feature-robust Augmentation and Evidence-grounded Exp…
Denoising the Future: Context-Aware Spectral Diffusion for Temporal Knowledge Graph Extra…
Advantage-level Aggregation Reinforcement Learning for X-point Target Magnetic Configurat…
When Failures Propagate: Causal Failure Attribution in Agentic Retrieval-Augmented Genera…
AgentMercury: Your Agent Can Synthesize Verifiable Environments for Business Scenarios at…
JuryProbe: An Empirical Consensus-Risk Diagnostic for Routing Reference-Free Factuality J…
Beyond End-to-End Success: Diagnosing Failures in Long-Horizon Security LLM Agents
Consistency Models for Fast MRI Reconstruction Using Regularization by Denoising
Testing and Evaluation of Agentic AI Systems In Military Command and Control
Peer-Voted LLM-Agent Stress Tests Find Feed-Induced Lexical Convergence but No Reliable M…
Towards Traffic Modelling of Multi-Agent Systems: The Role of Coordination Topology