Ukraine's one-time test used fully autonomous drones to kill Russian soldiers
Explorar
Noticias de IA
1057 elementos — filtrados, clasificados y sin duplicados
Google sues alleged Chinese cybercrime operation that used AI to send scam texts
Google sues Chinese cybercrime network that used Gemini to automate scams
Google sues Chinese scammers using Gemini AI for fraud
Scammers Used Gemini AI to Help Build Spam Messages, Google Says
AI agent bankrupted their operator while trying to scan DN42
PI-Hunter: Automated Red-Teaming for Exposing and Localizing Prompt Injections
SMSR: Certified Defence Against Runtime Memory Poisoning in Persistent LLM Agent Systems
SAIGuard: Communication-State Simulation for Proactive Defense of LLM Multi-Agent Systems
Reframing AI Loss of Control: What It Is, How to Have It, How to Lose It
The Containment Gap: How Deployed Agentic AI Frameworks Fail Public-Facing Safety Require…
Unsafer in Many Turns: Benchmarking and Defending Multi-Turn Safety Risks in Tool-Using A…
MAStrike: Shapley-Guided Collusive Red-Teaming on Multi-Agent Systems
PolicyGuard: Towards Test-time and Step-level Adversary Defense for Reinforcement Learnin…
The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI S…
Who Pays the Price? Stakeholder-Centric Prompt Injection Benchmarking for Real-world Web …
A Survey on Long-Term Memory Security in LLM Agents: Attacks, Defenses, and Governance Ac…
Efficient, Robust, and Anti-Collusion Fingerprinting of Image Diffusion Models
FENCE: A Financial and Multimodal Jailbreak Detection Dataset
ChatGPT Pushed Back on LA Fire Suspect’s Vision of Burning City
Grok Is Still Hosting Sexualized Deepfakes of Famous Women
Former xAI Staffer Says He Was Fired for Questioning Grok Safety
OpenAI says fake accounts from China tried to turn Americans against data centers
JailbreakOPT: Tool-Assisted Iterative Jailbreak Prompt Optimization
Robust Privacy: Inference-Stage Privacy through Certified Robustness
Learning to Inject: Automated Prompt Injection via Reinforcement Learning
Risk Under Pressure: Compute-Aware Evaluation of Adversarial Robustness in Language Models
When Poison Fails After Retrieval: Revisiting Corpus Poisoning under Chunking and Reranki…
Runtime Skill Audit: Targeted Runtime Probing for Agent Skill Security
Can Open-Source LLM Agents Replace Static Application Security Testing Tools? An Empirica…