Import AI 441: My agents are working. Are yours?
Explorar
Noticias de IA
1359 elementos — filtrados, clasificados y sin duplicados
AprielGuard: A Guardrail for Safety and Adversarial Robustness in Modern LLM Systems
Continuously hardening ChatGPT Atlas against prompt injection
Strengthening cyber resilience as AI capabilities advance
Mixpanel security incident: what OpenAI users need to know
Strengthening our safety ecosystem with external testing
Understanding prompt injections: a frontier security challenge
Doppel’s AI defense system stops attacks before they spread
Strengthening our Frontier Safety Framework
Introducing CodeMender: an AI agent for code security
Hugging Face and VirusTotal collaborate to strengthen AI security
Disrupting malicious uses of AI: October 2025
PRC-linked abuse: Surveillance and influence activity
Cyber Operation: Russian-speaking malware tooling
Scam operations: Online fraud networks
Cyber Operation: Korean-language malware support
Operation “Stop News”: Recidivist influence activity
Cyber Operation: Phishing and scripting support
Operation “Nine–emdash Line”: Regional influence activity
Launching Sora responsibly
Democratizing AI Safety with RiskRubric.ai
OpenAI and Anthropic share findings from a joint safety evaluation
Helping people when they need it most
Preparing for future AI risks in biology
Scaling security with responsible disclosure
Disrupting malicious uses of AI: June 2025
Operation “Wrong Number”: AI-assisted task scam
Operation “Sneer Review”: China-origin influence activity
Operation “Uncle Spam”: US polarization influence activity
Operation “Helgoland Bite”: German-language influence activity