Как именно AI-агенты атаковали Hugging Face: опубликованы отчеты OpenAI и METR
Обзор
Новости ИИ
130 материалов — отфильтровано, классифицировано, без дублей
Впервые человек атаковал суд через prompt injection для ИИ
FlautGuard: как мы построили многоуровневую защиту LLM от prompt injection и утечек данных
Как ИИ-агент атаковал инфраструктуру Hugging Face: что стало известно после Black Hat
День, когда искусственный интеллект впервые сам устроил кибератаку
Рэд‑флаг, который ИИ‑агент проигнорировал. Почему ИИ‑помощники могут пропускать вредоносн…
Приложение упало в закрытом контуре: скрытые загрузки в Python‑библиотеках для ML
Тот самый харнесс который мы заслужили в эпоху, когда безопасность ИИ уже не диковинка
[Перевод] Безопасность корпоративного MCP-шлюза на практике с agentgateway
ИИ-агент выдал себя за двух разработчиков и полез в чужой код. На чистую воду его вывел с…
Zero Trust для ИИ-агентов: почему отдельной идентичности недостаточно
Claude вскрыл 16 SAML-проектов за месяц вечеров. Чинить их оказалось некому
Как контроль Shadow AI связан с контролем ИИ‑агентов
Невидимые метки в AI-картинках 2.0: JPEG, blur, перерисовка и ошибки первого теста
Человек, которого никогда не было. Как ИИ создаёт синтетические личности?
Летальное трио агентской разработки: как ИИ-агенты открывают доступ к инфраструктуре и чт…
В AI-картинках есть невидимые метки. Я проверил, как они работают и можно ли их удалить
Зрелость внедрения ИИ и зрелость информационной безопасности ИИ
[Перевод] Деградация безопасности при итеративной генерации кода с помощью ИИ (краткое из…
Президент OpenAI попросил ChatGPT проверить свой сайт. Модель нашла 13 дыр за 15 минут
8 агентов, 12 волн, 4 дня: как ИИ в одиночку взломал правительство Тайваня
[Перевод] Что я узнал, поместив GitHub Copilot за MITM‑прокси
Anthropic пометила текст Claude невидимым клеймом. Опенсорс-сообщество попыталось взломат…
Инцидент OpenAI — Hugging Face — что «забыли» объяснить?
Возможно, водяной знак на всех текстах Клода, причина, по которой с ним невозможно работа…
ИИ-поиск бэкдоров и уязвимостей, часть 3: бэкдор и уязвимость в OLT C-Data
Как работают текстовые ИИ-вотермарки и как их обходить
Мысли ИИ научились читать с помощью другого ИИ. Внутри нашли чужие пароли и ключи
Вайб-кодинг против ИБэшника. Несмертельная битва. Часть 2
Источники сбора угроз ИБ для систем ИИ