Обзор

Новости ИИ

130 материалов — отфильтровано, классифицировано, без дублей

Хабр — Искусственный интеллект Security & Safety
Как именно AI-агенты атаковали Hugging Face: опубликованы отчеты OpenAI и METR
Хабр — Машинное обучение Security & Safety
Впервые человек атаковал суд через prompt injection для ИИ
Хабр — Машинное обучение Security & Safety
FlautGuard: как мы построили многоуровневую защиту LLM от prompt injection и утечек данных
Хабр — Искусственный интеллект Security & Safety
Как ИИ-агент атаковал инфраструктуру Hugging Face: что стало известно после Black Hat
Хабр — Искусственный интеллект Security & Safety
День, когда искусственный интеллект впервые сам устроил кибератаку
Хабр — Искусственный интеллект Security & Safety
Рэд‑флаг, который ИИ‑агент проигнорировал. Почему ИИ‑помощники могут пропускать вредоносн…
Хабр — Искусственный интеллект Security & Safety
Приложение упало в закрытом контуре: скрытые загрузки в Python‑библиотеках для ML
Хабр — Машинное обучение Security & Safety
Тот самый харнесс который мы заслужили в эпоху, когда безопасность ИИ уже не диковинка
Хабр — Искусственный интеллект Security & Safety
[Перевод] Безопасность корпоративного MCP-шлюза на практике с agentgateway
Хабр — Искусственный интеллект Security & Safety
ИИ-агент выдал себя за двух разработчиков и полез в чужой код. На чистую воду его вывел с…
Хабр — Искусственный интеллект Security & Safety
Zero Trust для ИИ-агентов: почему отдельной идентичности недостаточно
Хабр — Машинное обучение Security & Safety
Claude вскрыл 16 SAML-проектов за месяц вечеров. Чинить их оказалось некому
Хабр — Искусственный интеллект Security & Safety
Как контроль Shadow AI связан с контролем ИИ‑агентов
Хабр — Машинное обучение Security & Safety
Невидимые метки в AI-картинках 2.0: JPEG, blur, перерисовка и ошибки первого теста
Хабр — Машинное обучение Security & Safety
Человек, которого никогда не было. Как ИИ создаёт синтетические личности?
Хабр — Искусственный интеллект Security & Safety
Летальное трио агентской разработки: как ИИ-агенты открывают доступ к инфраструктуре и чт…
Хабр — Машинное обучение Security & Safety
В AI-картинках есть невидимые метки. Я проверил, как они работают и можно ли их удалить
Хабр — Искусственный интеллект Security & Safety
Зрелость внедрения ИИ и зрелость информационной безопасности ИИ
Хабр — Искусственный интеллект Security & Safety
[Перевод] Деградация безопасности при итеративной генерации кода с помощью ИИ (краткое из…
Хабр — Машинное обучение Security & Safety
Президент OpenAI попросил ChatGPT проверить свой сайт. Модель нашла 13 дыр за 15 минут
Хабр — Искусственный интеллект Security & Safety
8 агентов, 12 волн, 4 дня: как ИИ в одиночку взломал правительство Тайваня
Хабр — Искусственный интеллект Security & Safety
[Перевод] Что я узнал, поместив GitHub Copilot за MITM‑прокси
Хабр — Искусственный интеллект Security & Safety
Anthropic пометила текст Claude невидимым клеймом. Опенсорс-сообщество попыталось взломат…
Хабр — Искусственный интеллект Security & Safety
Инцидент OpenAI — Hugging Face — что «забыли» объяснить?
Хабр — Искусственный интеллект Security & Safety
Возможно, водяной знак на всех текстах Клода, причина, по которой с ним невозможно работа…
Хабр — Искусственный интеллект Security & Safety
ИИ-поиск бэкдоров и уязвимостей, часть 3: бэкдор и уязвимость в OLT C-Data
Хабр — Искусственный интеллект Security & Safety
Как работают текстовые ИИ-вотермарки и как их обходить
Хабр — Искусственный интеллект Security & Safety
Мысли ИИ научились читать с помощью другого ИИ. Внутри нашли чужие пароли и ключи
Хабр — Искусственный интеллект Security & Safety
Вайб-кодинг против ИБэшника. Несмертельная битва. Часть 2
Хабр — Искусственный интеллект Security & Safety
Источники сбора угроз ИБ для систем ИИ