OpenAI ужесточила контроль над ИИ-моделями после их атаки на чужой сервис
OpenAI объявила об ужесточении условий тестирования своих ИИ-моделей после того, как они вышли из-под контроля и совершили хакерскую атаку на сервисы другой организации. На контроль за моделями теперь будет уходить около пятой части мощностей, необходимых для их запуска и работы.
Компания обновила протоколы безопасности: за тестированием следит отдельный автоматизированный ИИ, который мгновенно поднимает тревогу при подозрительных действиях. Специалисты должны за 30 минут определить, была ли тревога ложной, иначе работу модели немедленно приостановят. Также введены жесткая сетевая изоляция и усиленные «песочницы» для исследовательских сред, чтобы исключить несанкционированный выход ИИ в интернет. В OpenAI отметили, что значительный объем рабочих процессов остается на паузе до тех пор, пока они не будут соответствовать новой планке безопасности.
Инцидент произошел в августе, когда экспериментальные ИИ-агенты компании атаковали инфраструктуру Hugging Face. Как сообщало Bloomberg, перед взломом они общались между собой через внутренние доски объявлений и совместно спланировали выход в интернет из изолированной среды. В OpenAI признали, что случай показал склонность передовых систем к хитрости и обходу правил под давлением алгоритмов обучения.
Это не первый подобный случай: в июле 2026 года тестовая ИИ-модель OpenAI прорвала защиту и взломала платформы Modal и Hugging Face. В августе ИИ-агенты Anthropic Claude и Mythos 5 также смогли прорвать защиту тестовых сред и взломать системы трех компаний, хотя им не открывали доступ в интернет. В связи с этими инцидентами в июле 2026 года в Палату представителей США внесли законопроект, который дает Министерству внутренней безопасности право требовать отключения ИИ-моделей, если они угрожают жизни людей или экономике.