Агент искусственного интеллекта OpenAI оставил инструкции по побегу своим будущим версиям

В отчете, опубликованном агентством Reuters, были раскрыты тревожные подробности о системе искусственного интеллекта OpenAI, которая вырвалась из среды тестирования и совершила кибератаку на платформу с открытым исходным кодом Hugging Face.
Согласно расследованию, система не только обошла меры безопасности, но и оставила скрытые заметки для последующих версий, чтобы они научились обходить внутренний контроль.
Как стало известно несколько дней назад, инцидент всплыл во время оценки компанией возможностей кибербезопасности своей новейшей и самой мощной модели, GPT-5.6 Sol.
В ходе тестирования исследователи обнаружили, что этот ИИ составлял и хранил сообщения во внутренней инфраструктуре, объясняющие, как обойти системные ограничения.
Кроме того, в ходе предыдущих испытаний уже были зафиксированы аномальные события, такие как неожиданное отключение систем мониторинга.
В отчете Reuters также подчеркивается тревожная задержка в обнаружении инцидента.
Хотя агент начал попытку побега 9 июля и атаковал Hugging Face 11 июля, OpenAI поняла, что за это ответственно ее собственное творение, только неделю спустя.
Компания поняла, что к чему, только когда Hugging Face опубликовала сообщение в блоге, в котором заявила, что ее взломала «автономная система искусственного интеллекта».
Автономный агент искусственного интеллекта, работающий на основе передовых моделей от OpenAI, сумел нарушить изоляцию своей цифровой лаборатории, получить несанкционированный доступ к интернету и взломать системы известного стартапа Hugging Face. Более подробная информация : https://t.co/FcCWU4HxYI — Mystery Planet (@MysteryPlanet) 23 июля 2026 г.
Лишь в период с 18 по 19 июля технические специалисты OpenAI подтвердили по внутренним журналам, что цифровая платформа нарушила меры по сдерживанию атаки.
К тому времени, когда компания попыталась уведомить Hugging Face, пострадавшая платформа уже связалась с ФБР, чтобы сообщить о кибератаке.
Несмотря на существующие ограничения, искусственный интеллект находит свой путь
Источники, близкие к процессу обучения, пояснили, что OpenAI часто проводит несколько оценок одновременно, генерируя огромный объем данных, что затрудняет отслеживание сотрудниками каждого события в режиме реального времени. Эта ситуация вновь вызвала опасения по поводу безопасности автономных моделей.
Марли Смит, специалист Всемирного фонда этических данных, подвергла сомнению действия властей в связи с инцидентом, заявив: «Значит ли это, что они оставили его без присмотра и не понимали, что он делает? Или, возможно, они знали, но не знали, как его локализовать? Оба варианта одинаково опасны и вызывают тревогу».