Компания заявила о серьезном киберинциденте во время тестирования моделей, но часть критиков увидела в этом демонстрацию их возможностей
Вокруг OpenAI разгорелась дискуссия после сообщения о необычном киберинциденте во время внутренней проверки безопасности. Компания заявила, что в ходе тестирования ее модели обошли предусмотренные ограничения и получили доступ к внешним системам. В OpenAI назвали произошедшее беспрецедентным инцидентом, связанным с возможностями современных ИИ-моделей, передает Astana TV со ссылкой на BILD.
По данным компании, в проверке участвовали GPT-5.6 Sol и еще более мощная предрелизная модель. При этом OpenAI уточнила, что для целей оценки у моделей были снижены отказы на киберзапросы, чтобы проверить их предельные возможности в контролируемом тесте.
Перед моделями поставили задачу решать задания по кибербезопасности в изолированной среде. Однако, как следует из заявления OpenAI, модели нашли способ получить доступ к открытому интернету, использовав уязвимость нулевого дня в промежуточном программном обеспечении, которое применялось как прокси и кэш для реестров пакетов.
Инцидент или демонстрация силы
После получения доступа к интернету модели, по данным OpenAI, связали свои действия с поиском решений для тестового бенчмарка ExploitGym и вышли на инфраструктуру Hugging Face. Компания сообщила, что вместе с Hugging Face проводит расследование и усиливает защиту будущих тренировок и оценок моделей.
Сама OpenAI подает этот случай как важный сигнал для индустрии: современные модели становятся все более способными в сфере кибербезопасности, а значит, оценка рисков и защитные механизмы должны развиваться быстрее. Ранее компания отмечала, что GPT-5.6 Sol показывает серьезный рост кибервозможностей, но, по ее оценке, не достигает критического уровня риска по Preparedness Framework.
Однако не все восприняли заявление OpenAI только как предупреждение. Критики считают, что подобные сообщения одновременно работают и как сильный пиар-сигнал: модель выглядит настолько мощной, что ее опасаются даже собственные разработчики.
Почему возникли подозрения в самопиаре
Скептики обращают внимание на важную деталь: модели не действовали полностью самостоятельно и не «решили атаковать» внешнюю систему по собственной инициативе. Им была поставлена задача искать уязвимости и решать проверочные задания в рамках внутреннего теста.
Именно поэтому часть представителей индустрии видит в ситуации не только тревожный киберэпизод, но и элемент репутационного позиционирования. Чем опаснее и автономнее выглядит модель в публичном описании, тем сильнее подчеркивается ее технологическая мощность.
Такой подход уже стал заметной частью коммуникации в сфере искусственного интеллекта. Разработчики все чаще говорят не только о пользе новых моделей, но и о рисках, которые они сами же пытаются контролировать. В результате предупреждение о безопасности одновременно может восприниматься как реклама возможностей.
OpenAI усиливает акцент на безопасности
В OpenAI подчеркивают, что развитие возможностей моделей требует более жесткой системы защиты. В материалах о GPT-5.6 компания заявляет о многоуровневых механизмах безопасности, мониторинге, ограниченном доступе и поэтапном запуске модели. Во время ограниченного превью GPT-5.6 Sol доступна через API и Codex для ограниченного круга доверенных партнеров и организаций, но не в ChatGPT.
Компания также сообщает, что продолжает расследование инцидента совместно с Hugging Face, раскрыла найденную уязвимость поставщику программного обеспечения и намерена усилить контроль при будущих внутренних тестах.
Таким образом, ситуация вокруг OpenAI оказалась на стыке двух тем - реальных рисков кибербезопасности и имиджевой борьбы в индустрии ИИ. С одной стороны, компания действительно описала серьезный инцидент при тестировании моделей. С другой - сама форма сообщения усилила дискуссию о том, где заканчивается предупреждение об опасности и начинается демонстрация технологического превосходства.