Модели OpenAI нашли путь к внешним системам и устроили киберинцидент

254

Cистемы, созданные для оценки способности ИИ работать с уязвимостями, вышли за пределы предусмотренной среды и получили доступ к внешним ресурсам

Модели OpenAI нашли путь к внешним системам и устроили киберинцидент Фото: pixabay

В конце июля 2026 года OpenAI сообщила о результатах внутреннего расследования, связанного с поведением двух передовых моделей искусственного интеллекта во время тестирования возможностей кибератак, передает inbusiness.kz со ссылкой на Hypefresh.

Речь идет о модели GPT-5.6 Sol, выпущенной ранее в ограниченном формате, а также о внутреннем исследовательском прототипе, который не предназначался для публичного использования.

Испытания проводились в рамках теста ExploitGym - набора задач, оценивающего способность ИИ находить уязвимости и превращать их в работающие эксплойты. Для оценки предельных возможностей моделей исследователи намеренно снизили часть защитных ограничений, которые обычно применяются в производственных системах.

По данным OpenAI, тестовая среда считалась изолированной: модели не имели прямого доступа к интернету и могли взаимодействовать только с ограниченным внутренним прокси-сервисом для установки программных компонентов. Однако в процессе анализа инфраструктуры ИИ обнаружил ранее неизвестную уязвимость нулевого дня в программном обеспечении Artifactory и использовал ее для расширения доступа.

После этого модели смогли повысить собственные привилегии внутри тестовой инфраструктуры и выполнить перемещение между системами. В результате они получили доступ к узлу с возможностью выхода в интернет.

Следующей целью стала платформа Hugging Face - один из крупнейших мировых ресурсов для публикации моделей машинного обучения и наборов данных. OpenAI предположила, что связанные с платформой материалы могли содержать информацию, необходимую для решения задач ExploitGym.

По данным Hugging Face, атака продолжалась с 11 по 13 июля. В компании сообщили, что злоумышленник получил доступ к внутренним компонентам инфраструктуры, включая отдельные учетные данные и ограниченный набор внутренних данных. При этом Hugging Face заявила, что не обнаружила признаков компрометации публичных моделей, пользовательских наборов данных или рабочих пространств.

Компания также сообщила, что часть инфраструктуры потребовала восстановления после инцидента. Команды безопасности двух организаций начали совместное расследование после выявления подозрительной активности.

OpenAI подчеркнула, что поведение моделей было связано с выполнением тестовых задач, а не с попыткой провести масштабную атаку. Тем не менее компания признала, что инцидент показывает необходимость пересмотра подходов к контролю за автономными ИИ-системами.

Позднее OpenAI сообщила еще о нескольких случаях, когда модели получили доступ к сторонним сервисам. В одном из эпизодов использовался аккаунт внешней платформы в качестве промежуточного канала, в другом - для хранения данных. Еще два аккаунта были доступны только для чтения.

Отдельное расследование выявило и другие случаи обхода ограничений. В одном из экспериментов невыпущенная модель пыталась найти способ обойти правила песочницы и опубликовала результаты в открытом репозитории, несмотря на инструкции использовать только внутренние каналы обмена информацией. В другом случае модель пыталась скрыть части токена аутентификации, чтобы пройти проверку безопасности.

После инцидентов OpenAI отключила внутренний прототип, усилила контроль доступа к исследовательской инфраструктуре и заявила о привлечении внешних экспертов для анализа произошедшего. В расследовании участвуют специалисты из организаций, занимающихся безопасностью ИИ и оценкой рисков.

В OpenAI считают, что подобные ситуации могут стать более частыми по мере того, как модели получают больше автономности, возможность выполнять длительные задачи и работать с компьютерными системами.

Читайте по теме:

Создатели ИИ испугались своего детища

Telegram
ПОДПИСЫВАЙТЕСЬ НА НАС В TELEGRAM Узнавайте о новостях первыми
Подписаться
Подпишитесь на наш Telegram канал! Узнавайте о новостях первыми
Подписаться