
OpenAI обращает внимание на то, что ее модели быстро развивают свои кибернавыки — теперь компания планирует свой дальнейший путь так, чтобы каждый новый значимый релиз мог служить полноценным инструментом для кибератак. Это значит, что модели могут достигнуть уровня, позволяющего разрабатывать «нулевые дни» (zero-day-эксплойты) и оказывать помощь в сложных атаках на инфраструктуру.
Эти выводы основаны на внутренних тестах в формате CTF (capture-the-flag, соревнования по взлому). В августе 2025 года GPT-5 справлялась с 27% задач, в то время как в ноябре GPT-5.1-Codex-Max уже показала 76%. Практически трехкратный рост за три месяца. OpenAI надеется, что следующие модели продолжат этот тренд и достигнут уровня High по внутреннему индексу риска Preparedness Framework — это означает, что они смогут разрабатывать рабочие эксплойты для хорошо защищенных систем или существенно помогать в сложных скрытых атаках на инфраструктуру.
Тем не менее, компания заявляет, что намерена направить эти возможности на пользу защитникам, не нападению. Для этого OpenAI создает многоуровневую систему: модели обучаются отказывать в явно вредоносных запросах, оставаясь полезными для аудита и защиты; вводится мониторинг и системы обнаружения злоупотреблений; регулярно проводится red teaming с внешними экспертами. Также разрабатывается программа Trusted Access — «доверенный доступ» для специалистов по киберзащите, которым будут предоставлены расширенные возможности моделей для оборонительных задач. Кроме того, создается Frontier Risk Council — консультативный совет из практиков кибербезопасности, который будет влиять на оценки рисков и меры защиты и в будущем должен охватить не только кибербезопасность, но и другие опасные возможности передовых моделей.
OpenAI признает, что эта проблема затрагивает не только ее продукты — любая фронтир-модель в индустрии потенциально может использоваться для кибератак. Поэтому компания сотрудничает с другими лабораториями через Frontier Model Forum для разработки общих моделей угроз и поддерживает независимые оценки кибервозможностей ИИ. В OpenAI подчеркивают, что это долгосрочная стратегия по укреплению цифровой и критической инфраструктуры, которая будет развиваться не только за счет собственных инструментов, но и через гранты и другие инициативы для исследователей, индустрии и open source-сообщества.
P.S. Поддержать меня можно подпиской на канал «сбежавшая нейросеть», где я освещаю ИИ с творческой стороны.