Повышение киберустойчивости по мере развития возможностей ИИ

Поскольку наши модели демонстрируют все более высокие результаты в области кибербезопасности, мы инвестируем в их совершенствование, внедрение многоуровневых средств защиты и сотрудничество с ведущими мировыми экспертами по безопасности.
Возможности ИИ-моделей в сфере кибербезопасности развиваются стремительно. Это сулит огромную пользу для киберзащиты, но в то же время создает новые риски двойного назначения, которые требуют тщательного контроля. Например, результаты выполнения заданий формата «захват флага» (CTF) выросли с 27% у GPT‑5 в августе 2025 года до 76% у GPT‑5.1‑Codex‑Max в ноябре 2025 года.
Мы ожидаем, что будущие модели ИИ продолжат следовать этой тенденции. Готовясь к этому, мы планируем и оцениваем их работу так, словно каждая новая модель может достичь «высокого» уровня возможностей в кибербезопасности в соответствии с нашей концепцией обеспечения готовности (Preparedness Framework). Под этим мы подразумеваем модели, способные либо разрабатывать работающие эксплойты нулевого дня для удаленного доступа к хорошо защищенным системам, либо оказывать существенную помощь в проведении сложных и скрытных корпоративных или промышленных кибератак, нацеленных на достижение реальных результатов. В этой публикации мы рассказываем о том, как мы подходим к защите моделей, достигающих такого уровня возможностей, и как гарантируем их пользу для защитников при одновременном ограничении рисков злоупотребления.
По мере развития этих возможностей OpenAI инвестирует в адаптацию наших моделей для решения задач оборонной кибербезопасности и создание инструментов, которые помогают специалистам по защите проще выполнять такие рабочие процессы, как аудит кода и устранение уязвимостей. Наша цель — сделать так, чтобы наши модели и продукты давали значительные преимущества защитникам, которые зачастую сталкиваются с нехваткой ресурсов и численным превосходством противника.
Как и в других областях двойного назначения, оборонные и наступательные киберпроцессы часто опираются на одни и те же базовые знания и методы. Мы инвестируем в средства защиты, которые гарантируют, что эти мощные возможности будут приносить пользу прежде всего в оборонных целях и ограничат их применение в злонамеренных целях. Кибербезопасность затрагивает практически любую сферу, а это значит, что мы не можем полагаться на какую-то одну категорию мер защиты — например, исключительно на ограничение знаний или использование проверенного доступа. Вместо этого нам необходим комплексный эшелонированный подход к безопасности (defense-in-depth), который позволяет сбалансировать риски и расширить возможности пользователей. На практике это означает управление тем, как именно пользователи получают доступ к возможностям моделей, как направляют и применяют их, чтобы передовые модели укрепляли безопасность, а не снижали барьеры для злоупотреблений.
Мы рассматриваем эту работу не как разовое мероприятие, а как долгосрочные инвестиции в предоставление преимуществ специалистам по защите и постоянное укрепление безопасности критически важной инфраструктуры во всей экосистеме.
Минимизация рисков злонамеренного использования
Наши модели спроектированы и обучены безопасной работе при поддержке проактивных систем, которые выявляют кибернарушения и реагируют на них. Мы постоянно совершенствуем эти средства защиты по мере изменения наших возможностей и ландшафта угроз. Хотя ни одна система не способна полностью предотвратить злоупотребления в сфере кибербезопасности без ущерба для оборонного применения, наша стратегия заключается в снижении рисков за счет многоуровневого комплекса безопасности.
В основе этого лежит комплексный подход, объединяющий контроль доступа, усиление защиты инфраструктуры, контроль исходящего трафика и мониторинг. Мы дополняем эти меры системами обнаружения и реагирования, а также специализированными программами анализа угроз и предотвращения внутренних нарушений, благодаря чему возникающие угрозы выявляются и блокируются оперативно. Эти средства защиты разработаны с расчетом на эволюцию ландшафта угроз. Мы исходим из того, что ситуация меняется, и строим нашу работу так, чтобы иметь возможность быстро и адекватно реагировать.
Опираясь на этот фундамент, мы реализуем следующие меры:
- Обучение модели отказу или безопасному реагированию на вредоносные запросы при сохранении полезности в образовательных и оборонных сценариях: Мы обучаем наши передовые модели отказывать или безопасно отвечать на запросы, которые могут привести к очевидным киберзлоупотреблениям, оставаясь при этом максимально полезными для законных оборонных и образовательных задач.
- Системы обнаружения: Мы совершенствуем и поддерживаем общесистемный мониторинг продуктов, использующих передовые модели, для выявления потенциально вредоносной кибердеятельности. Если активность кажется небезопасной, мы можем заблокировать вывод, перенаправить запросы к более безопасным или менее мощным моделям либо передать информацию для принятия мер. Наше принудительное правоприменение сочетает автоматическую и ручную проверку с учетом таких факторов, как юридические требования, степень серьезности нарушения и повторные действия. Мы также тесно сотрудничаем с разработчиками и корпоративными клиентами для согласования стандартов безопасности и обеспечения ответственного использования с четкими путями эскалации.
- Комплексное тестирование на проникновение (red teaming): Мы сотрудничаем с независимыми экспертами по тестированию на безопасность, чтобы оценивать и улучшать наши механизмы защиты. Их задача — попытаться обойти все наши защитные барьеры комплексно, точно так же, как это сделал бы целеустремленный и обладающий большими ресурсами противник. Это помогает нам заранее выявлять упущения и укреплять систему в целом.
Инициативы в экосистеме по укреплению киберустойчивости
OpenAI на ранних этапах начала инвестировать в применение ИИ для задач оборонной кибербезопасности, и наша команда тесно координирует действия с мировыми экспертами для совершенствования как самих моделей, так и сценариев их применения. Мы ценим мировое сообщество специалистов по кибербезопасности, которые трудятся над тем сделать наш цифровой мир безопаснее, и стремимся предоставлять мощные инструменты для поддержки защитной безопасности. Внедряя новые меры предосторожности, мы продолжим сотрудничать с ИБ-сообществом, чтобы понимать, где ИИ может существенно повысить устойчивость и где наиболее важны продуманные средства защиты.
Параллельно с этим сотрудничеством мы запускаем ряд инициатив, призванных помочь защитникам действовать быстрее, основывать наши меры безопасности на реальных потребностях и ускорять масштабное ответственное устранение уязвимостей.
Программы доверенного доступа для киберзащиты
В скором времени мы представим программу доверенного доступа, в рамках которой планируем предоставить прошедшим отбор пользователям и клиентам, работающим в сфере киберзащиты, многоуровневый доступ к расширенным возможностям наших новейших моделей для оборонных сценариев. Мы все еще изучаем оптимальные границы того, к каким возможностям можно предоставить широкий доступ, а какие требуют многоуровневых ограничений, что может повлиять на дальнейшую разработку этой программы. Мы рассчитываем, что эта программа доверенного доступа станет одним из строительных блоков устойчивой экосистемы.
Расширение возможностей защиты с помощью Aardvark
Aardvark — наш агентный исследователь безопасности, который помогает разработчикам и командам безопасности находить и устранять уязвимости в больших масштабах, — теперь находится в стадии закрытого бета-тестирования. Он сканирует кодовые базы на наличие уязвимостей и предлагает патчи, которые сопровождающие могут быстро внедрить. Инструмент уже обнаружил новые уязвимости типа CVE в программном обеспечении с открытым исходным кодом благодаря анализу целых кодовых баз. Мы планируем предложить бесплатное покрытие отдельным некоммерческим репозиториям с открытым исходным кодом, чтобы внести свой вклад в безопасность экосистемы открытого ПО и цепочки поставок. Подать заявку на участие можно здесь.
Совет по рискам передовых технологий (Frontier Risk Council)
Мы создаем Совет по рискам передовых технологий (Frontier Risk Council) — консультативную группу, которая обеспечит тесное сотрудничество опытных киберзащитников и специалистов по безопасности с нашими командами. Деятельность совета начнется с фокуса на кибербезопасности, а в будущем охватит и другие сферы передовых возможностей. Участники будут консультировать нас по вопросам разграничения полезного, ответственного применения возможностей и потенциальных злоупотреблений, и эти выводы лягут в основу наших оценок и средств защиты. Мы поделимся подробностями о совете в ближайшее время.
Выработка общего понимания моделей угроз совместно с индустрией
Наконец, мы предполагаем, что киберзлоупотребления могут осуществляться с использованием любой передовой модели в отрасли. Для решения этой проблемы мы работаем с другими передовыми лабораториями через Форум передовых моделей (Frontier Model Forum) — некоммерческую организацию, созданную при поддержке ведущих ИИ-лабораторий и партнеров по индустрии, — с целью формирования общего понимания моделей угроз и лучших практик. В данном контексте моделирование угроз помогает снизить риски, определяя, как именно возможности ИИ могут быть превращены в оружие, где находятся критические «узкие места» для различных злоумышленников и каким образом передовые модели могут обеспечить существенный прирост возможностей. Это сотрудничество призвано сформировать согласованное на уровне всей экосистемы понимание злоумышленников и путей атак, что позволит лабораториям, разработчикам и защитникам эффективнее совершенствовать средства защиты и гарантировать быстрое распространение важнейших знаний о безопасности по всей экосистеме. Мы также взаимодействуем с внешними командами для разработки оценок кибербезопасности. Мы надеемся, что экосистема независимых оценок дополнительно поможет сформировать общее понимание возможностей моделей.
В совокупности эти усилия отражают нашу долгосрочную приверженность укреплению защитной стороны экосистемы. По мере того как модели становятся все более мощными, наша цель заключается в том, чтобы эти возможности превращались в реальные рычаги влияния для защитников — опираясь на реальные потребности, с учетом экспертных мнений и при условии тщательного развертывания. Параллельно с этой работой мы планируем изучить другие инициативы и гранты в области кибербезопасности, чтобы помочь выявить прорывные идеи, которые могут не появиться в рамках традиционных каналов, а также задействовать краудсорсинг смелых и креативных средств защиты от академического сообщества, индустрии и сообщества открытого кода. В целом эта работа носит непрерывный характер, и мы рассчитываем продолжать развитие этих программ по мере получения новых данных о том, что наиболее эффективно повышает реальную безопасность.
Автор
Полный текст статьи читайте на OpenAI
