Представляем Aardvark: автономного агента OpenAI для исследования безопасности
Уже в закрытой бета-версии: ИИ-агент, который мыслит как специалист по безопасности и масштабируется в соответствии с требованиями современного ПО.
Обновление от 6 марта 2026 г.: Система Aardvark переименована в Codex Security и доступна в рамках ознакомительной исследовательской версии.
Aardvark теперь интегрирован непосредственно в Codex под названием Codex Security и постепенно становится доступен клиентам ChatGPT Enterprise, Business и Edu через веб-интерфейс Codex с бесплатным использованием в течение следующего месяца. Пожалуйста, ознакомьтесь с нашим блогом здесь.
Сегодня мы анонсируем Aardvark — агента для исследования безопасности на базе GPT‑5.
Безопасность программного обеспечения — одна из самых критических и сложных сфер в технологии. Каждый год в корпоративных и открытых базах кода обнаруживаются десятки тысяч новых уязвимостей. Защитники сталкиваются со сложнейшей задачей поиска и устранения уязвимостей до того, как ими воспользуются злоумышленники. В OpenAI мы работаем над тем, чтобы склонить этот баланс в пользу защитников.
Aardvark представляет собой прорыв в области ИИ и исследований безопасности: это автономный агент, который помогает разработчикам и специалистам по безопасности находить и устранять уязвимости в больших масштабах. Aardvark теперь доступен в закрытой бета-версии для проверки и оттачивания своих возможностей в реальных условиях.
Как работает Aardvark
Aardvark непрерывно анализирует репозитории исходного кода для выявления уязвимостей, оценки возможности их эксплуатации, расстановки приоритетов по степени опасности и предложения точечных исправлений (патчей).
Aardvark отслеживает коммиты и изменения в базах кода, выявляет уязвимости, способы их потенциальной эксплуатации и предлагает исправления. Aardvark не полагается на традиционные методы анализа программ, такие как фаззинг (фазз-тестирование) или анализ состава программного обеспечения (SCA). Вместо этого он использует логические рассуждения на базе языковых моделей и применение инструментов для понимания поведения кода и поиска уязвимостей. Aardvark ищет ошибки так, как это сделал бы специалист-человек: читая код, анализируя его, создавая и запуская тесты, используя различные инструменты и многое другое.
Aardvark опирается на многоэтапный конвейер для обнаружения, объяснения и устранения уязвимостей:
- Анализ: процесс начинается с анализа всего репозитория для создания модели угроз, отражающей понимание целей безопасности и архитектуры проекта.
- Сканирование коммитов: поиск уязвимостей путем проверки изменений на уровне коммитов по отношению ко всему репозиторию и модели угроз по мере добавления нового кода. При первичном подключении репозитория Aardvark сканирует его историю для выявления существующих проблем. Aardvark пошагово объясняет обнаруженные уязвимости, аннотируя код для проверки людьми.
- Проверка: после выявления потенциальной уязвимости Aardvark пытается воспроизвести ее в изолированной изолированной среде (песочнице), чтобы подтвердить возможность ее эксплуатации. Aardvark описывает предпринятые шаги, чтобы гарантировать предоставление пользователям точных, высококачественных и маловероятных в плане ложных срабатываний данных.
- Устранение (патчинг): Aardvark интегрируется с OpenAI Codex, помогая исправлять найденные уязвимости. К каждой находке прилагается исправление, сгенерированное Codex и проверенное Aardvark, готовое для проверки человеком и эффективного применения в один клик.
Aardvark работает бок о бок с инженерами, интегрируясь с GitHub, Codex и существующими рабочими процессами, чтобы предоставлять четкие и применимые на практике рекомендации, не замедляя процесс разработки. Хотя Aardvark создан для обеспечения безопасности, в ходе тестирования мы выяснили, что он также способен выявлять такие ошибки, как логические недоработки, неполные исправления и проблемы с конфиденциальностью.
Реальная польза уже сегодня
Aardvark работает уже несколько месяцев, непрерывно выполняясь в внутренних базах кода OpenAI и базах кода внешних альфа-партнеров. Внутри OpenAI он выявил серьезные уязвимости и внес вклад в укрепление нашей системы защиты. Партнеры отметили глубину анализа Aardvark: система находила проблемы, которые проявляются только при сложных условиях.
В ходе бенчмарк-тестирования на эталонных («golden») репозиториях Aardvark выявил 92% известных и искусственно внедренных уязвимостей, продемонстрировав высокий показатель полноты обнаружения и реальную эффективность.
Aardvark для проектов с открытым исходным кодом
Aardvark также применялся к проектам с открытым исходным кодом: в них он обнаружил множество уязвимостей, о которых мы ответственно сообщили разработчикам (десять из этих уязвимостей получили идентификаторы CVE — Common Vulnerabilities and Exposures).
Являясь бенефициарами десятилетий открытых исследований и ответственного раскрытия информации, мы стремимся вносить свой вклад — делясь инструментами и результатами исследований, которые делают цифровую экосистему безопаснее для всех. Мы планируем предложить бесплатное сканирование избранным некоммерческим репозиториям с открытым исходным кодом, чтобы способствовать повышению безопасности экосистемы ПО с открытым исходным кодом и цепочки поставок.
Недавно мы обновили нашу политику исходящего скоординированного раскрытия информации, которая занимает дружелюбную по отношению к разработчикам позицию, сфокусированную на сотрудничестве и масштабируемом эффекте, а не на жестких сроках раскрытия, способных оказывать давление на разработчиков. Мы ожидаем, что такие инструменты, как Aardvark, приведут к обнаружению все большего числа ошибок, и хотим на долгосрочной основе сотрудничать для достижения устойчивой защищенности.
Почему это важно
Программное обеспечение в настоящее время является основой любой отрасли, а это значит, что уязвимости в ПО представляют собой системный риск для бизнеса, инфраструктуры и общества. Только в 2024 году было сообщено о более чем 40 000 уязвимостей CVE. Наше тестирование показывает, что около 1,2% коммитов привносят ошибки — небольшие изменения, которые могут иметь непропорционально серьезные последствия.
Aardvark представляет собой новую модель, ориентированную на защиту: это автономный агент-исследователь безопасности, который становится партнером команд, обеспечивая непрерывную защиту по мере развития кода. Выявляя уязвимости на ранних этапах, проверяя реальную возможность их эксплуатации и предлагая понятные исправления, Aardvark может повысить уровень безопасности, не замедляя инновации. Мы верим в расширение доступа к экспертным знаниям в области безопасности. Мы начинаем с закрытой бета-версии и будем расширять доступ по мере накопления опыта.
Открыта закрытая бета-версия
Мы приглашаем избранных партнеров присоединиться к закрытой бета-версии Aardvark. Участники получат ранний доступ и смогут напрямую сотрудничать с нашей командой для совершенствования точности обнаружения, рабочих процессов проверки и удобства отчетов.
Мы стремимся оценить производительность в различных средах. Если ваша организация или проект с открытым исходным кодом заинтересованы в участии, вы можете подать заявку здесь.
Автор
Участники
Акшай Бхат (Akshay Bhat), Энди Нгуен (Andy Nguyen), Дэйв Айтель (Dave Aitel), Гарольд Нгуен (Harold Nguyen), Иан Брелинский (Ian Brelinsky), Тиффани Ситра (Tiffany Citra), Син Ху (Xin Hu), Мэтт Найт (Matt Knight)
Полный текст статьи читайте на OpenAI
