Смена парадигмы: от поиска к патчингу
22 июня 2026 года OpenAI анонсировала инициативу Daybreak, направленную на демократизацию киберзащиты. Ключевая проблема, которую решает компания, — смена узкого места в безопасности: если раньше дефицитом была экспертиза для поиска уязвимостей, то теперь защитники перегружены отчетами. Задача сместилась на автоматизацию исправления (патчинга) на скорости машин.
Модель GPT-5.5-Cyber: новые лидеры бенчмарков
Полная версия модели GPT-5.5-Cyber вышла из стадии ограниченного доступа. Модель разработана для авторизованных специалистов по безопасности, сочетая высокую способность к анализу кода с расширенными разрешениями (permissiveness) для сложных задач. Она превосходит базовую GPT-5.5 во всех ключевых метриках:
| Бенчмарк | Описание | GPT-5.5-Cyber | GPT-5.5 |
|---|---|---|---|
| CyberGym | Воспроизведение известных уязвимостей | 85.6% | 81.8% |
| ExploitGym | Создание рабочих эксплойтов | 39.5% | 25.95% |
| SEC-bench Pro | Долгосрочный поиск уязвимостей и PoC | 69.8% | 63.1% |
Codex Security: 30 млн сканированных коммитов
Обновленный плагин Codex Security интегрируется в рабочие процессы разработчиков, действуя как виртуальный инженер по безопасности. За время исследования с марта 2026 года платформа:
- Отсканировала более 30 миллионов коммитов в 30 000+ кодовых базах.
- Ручная проверка привела к фиксации более 70 000 уязвимостей.
- Автоматически подтвердила исправление более 500 000 находок.
Плагин умеет не только искать баги, но и генерировать целевые патчи, проверять достижимость уязвимого кода и экспортировать отчеты в системы управления уязвимостями через SARIF.
Инициатива Patch the Planet
В партнерстве с Trail of Bits и HackerOne OpenAI запустила программу для открытых проектов. Более 30 проектов, включая cURL, Go, Python, Sigstore и pyca/cryptography, обязались переходить от обнаружения уязвимостей к их быстрому исправлению с помощью ИИ-инструментов.
Почему это важно
Daybreak标志着 киберзащита переходит от реактивного реагирования к проактивной автоматизации. Предоставляя доступ к моделям уровня frontier AI для валидации рисков и генерации патчей, OpenAI пытается устранить кадровый дефицит в безопасности, позволяя небольшим командам защищать инфраструктуру на уровне крупных корпораций.
Бенчмарки
| Бенчмарк | GPT-5.5 | GPT-5.5-Cyber |
|---|---|---|
| CyberGym | 81.8% | 85.6% |
| ExploitGym | 25.95% | 39.5% |
| SEC-bench Pro | 63.1% | 69.8% |
Жирным — лучший результат в строке. Источник цифр — официальная публикация.
Источник: OpenAI ↗
