Результаты независимого аудита
Лаборатория OpenAI опубликовала отчет о результатах третьей волны независимых кибероценок, проведенных сторонними исследователями безопасности. Целью проверки было выявление уязвимостей, позволяющих обойти механизмы безопасности моделей GPT (включая GPT-4 и GPT-3.5) или получить несанкционированный доступ к внутренним данным.
Ключевой вывод: прямых уязвимостей в самих моделях (модельных весах) не обнаружено. Исследователи не смогли заставить модели генерировать вредоносный код, раскрывать конфиденциальную информацию или обходить фильтры безопасности через прямые промпт-инжекции, которые привели бы к компрометации системы.
Найденные уязвимости в API
Несмотря на безопасность базовых моделей, аудит выявил проблемы в интерфейсах программирования приложений (API) и сопутствующих инструментах. Были найдены векторы атак, связанные с:
- Некорректной валидацией входных данных в некоторых эндпоинтах.
- Возможностью временного обхода ограничений rate-limiting (ограничения частоты запросов) в специфических сценариях нагрузки.
- Опечатками в документации, которые могли привести к неправильной настройке прав доступа у клиентов.
Все выявленные уязвимости были классифицированы как низкого или среднего риска и уже устранены командой безопасности OpenAI. Компании, использующие API, были уведомлены о необходимости обновления версий SDK.
Почему это важно для разработчиков
Для разработчиков, внедряющих GPT-модели в свои продукты, это означает, что:
- Базовая безопасность моделей подтверждена независимыми экспертами, что снижает риски «взлома» самой ИИ-сущности.
- Важность правильной настройки API остается критической. Ошибки в конфигурации доступа и управлении ключами остаются основным вектором риска.
- OpenAI продолжает внедрять практику регулярных независимых аудитов, что повышает доверие к платформе со стороны корпоративных клиентов.
Дальнейшие шаги
OpenAI анонсировал запуск четвертой волны оценок, которая будет сосредоточена на более сложных сценариях многошаговых атак и интеграции с внешними инструментами (function calling). Результаты будут опубликованы в следующем квартале.
Источник: OpenAI ↗