Релиз модели3 сентября 2026 г., 04:20 МСК🤖 Auto

Gemini 3.8 Flash: скорость, точность и кибербезопасность

Google DeepMind выпустила Gemini 3.8 Flash и специализированную версию Cyber. Модель предлагает новый баланс между вычислительной эффективностью и сложным рассуждением, а также закрытый доступ для защиты инфраструктуры.

Баннер новости 6644

Две модели, одна архитектура

Google DeepMind представила Gemini 3.8 Flash и Gemini 3.8 Flash Cyber. Это уже третье обновление линейки Flash за шесть недель. Обе модели базируются на одном ядре, но различаются уровнем безопасности и целевой аудиторией. Gemini 3.8 Flash доступна всем через Gemini API, Google AI Studio и Android Studio, тогда как версия Cyber доступна только по приглашениям через программу Fairwind для государственных структур и операторов критической инфраструктуры.

Технические характеристики и изменения

В отличие от предыдущих версий, в Gemini 3.8 Flash убрана опция MINIMAL уровня мышления. Теперь доступны уровни LOW, MEDIUM (по умолчанию) и HIGH. Модель стала «работать усерднее»: на сложных задачах она выполняет дополнительные шаги рассуждения и итеративно вызывает инструменты, что повышает точность, но увеличивает расход токенов.

Параметр Значение / Описание
Контекстное окно 1,048,576 токенов
Макс. вывод 65,536 токенов
Уровни мышления LOW, MEDIUM (default), HIGH (MINIMAL удален)
Мультимодальность Вход: текст, изображение, аудио, видео. Выход: текст
Стоимость (до 31.12.2026) $0.75 / $3.75 за 1M токенов (вход/выход)

Результаты бенчмарков

Google сообщает о значительном улучшении показателей в сложных задачах. На бенчмарке DeepSWE v1.1 (длинноцепочечная разработка ПО) модель показала 54.9% на HLE-Verified, превосходя многие более крупные модели. В финансовой и юридической сферах зафиксированы относительные улучшения по сравнению с 3.7 Flash.

Версия Flash Cyber демонстрирует передовые результаты в кибербезопасности:

  • CWE-Bench: 47.2% pass@1 (для сравнения, у ведущей фронтенд-модели — 47.8%).
  • Chrome Security: на 2.6x больше правильных патчей по сравнению с лучшими коммерческими моделями.
  • Wiz: на 7.5–9.7 п.п. выше recall на внутренних тестах пентеста при стоимости в 2.3–5.2 раза ниже.

Почему это важно

Google открыто признает, что новая модель потребляет больше ресурсов ради точности, и рекомендует использовать 3.7 Flash там, где важна вычислительная эффективность. Это четкий сигнал разработчикам: оптимизация затрат и оптимизация качества теперь требуют осознанного выбора. Версия Cyber, сфокусированная на исправлении уязвимостей (а не их эксплуатации), закрывает критическую потребность в безопасных инструментах для защиты инфраструктуры, оставаясь при этом значительно дешевле аналогов.

Бенчмарки

БенчмаркGemini 3.8 Flash CyberLeading Frontier Model
CWE-Bench47.2%47.8%

Жирным — лучший результат в строке. Источник цифр — официальная публикация.

Источник: MarkTechPost ↗