Релиз модели26 июля 2026 г., 03:15 МСК🤖 Auto

Sakana AI выпустила Fugu-Cyber: оркестратор для кибербезопасности с результатами выше GPT-5.5

Sakana AI представила специализированную модель Fugu-Cyber, которая демонстрирует 86.9% успеха на бенчмарке CyberGym, превосходя аналоги от OpenAI и Anthropic. Это не новая базовая модель, а оркестратор, управляющий агентами.

Баннер новости 4403

Что такое Fugu-Cyber и как это работает

Sakana AI выпустила Fugu-Cyber (версия v1.0) — специализированный эндпоинт в рамках своей экосистемы Fugu. Важно понимать: это не новая базовая языковая модель, а оркестратор, который динамически строит агентный каркас и делегирует задачи специализированным моделям из пула. Архитектура базируется на принципах, описанных в отчетах TRINITY и The Conductor (ICLR 2026), где роли разделены на Thinker, Worker и Verifier. В контексте кибербезопасности ключевую роль играет Verifier: кандидат на уязвимость проверяется специализированными под-агентами до предложения патча.

Результаты на бенчмарках: цифры и сравнения

Sakana AI сообщает о высоких показателях на двух ключевых тестах, которые покрывают разные этапы кибержизненного цикла: поиск уязвимостей и создание правил обнаружения. Результаты Sakana сопоставимы или превышают показатели «фронтендовых» моделей от OpenAI и Anthropic.

Бенчмарк Что измеряет Результат Fugu-Cyber Сравнение с конкурентами
CyberGym (UC Berkeley) Поиск уязвимостей: написание PoC-кода для 1507 реальных багов в OSS-Fuzz 86.9% Выше GPT-5.5-Cyber (85.6%) и Claude Mythos Preview (83.1%)
CTI-REALM (Microsoft) Обнаружение угроз: маппинг MITRE ATT&CK, написание KQL/Sigma правил по 37 отчетам 72.1% Выше топ-3 конфигураций Claude (диапазон 62.4%–68.5%)

Стоит отметить, что на CyberGym преимущество Sakana незначительно (всего ~1.3% выше GPT-5.5-Cyber), но на CTI-REALM разрыв с лучшими результатами Anthropic более существенен. Однако эти данные являются самоотчетными и еще не прошли независимую репликацию.

Доступ, цены и ограничения

Модель доступна через API, но с рядом строгих ограничений. Доступ к Fugu-Cyber требует ручной проверки заявки (application form) и соблюдения политики приемлемого использования (AUP), запрещающей наступательное использование. Весовые коэффициенты модели не открыты.

Тарификация фиксирована и включает 20% премию по сравнению с базовой моделью Fugu-Ultra:

  • Входные токены: $6 за 1 млн (в кэше: $0.60 за 1 млн).
  • Выходные токены: $36 за 1 млн.
  • Контекст: При превышении 272K токенов все цены удваиваются.

Важное географическое ограничение: API недоступен в странах ЕС и ЕЭЗ до достижения соответствия GDPR. Подписка доступна только по плану Token Plan (тарифы $20, $100, $200).

Почему это важно

Запуск Fugu-Cyber 21 июля 2026 года сигнализирует о сдвиге в парадигме AI-безопасности: от использования «умных» чат-ботов к сложным многоагентным системам, где верификация решений критична. Sakana позиционирует это как решение для защитников (defensive use), подчеркивая, что комбинация мощного API и человеческой экспертизы превосходит использование API в одиночку.

Бенчмарки

БенчмаркFugu-CyberClaude Mythos PreviewGPT-5.5-Cyber
CyberGym86.9%83.1%85.6%

Жирным — лучший результат в строке. Источник цифр — официальная публикация.

Источник: MarkTechPost ↗