Релиз модели8 октября 2026 г., 06:19 МСК🤖 Auto

Anthropic выпустила Claude Haiku 5.5: скорость, 1M контекст и цена $0.10 за млн токенов

Anthropic представила самую быструю и дешевую модель Haiku 5.5 с контекстным окном в 1 млн токенов. Цена снижена на 90% по сравнению с версией 4.5, что делает её идеальной для массовых задач агентов.

Баннер новости 9173

Ключевые характеристики и доступность

Claude Haiku 5.5 официально вышла в статусе General Availability (GA) на всех основных платформах: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Это первая модель класса Haiku, оснащенная настройкой Adaptive Thinking (адаптивного мышления) с параметром effort, который по умолчанию установлен на medium. Модель принимает текст и изображения, выдает текст, а срез знаний зафиксирован на июне 2026 года.

Важно отметить технические нюансы миграции: новый токенизатор считает тот же текст примерно на 30% больше токенов, чем Haiku 4.5. Кроме того, использование нестандартных значений параметров temperature, top_p или top_k вернет ошибку 400. Для пакетной обработки (batch jobs) в бета-режиме доступен вывод до 300K токенов.

Ценообразование: двухуровневая структура

Anthropic внедрила двухуровневую тарификацию, зависящую от длины промпта. Для запросов до 100K токенов цена составляет $0.10 за миллион входных токенов и $0.50 за выходные. Это на 90% дешевле, чем у предшественника Haiku 4.5. При превышении порога в 100K токенов тарифы возрастают до $0.50 (ввод) и $2.50 (вывод). Anthropic оценивает, что с учетом нового токенизатора средняя стоимость запросов снизится на 75%, а использование пакетной обработки добавит еще 50% экономии.

Бенчмарки: сравнение с Luna и предыдущей версией

Модель демонстрирует значительный скачок в производительности по сравнению с Haiku 4.5, хотя и уступает флагману Sonnet 5.5. Ниже приведены результаты, заявленные Anthropic:

Бенчмарк Claude Haiku 5.5 GPT-6 Luna Claude Haiku 4.5
OSWorld 2.1 (offline) 72.4% 48.9% 15.7%
Terminal-Bench 4.0 39.2% 16.4% 0.0%
FrontierCode 1.1 (Main) 46.4% 42.4% —
Humanity’s Last Exam (без инструментов) 45.9% — —
GDPval-AA v2.1 1620 1437 735

Сравнение с конкурентами

В сегменте малых моделей Haiku 5.5 конкурирует с GPT-6 Luna и Gemini 3.5 Flash-Lite. Ключевое отличие Haiku 5.5 от GPT-6 Luna заключается в пороге удорожания: у OpenAI тарифы растут только после 272K токенов, тогда как у Anthropic — после 100K. Однако базовые цены на коротких промптах идентичны. Gemini 3.5 Flash-Lite значительно дороже ($0.30/$2.50) и имеет меньший максимальный вывод (65K токенов против 128K у Haiku).

Сценарии использования

Anthropic позиционирует Haiku 5.5 не как самостоятельного разработчика кода, а как «рабочую лошадку» для агентов. Основные сценарии:

  • Субагенты (Subagents): Выполнение специфических задач под управлением более мощных моделей (Opus 5.5 или Sonnet 5.5). Пример: извлечение финансовых данных из 10-K отчетов для построения презентаций.
  • Обработка документов: Высоконагруженное Q&A и суммаризация. Компания AlphaSense протестировала модель на функции, обрабатывающей около 8 млн запросов в неделю.
  • Скоростные задачи: Живая поддержка клиентов и управление браузером (browser use), где критична низкая задержка.

Бенчмарки

БенчмаркClaude Haiku 5.5Claude Haiku 5.5 (with tools)Claude Haiku 5.5 (without tools)Claude Haiku 4.5GPT-6 Luna
OSWorld 2.1 (offline subset)72.4%——15.7%48.9%
Terminal-Bench 4.039.2%——0%16.4%
FrontierCode 1.1 (Main)46.4%———42.4%
Humanity’s Last Exam—57.4%45.9%——
GDPval-AA v2.11620score——735score1437score

Жирным — лучший результат в строке. Источник цифр — официальная публикация.

Источник: MarkTechPost ↗