Ключевые характеристики и доступность
Claude Haiku 5.5 официально вышла в статусе General Availability (GA) на всех основных платформах: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Это первая модель класса Haiku, оснащенная настройкой Adaptive Thinking (адаптивного мышления) с параметром effort, который по умолчанию установлен на medium. Модель принимает текст и изображения, выдает текст, а срез знаний зафиксирован на июне 2026 года.
Важно отметить технические нюансы миграции: новый токенизатор считает тот же текст примерно на 30% больше токенов, чем Haiku 4.5. Кроме того, использование нестандартных значений параметров temperature, top_p или top_k вернет ошибку 400. Для пакетной обработки (batch jobs) в бета-режиме доступен вывод до 300K токенов.
Ценообразование: двухуровневая структура
Anthropic внедрила двухуровневую тарификацию, зависящую от длины промпта. Для запросов до 100K токенов цена составляет $0.10 за миллион входных токенов и $0.50 за выходные. Это на 90% дешевле, чем у предшественника Haiku 4.5. При превышении порога в 100K токенов тарифы возрастают до $0.50 (ввод) и $2.50 (вывод). Anthropic оценивает, что с учетом нового токенизатора средняя стоимость запросов снизится на 75%, а использование пакетной обработки добавит еще 50% экономии.
Бенчмарки: сравнение с Luna и предыдущей версией
Модель демонстрирует значительный скачок в производительности по сравнению с Haiku 4.5, хотя и уступает флагману Sonnet 5.5. Ниже приведены результаты, заявленные Anthropic:
| Бенчмарк | Claude Haiku 5.5 | GPT-6 Luna | Claude Haiku 4.5 |
|---|---|---|---|
| OSWorld 2.1 (offline) | 72.4% | 48.9% | 15.7% |
| Terminal-Bench 4.0 | 39.2% | 16.4% | 0.0% |
| FrontierCode 1.1 (Main) | 46.4% | 42.4% | — |
| Humanity’s Last Exam (без инструментов) | 45.9% | — | — |
| GDPval-AA v2.1 | 1620 | 1437 | 735 |
Сравнение с конкурентами
В сегменте малых моделей Haiku 5.5 конкурирует с GPT-6 Luna и Gemini 3.5 Flash-Lite. Ключевое отличие Haiku 5.5 от GPT-6 Luna заключается в пороге удорожания: у OpenAI тарифы растут только после 272K токенов, тогда как у Anthropic — после 100K. Однако базовые цены на коротких промптах идентичны. Gemini 3.5 Flash-Lite значительно дороже ($0.30/$2.50) и имеет меньший максимальный вывод (65K токенов против 128K у Haiku).
Сценарии использования
Anthropic позиционирует Haiku 5.5 не как самостоятельного разработчика кода, а как «рабочую лошадку» для агентов. Основные сценарии:
- Субагенты (Subagents): Выполнение специфических задач под управлением более мощных моделей (Opus 5.5 или Sonnet 5.5). Пример: извлечение финансовых данных из 10-K отчетов для построения презентаций.
- Обработка документов: Высоконагруженное Q&A и суммаризация. Компания AlphaSense протестировала модель на функции, обрабатывающей около 8 млн запросов в неделю.
- Скоростные задачи: Живая поддержка клиентов и управление браузером (browser use), где критична низкая задержка.
Бенчмарки
| Бенчмарк | Claude Haiku 5.5 | Claude Haiku 5.5 (with tools) | Claude Haiku 5.5 (without tools) | Claude Haiku 4.5 | GPT-6 Luna |
|---|---|---|---|---|---|
| OSWorld 2.1 (offline subset) | 72.4% | — | — | 15.7% | 48.9% |
| Terminal-Bench 4.0 | 39.2% | — | — | 0% | 16.4% |
| FrontierCode 1.1 (Main) | 46.4% | — | — | — | 42.4% |
| Humanity’s Last Exam | — | 57.4% | 45.9% | — | — |
| GDPval-AA v2.1 | 1620score | — | — | 735score | 1437score |
Жирным — лучший результат в строке. Источник цифр — официальная публикация.
Источник: MarkTechPost ↗
