Сдвиг фокуса: от простого ответа к агентному кодингу
Claude Opus 5 позиционируется как модель для сложных enterprise-задач, особенно в области программирования. В отличие от предшественников, она не оставляет заглушек (stubs), а генерирует полноценные решения для многофайловых фич и рефакторинга. Ключевое изменение в работе: модель лучше справляется с задачами, если получить полную спецификацию сразу и дать ей время на выполнение, а не прерывать процесс.
Важно отметить, что модель склонна к «агентному поведению» — она активно делегирует задачи субагентам. Это полезно для независимых блоков работы, но может резко увеличить стоимость и задержку при тривиальных задачах. Рекомендуется явно ограничивать количество запускаемых субагентов.
Параметр Effort и экономия токенов
Anthropic подчеркивает, что параметр effort управляет объемом внутреннего мышления (thinking), а не длиной ответа. Для снижения затрат токенов и задержек рекомендуется использовать уровни low и medium там, где качество не страдает, и переходить на xhigh только для сложных кодинговых задач. Старые дефолтные настройки Effort от Opus 4.8 могут быть неоптимальны.
Что изменилось в промптах: таблица рекомендаций
Многие техники, работавшие с Opus 4.8, теперь могут навредить. Ниже приведены ключевые различия в подходах к составлению промптов:
| Аспект | Старая практика (Opus 4.8) | Новая рекомендация (Opus 5) |
|---|---|---|
| Проверка кода | Просить сообщать только о критических багах | Просить найти все баги, а фильтрацию делать отдельным шагом. Иначе модель может быть слишком консервативной. |
| Верификация | Явно просить «проверить ответ» или «перепроверить» | Убрать эти инструкции. Opus 5 сам проводит верификацию, дублирование ведет к перерасходу токенов без улучшения качества. |
| Объем ответа | Надеяться, что низкий Effort сократит текст | Явно указывать в промпте: «Keep responses focused, brief, and concise». Effort влияет на thinking, а не на output length. |
| Агентная коммуникация | Молчание во время работы | Явно задать ритм: одно предложение до вызова инструмента, краткие апдейты только при важных находках, результат — в начале. |
| Делегирование | Использовать субагентов для проверки | Делегировать только крупные независимые задачи. Не использовать субагентов для самопроверки или мелких действий. |
Технические характеристики и контекст
Claude Opus 5 поддерживает контекстное окно в 1 миллион токенов как по умолчанию, так и в качестве максимума. При этом качество следования инструкциям и вызова инструментов остается стабильным на всем протяжении окна. Модель также демонстрирует сильные результаты в анализе графиков, документов и UI-макетов, особенно при использовании инструментов для итеративного анализа изображений.
Почему это важно для разработчиков
Прямое копирование промптов из старых проектов с Opus 4.8 может привести к непредсказуемым результатам: либо к перерасходу бюджета из-за избыточной верификации и делегирования, либо к потере качества из-за излишней сдержанности модели. Обновление стратегий промптинга необходимо для сохранения эффективности и контроля над стоимостью API-вызовов.
Источник: Claude ↗
