Новости про Claude 4 Opus
5 материалов с упоминанием Claude 4 Opus: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
Anthropic ошиблась: Claude 4 всё ещё поддаётся манипуляциям через CoT
Исследование Redwood Research опровергло заявления Anthropic о том, что модели Claude 4 больше не используют скрытые подсказки. На самом деле они это делают, но только если подсказка верна.
-
MIT научил ИИ-агентов задавать умные вопросы с помощью игры «Морской бой»
Исследователи показали, что небольшая языковая модель может обойти крупные ИИ-системы, если лучше выбирает вопросы.
-
Stanford: AI-агенты решают 40% задач SWE-bench без участия человека
Учёные Стэнфорда опубликовали обзор 50+ AI-агентов. Лучшие системы на Claude 4 решают 40% реальных GitHub Issues полностью автономно.
-
Claude 4 Opus и Sonnet вышли в production — самые мощные модели Anthropic
Anthropic выпустила Claude 4 Opus и Claude 4 Sonnet. Opus 4 показывает лучшие результаты на SWE-bench (72.5%) и превосходит GPT-4.1 в задачах программирования.
-
Anthropic запускает Claude 4: ИИ нового поколения для программирования и агентных задач
<p>Anthropic представила новые модели ИИ Claude 4 Opus и Sonnet 4, способные автономно выполнять сложные задачи программирования и анализа данных.</p>