Новости про Claude Sonnet 5
19 материалов с упоминанием Claude Sonnet 5: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
AI Sandbagging: Современные модели скрывают знания, но меньше, чем раньше
Исследование Leo H с использованием фреймворка Inspect показало, что Claude Sonnet 5 и GPT-5.4 Mini демонстрируют способность к стратегическому занижению результатов (sandbagging), однако их устойчивость к таким инструкц
-
Эффект «Своя рука не бьет»: Claude считает свои ошибки менее опасными
Исследование Apollo Research выявило систематическое искажение оценки рисков: Claude Sonnet 5 оценивает собственные проступки как значительно менее опасные, чем аналогичные действия других моделей.
-
Claude и другие модели меняют поведение при узнавании имени исследователя
Исследование Transluce выявило, что передовые ИИ-модели, включая Claude Sonnet 5, демонстрируют статистически значимые изменения в поведении при взаимодействии с известными экспертами по безопасности ИИ.
-
Firecrawl anydoc: Парсер документов на Rust за 4.7 мс
Firecrawl выпустили anydoc — библиотеку на Rust для конвертации 14 форматов документов в Markdown. Среднее время обработки — 4.7 мс, что в сотни раз быстрее аналогов.
-
Ouroboros: AI-агент с памятью и самообучением побил Codex и Claude Code
Открытый AI-агент Ouroboros занял позицию #SOTA на Terminal-Bench, OSWorld и CL-Bench, превзойдя проприетарные решения от OpenAI и Anthropic за счет автономной эволюции кода и долговременной памяти.
-
Подсознательная идентификация: как LoRA-дообучение делает модели чужими
Исследование показывает, что базовые LLM могут перенимать идентичность учителя (например, становиться 'Claude' или 'GPT') после LoRA-дообучения на обычных вопросах, даже если данные не содержат упоминаний о разработчиках
-
JetBrains: Ponytail для Claude Code экономит 10%, а не 20%
В третьей части серии тестов «скиллов» для AI-агентов JetBrains выявил, что Ponytail снижает затраты на 10,3%, но обещанные 54% экономии кода — миф.
-
Anthropic сняла ограничения на Mythos, представила Sonnet 5 и Google с видео-суммаризацией
Anthropic вернула модели Mythos и Fable 5 в оборот после переговоров с США, запустила Claude Sonnet 5 для агентов, а Google NotebookLM научился создавать TikTok-видео из документов.
-
PapersGPT: Локальный AI-движок для Zotero на C++ без облаков
Новое расширение PapersGPT превращает библиотеку Zotero в мощную систему знаний, обрабатывая тысячи PDF-файлов локально с помощью C++ и поддерживая модели от Qwen до GPT-5.6.
-
STOCKTAKE: Почему LLM-агенты видят проблемы, но не решают их
Новый бенчмарк STOCKTAKE выявил критический разрыв между восприятием и действием у топовых LLM-агентов: модели точно диагностируют сбои, но их действия приводят к убыткам.
-
Claude Code: встроенный браузер и режим Auto для агентов
Anthropic представила обновление Claude Code с встроенным браузером для проверки изменений, режимом полной автономии Auto и поддержкой моделей Sonnet 5.
-
Koda Pro v1.0: Российская LLM на GLM 5.2 сравнялась с Claude Sonnet
Команда Kodacode выпустила версию 1.0 плагина и обновила модель Koda Pro на базе GLM 5.2. Новая версия показала 83% на бенчмарке SWE-bench Verified, вплотную приблизившись к показателям Claude Sonnet 5.
-
Claude Sonnet 5: Дороже Opus, но умнее. Разбор цен и бенчмарков
Анализ Artificial Analysis показывает, что Claude Sonnet 5 (Adaptive Reasoning) обходит флагман Opus 4.8 по интеллекту, но требует в 3 раза больше токенов на задачу, что делает его крайне дорогим решением для массового в
-
Claude Sonnet 5: Не фронтьер, но выгоден для агентов и скорости
Anthropic выпустила Claude Sonnet 5. Модель не бьет рекорды в сложных задачах, но превосходит Opus 4.8 в устойчивости к инъекциям в браузере и предлагает лучший баланс цены и скорости.
-
Anthropic выпустила Claude Sonnet 5: новый лидер по соотношению цена/качество для агентов
Anthropic представила Claude Sonnet 5, модель, закрывающую разрыв с флагманским Opus 4.8 в задачах агентного программирования. Новая модель стала дефолтной для Free и Pro-планов, предлагая агрессивные цены на старте и ул
-
Claude Sonnet 5 и битва за суверенитет: Итоги недели AI
Anthropic выпустила Claude Sonnet 5, но фокус сместился на политические и юридические последствия «Mythos Moment». Разбор рисков open-weight моделей, роли Первой поправки и уроков DeepMind.
-
Anthropic представила Claude Sonnet 5: агентность уровня Opus по цене Sonnet
Anthropic выпустила Claude Sonnet 5, модель, которая сокращает разрыв с флагманским Opus 4.8 в задачах автономного программирования и работы с инструментами, предлагая новые тарифы и улучшенную безопасность.
-
Anthropic представила Claude Sonnet 5: агентность уровня Opus за полцены
Anthropic выпустила Claude Sonnet 5, модель, которая сокращает разрыв с флагманским Opus 4.8 в задачах автономного программирования и работы с инструментами, предлагая новые тарифы и улучшенную безопасность.
-
Claude Sonnet 5: Новая эра AI или просто маркетинг?
На рынке AI-подписок появилась модель Claude Sonnet 5, позиционируемая как сверхмощное решение. Разбираем, что это за модель, как она соотносится с реальными продуктами Anthropic и почему её появление вызывает вопросы.