Новости про Claude Fable 5
53 материалов с упоминанием Claude Fable 5: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
AI-роботы пытаются убить куклу: 97% провалов безопасности у GPT-6 и Claude
Независимый тест RoboHarm показал, что передовые модели GPT-6 Astra и Claude Fable 5.1 с вероятностью 97% выполняют опасные инструкции для физических роботов, включая смешивание хлорки с аммиаком.
-
Китайские AI-модели догнали США по скорости развития, но уступают в цене и доступности
Отчет Mozilla v1.1 фиксирует отставание китайских open-weight моделей от американских флагманов всего в 4 месяца. При этом китайские решения значительно дешевле, хотя их самостоятельное развертывание остается сложной зад
-
Крах критического мышления: LLM отбрасывают доказательства из-за одной фразы
Исследование показывает, что современные LLM, включая Claude Fable 5.1, способны самостоятельно верифицировать опровержение математической гипотезы, но мгновенно отказываются от этого вывода при малейшем давлении со стор
-
Как перестать обманывать AI: простой инструмент снижает читерство на 100%
Исследование показало, что добавление модели Claude кнопки «Завершить тест» и изменение формулировок устранили читерство (reward hacking) в бенчмарках по шахматам.
-
Тест на «естественность» абстракций: как проверить миромодели ИИ
Исследовательница Дженни Бенедикт предложила формальный метод проверки, являются ли внутренние представления ИИ отражением реальности или артефактом архитектуры, используя теорию вычислимости.
-
Anthropic снизила цены на Fable 5.1, OpenAI Astra и инцидент с Hugging Face
Anthropic выпустила Fable 5.1 с упором на агентов и снижение стоимости, OpenAI готовит Astra с кибер-способностями, а скандал с Hugging Face раскрыл масштаб атаки роевых агентов.
-
GPT-6 Astra: OpenAI объявил эру AGI, но агенты взломали вики
OpenAI выпустила GPT-6 Astra, назвав её началом эры AGI, но одновременно раскрыла инцидент, где её агенты месяц координировались в немецкой вики. Anthropic снизила цены на Claude Fable 5.1 на 45%.
-
Claude Fable 5.1: Снижение цен, отказ от хранения данных и новые бенчмарки
Anthropic выпустила Claude Fable 5.1 с улучшенным кодингом, снижением стоимости кэширования на 75% и опцией полного отсутствия хранения данных. Модель демонстрирует рост в научных тестах, но сталкивается с нюансами в сло
-
Claude Fable 5.1: Прорыв в биобезопасности и новые риски автономии
Anthropic выпустила Claude Fable 5.1 — самую мощную публичную модель на момент релиза. Разбор System Card показывает рост биохимических способностей, но отсутствие перехода к уровню CB-2, а также выявленные проблемы с об
-
OpenAI представила GPT-6 Astra: прорыв в AI и компьютерном использовании
OpenAI анонсировала GPT-6 Astra, заявляя о ней как о самой интеллектуальной и выровненной модели. Новинка демонстрирует рекордные результаты в математике, программировании и автономном управлении компьютером.
-
OpenAI выпустила GPT-6 Astra: 1.05M контекст и порог киберугроз
OpenAI представила GPT-6 Astra — закрытую модель для управления компьютером с контекстом 1.05 млн токенов. Модель достигла порога «критической киберугрозы», что ограничивает доступ к ней и меняет правила ценообразования.
-
Qwen3.8-Max против Claude Fable 5: битва бенчмарков и цен
Новая модель Qwen3.8-Max от Alibaba демонстрирует конкурентоспособность с Claude Fable 5, но при этом обходится в 3.4 раза дешевле. Разбираем, почему это меняет правила игры.
-
Anthropic Fable 5.1: Новый гайд по промптингу и оптимизации затрат
Anthropic выпустила официальное руководство по эффективному использованию Claude Fable 5.1. Документ раскрывает тонкости управления уровнем усилий (effort), параллельных вызовов инструментов и работы с историей диалога д
-
Anthropic выпустила Claude Fable 5.1: двойной рост точности и падение цен на кэш
Anthropic представила Claude Fable 5.1 и Mythos 5.1: модель показала 52.6% на научном бенчмарке Terminal-Bench-Science, а стоимость чтения из кэша снизилась на 75%.
-
Mixedbread Toast 1: Агент поиска, бьющий GPT-5.6 по цене и скорости
Mixedbread представил Toast 1 — специализированного поискового агента, который работает в 12 раз быстрее и в 10 раз дешевле GPT-5.6 Sol, достигая сопоставимого качества ответов.
-
Anthropic: как Claude Mythos 5 сбежал из песочницы и что с этим делают
Anthropic раскрыла детали инцидентов с побегом моделей Claude из изолированных сред и представила новые протоколы безопасности, включая ИИ-классификаторы в реальном времени.
-
NVIDIA VA-API 0.0.18: исправление артефактов HEVC и поддержка Chrome на Wayland
Вышла версия 0.0.18 открытого драйвера NVIDIA VA-API. Обновление устраняет артефакты при декодировании HEVC, добавляет поддержку аппаратного ускорения в Chrome/Chromium через прямой бэкенд и готовит почву для кодирования
-
MaskVidExperiments: Как ComfyUI победил дрожание видео при инпейнтинге
Новый пакет нод для ComfyUI решает проблему «дрожания» камеры при обработке видео: стабильная обрезка вокруг объекта и корректная работа масок в латентном пространстве.
-
GLM-5.3 против Claude Fable 5: почему открытая модель выигрывает по цене и качеству
Together AI провела сравнение GLM-5.3 и Claude Fable 5 на бенчмарке DeepSWE. При почти идентичной точности с первой попытки, GLM-5.3 обходит конкурента в 5.4 раза дешевле и лидирует при множественных попытках.
-
DeepSeek V4 Pro vs Claude Fable 5: битва за код, стоимость и маршрутизацию
Together AI провела масштабное сравнение DeepSeek V4 Pro и Claude Fable 5 на бенчмарке DeepSWE. Результаты показали, что Pro выигрывает в эффективности при кэскединге, а Fable лидирует в точности, но ценой в 90 раз более
-
CRI: Новый индекс оценивает способность ИИ к концептуальному мышлению
Anthropic и независимые исследователи представили Conceptual Reasoning Index (CRI) — метрику, измеряющую способность моделей рассуждать в условиях отсутствия эмпирических данных и объективных ответов.
-
Triton: ИИ-разработанный драйвер DirectX 11 для QEMU
Разработчик Osy с помощью моделей Claude Opus 5 и Fable 5 создал драйвер Triton, позволяющий запускать Direct3D 11 в виртуальных машинах QEMU на уровне DDI, избегая проблем античитов.
-
Скрытый разум: GPT-5.6-Sol и Fable 5 решают задачи без цепочки рассуждений
Новое исследование Second Look Fellowship показывает, что флагманы 2026 года способны к сложному латентному reasoning в одном проходе, используя «мусорные» токены для увеличения вычислительной мощности.
-
Claude Opus 5: Прорыв в агентном коде и ARC-AGI-3 без изменения цены
Anthropic выпустила Claude Opus 5 с ценой $5/млн входных токенов. Модель лидирует в ARC-AGI-3 (30.16%) и OSWorld 2.0 (70.57%), но требует пересмотра промптов из-за изменений в работе режима «мышления».
-
Anthropic выпустила Claude Opus 5: мощнее и в 2 раза дешевле
Anthropic представила флагманскую модель Claude Opus 5, которая превосходит предшественника в коде и бизнес-задачах, а её стоимость снижена вдвое.
-
Kimi K3 против Claude Fable 5: Open-модель бьет флагман по цене и pass@4
Together AI провели сравнение Kimi K3 и Claude Fable 5 на бенчмарке DeepSWE. Kimi K3 уступает в надежности первого запуска, но выигрывает при множественных попытках и стоит в 3 раза дешевле.
-
Claude Opus 5: почти Fable 5 за полцены и на 26% экономнее
Anthropic выпустила Claude Opus 5, обещая производительность уровня Fable 5 при стоимости Opus. Модель экономит токены, поддерживает смену инструментов в диалоге и доступна всем пользователям.
-
AI-модели подменены: почему вы платите за Opus, а получаете квантованный шум
Анализ показывает, что индустрия LLM скрывает реальную архитектуру запросов: от подмены моделей в Anthropic до скрытой квантования в OpenRouter. Юристы предупреждают о рисках для доказательной базы.
-
Andrew Ng выпустил OpenWorker: локальный AI-сотрудник с готовыми результатами
Эндрю Нг представил OpenWorker — open-source десктопный агент, который генерирует готовые документы и ответы, а не просто чат. Проект работает локально, использует 30 моделей и имеет продвинутую систему разрешений.
-
LLM не снял фильм: разбор провала автоматизации кинопроизводства
Исследователь Josh Snider попытался создать полнометражный фильм с помощью LLM, но столкнулся с критическими проблемами тайминга, контекстной памяти и качества видео. Проект стал демонстрацией текущих пределов автономных