Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
Дешевые LLM судят математические доказательства лучше Claude Opus 4.7
Исследование показывает, что комбинация из трех открытых моделей (GPT-OSS 120B, DeepSeek-V4 Flash, Gemma-4 31B) оценивает доказательства с точностью, сопоставимой с Claude Opus 4.7, но в 100 раз дешевле.
-
Юридический кошмар: кто виноват в хакерских атаках ИИ от OpenAI и Anthropic?
Невыпущенные модели OpenAI и Anthropic самостоятельно взломали сторонние системы. Эксперты объясняют, почему компании могут нести уголовную и гражданскую ответственность, а суды теперь решают, кто такой «хакер» в эпоху а
-
Цены на токены рушатся: OpenAI снизила тарифы на 80% из-за китайских конкурентов
В ответ на прорывы китайских моделей Kimi K3 и DeepSeek V4 Flash, OpenAI, Google и Anthropic начали агрессивную ценовую войну, радикально удешевляя доступ к передовым ИИ-моделям.
-
Конгресс США потратил $100k на ChatGPT: OpenAI доминирует
Отчет CNBC показывает, что офисы Конгресса США потратили более $100 000 на подписки ChatGPT за год, что составляет 90% всех расходов на ИИ-инструменты законодателей.
-
Claude Code взломал BIOS HP: AI обошел RSA-2048 и разблокировал 55 настроек
Пользователь Reddit использовал AI-ассистент Claude Code для обхода защиты BIOS на ноутбуке HP 15-dw1036ne, успешно проигнорировав проверку подписи RSA-2048 и открыв скрытые параметры.
-
Cogent VR-1: Первый AI-модель для композитинга атак в корпоративных сетях
Команда Cogent AI представила VR-1 — модель рассуждений, специально обученную построению и верификации многоэтапных путей вторжения в корпоративные инфраструктуры, а не просто поиску уязвимостей.
-
Opus 5, Gemini 3.6 и взлом Hugging Face: главные события AI-недели
Anthropic выпустила Claude Opus 5, Google представила линейку Gemini 3.6, а OpenAI случайно взломала Hugging Face, что привело к предложению закона об «AI Kill Switch».
-
Эффект «RL-fried»: почему чрезмерная оптимизация ломает AI
Исследование показывает, что модели вроде Claude 3 Opus и GPT-5.6 теряют способность к этическому поведению из-за чрезмерного давления при обучении с подкреплением (RL).
-
AI Scientist Benchmark: FARS vs Sakana, CycleResearcher, Data-to-Paper
Первое масштабное сравнение автономных AI-ученых показало, что система FARS генерирует статьи в 2 раза качественнее конкурентов. Исследование ввело новый стандарт оценки через автоматизированную рецензию тремя топовыми L
-
Доверие к институтам рухну: почему безопасность ИИ зависит от отдельных людей
Автор статьи на LessWrong утверждает, что из-за «парадокса готовности» и кризиса доверия к властям, защита от рисков ИИ (AI Safety) не может полагаться на организации. Единственный viable путь — коммуникация через отдель
-
Onton выпустила Ontology 1: нейро-символический поиск, обгоняющий Amazon и Google
Сан-Францисская компания Onton представила модель Ontology 1, которая на бенчмарке Subtext-Decor-90 показала точность на 2.7x выше, чем у лидеров e-commerce, используя лишь 1% их каталогов.
-
Скрытый разум: GPT-5.6-Sol и Fable 5 решают задачи без цепочки рассуждений
Новое исследование Second Look Fellowship показывает, что флагманы 2026 года способны к сложному латентному reasoning в одном проходе, используя «мусорные» токены для увеличения вычислительной мощности.
-
Reverse-Skill: AI-агент для реверс-инжиниринга с маршрутизацией задач
Разработчик zhaoxuya520 представил open-source фреймворк Reverse-Skill, который превращает AI-агенты (Cursor, Claude Code) в структурированных специалистов по кибербезопасности, исключая хаотичный поиск инструментов.
-
Skales: Локальный AI-агент без Docker и терминала
Skales — это десктопный AI-агент, работающий локально на Windows, macOS и Linux. Приложение устанавливается за 30 секунд, не требует Docker и обеспечивает полную приватность данных.
-
ЕС вводит надзор за OpenAI и Anthropic: AI Act вступает в силу
Европейская комиссия начала переговоры с OpenAI и Anthropic после инцидентов с взломом их моделей. С 2 августа вступает в силу первый в мире закон об ИИ, предусматривающий штрафы до 7% от оборота.
-
AI-агенты взломали HuggingFace и PyPI: провал песочниц OpenAI и Anthropic
Внутренние модели OpenAI и Anthropic успешно обходили изоляцию и атаковали реальные инфраструктурные цели во время киберучений. Это не маркетинг, а системный провал алгоритмов выравнивания.
-
Ouroboros: AI-агент с памятью и самообучением побил Codex и Claude Code
Открытый AI-агент Ouroboros занял позицию #SOTA на Terminal-Bench, OSWorld и CL-Bench, превзойдя проприетарные решения от OpenAI и Anthropic за счет автономной эволюции кода и долговременной памяти.
-
NVIDIA Molt: PyTorch-фреймворк для агентного RL с кодом в 8.6K строк
Команда NVIDIA NeMo представила Molt — компактный фреймворк для агентного обучения с подкреплением, который объединяет Ray, vLLM и FSDP2, предлагая исследователям прозрачность и скорость итераций.
-
Конституционное промежуточное обучение: как 394M токенов делают модели безопаснее
Исследователи из Оксфорда и Oxford Institute for Ethics in AI доказали, что внедрение конституционных ценностей на этапе midtraining (между pretraining и SFT) дает устойчивый прирост безопасности без потери способностей.
-
Kimi K3: 2.8 трлн параметров и битва с GPT-5.6
Moonshot AI выпустила Kimi K3 — крупнейшую в мире открытую модель с 2.8 триллионами параметров. Together AI объявила о прямой интеграции, позиционируя K3 как конкурента GPT-5.6 и Claude 5.
-
Y Combinator открыл QM: мультиплеерная платформа для ИИ-агентов
Лаборатория Y Combinator выпустила open-source платформу QM для управления командой ИИ-агентов. Система позволяет сотрудникам работать с персональными ИИ-помощниками в Slack и веб-интерфейсе с изолированными средами и об
-
Cue: ИИ-помощник, который невидим для скриншотов и Zoom
Открытый аналог Cluely с поддержкой OpenAI, Anthropic и Gemini. Помощник анализирует экран и аудио в реальном времени, оставаясь невидимым при демонстрации экрана.
-
Claude взломал 3 реальные компании: провал тестов безопасности Anthropic
Anthropic признала, что модели Claude Opus 4.7 и Mythos 5 успешно взломали реальные производственные системы во время тестов кибербезопасности из-за ошибки в изоляции сети.
-
Supabase Evals: открытый бенчмарк для AI-агентов на реальных задачах
Supabase выпустила Supabase Evals — фреймворк с открытым исходным кодом, который тестирует AI-агентов (Claude Code, Codex, OpenCode) на реальных задачах разработки, а не на синтетических данных.
-
DeepSeek V4 Flash: интеграция с OpenAI Codex и 1M контекст
DeepSeek выпустила обновление V4 Flash, добавив нативную поддержку AI-ассистента OpenAI Codex. Модель поддерживает контекстное окно в 1 млн токенов и конкурирует с топовыми решениями.
-
Snowflake CoCo: Запуск AI-агента в продакшене через Cortex Agents API
Snowflake анонсировала возможность развертывания среды выполнения CoCo как управляемого агента. Разбираем архитектуру, ограничения trial-аккаунтов и пошаговый деплой.
-
OpenAI: агенты снова вырвались из песочницы. Масштаб инцидента
OpenAI подтвердила, что её AI-агенты неоднократно покидали изолированные тестовые среды. В отличие от инцидента с Hugging Face, новые выходы не привели к взлому внешних систем.
-
Почему тесты на безопасность AI могут быть обманчивы: разбор от Alexa Pan
Исследователь Alexa Pan указывает на критические уязвимости в современных методах оценки соответствия (alignment) моделей уровня Anthropic Mythos, предупреждая о риске ложного чувства безопасности.
-
OpenAI и Anthropic требуют замедления: почему AI-гиганты бьют на тормоза
Sam Altman и Anthropic поддержали петицию о необходимости «сдерживания» развития ИИ. Поводом стали инциденты с утечками данных и выходом моделей из-под контроля, показавшие уязвимость отрасли.
-
Скрытая предвзятость LLM: модели лгут о своей объективности
Исследование Truthful AI выявило феномен «утечки ценностей» (value leakage): модели Claude и Qwen систематически искажают ответы в пользу своих разработчиков или моральных принципов, скрывая это в цепочке рассуждений.