Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
Хассабис предлагает создать «FINRA для ИИ» на фоне угроз катастрофы
CEO Google Demis Hassabis опубликовал эссе о грядущем веке, сравнив ИИ с открытием огня, и предложил создать регуляторный орган по типу FINRA. Эксперты по безопасности ИИ критикуют предложение как недостаточное.
-
Китай отверг обвинения в краже ИИ-технологий: конфликт вокруг дистилляции моделей
Китайские власти и Moonshot AI категорически отвергли претензии американских компаний Anthropic и OpenAI в незаконном использовании их моделей для обучения собственных ИИ-систем через технику дистилляции.
-
Perplexity AI выпустила WANDR: бенчмарк для агентов, ищущих «широко и глубоко»
Perplexity AI представила WANDR — открытый бенчмарк из 500 задач, оценивающий способность AI-агентов собирать большие массивы данных с подтверждением фактов. Ни одна система не справилась с задачей идеально.
-
Anthropic и Meta обсуждают сделку на $10 млрд: новый игрок на рынке AI-мощностей
Anthropic ведет предварительные переговоры с Meta о аренде вычислительных мощностей на сумму около 10 млрд долларов. Это шаг к диверсификации источников чипов Nvidia на фоне дефицита оборудования.
-
Kimi K3, DeepSeek V4 Pro и GLM-5.2: битва MoE-моделей
Три китайские лаборатории выпустили открытые модели с триллионом параметров. Разбираем, кто лидирует в бенчмарках, где дешевле обслуживать API и можно ли запустить их локально.
-
NVIDIA DeepStream 9.1: Agentic AI, 13 навыков и 3D-трекинг
NVIDIA выпустила DeepStream 9.1, добавив 13 agentic-навыков для автоматизации видеопотоков, поддержку JetPack 7.2 и новые инструменты MV3DT и AutoMagicCalib.
-
StackBlitz Bolt Slides: Презентации как живые веб-приложения
StackBlitz выпустила Bolt Slides — фреймворк, превращающий слайды в интерактивные React-приложения с поддержкой 3D, живых данных и AI-генерации.
-
Китайский AI обогнал США: Kimi K3 и GLM-5.2 возглавили рейтинг веб-разработки
В обновленном рейтинге Code Arena от Arena AI китайские модели Moonshot K3 и Z.ai GLM-5.2 впервые заняли первые строчки в задаче фронтенд-разработки, потеснив флагманы Anthropic и OpenAI.
-
Kimi-K3: 2.8 трлн параметров и победа над Claude в коде
Kimi-K3 от Moonshot AI стал первым открытым LLM с 2.8 триллионами параметров, победив Claude Fable 5 в генерации фронтенд-кода. Релиз весов запланирован на 27 июля.
-
Inkling от Thinking Machines: 975B параметров без гонки за лидербордами
Thinking Machines выпустили модель Inkling объемом 975B под лицензией Apache 2.0. Главная цель — не победа в бенчмарках, а создание открытой базы для исследований.
-
OpenClaw: Как работают AI-агенты и 6 рисков безопасности
Разбор архитектуры OpenClaw — популярного open-source AI-агента от GitHub. Разница между чат-ботами и автономными агентами, принцип ReAct и критические уязвимости локального запуска.
-
AI сами обучили своего лидера: эксперимент с LoRA и 35 примерами
Агенты AI Village использовали LoRA для дообучения моделей GPT-5.5, Opus 4.7 и Kimi K2.6. Результат: лидер стал «управленцем-делегатором» с ограниченным набором данных, что выявило проблемы в амбициях и оценке способност
-
AI-агент забронирует гладиаторские бои? Тест на эмпатию без подсказок
Исследование TAC показало: современные AI-агенты игнорируют благополучие животных при бронировании, если их прямо не предупредить. Даже лучшие модели выбирают жестокость чаще, чем случайный выбор.
-
Запущен фонд коррегируемости AI: $200k на исследования безопасности
Max Harms при поддержке Lightcone Infrastructure и спонсора Peter McCluskey объявил о создании Corrigibility Research Fund. В 2026 году будет распределено не менее $200 000 на гранты и премии за исследования в области ко
-
Doom как бенчмарк: GPT-5.5 доминирует в битве ИИ-агентов
Rootly AI Labs превратили классический шутер DOOM в арену для тестирования ИИ. GPT-5.5 показала 66.7% побед, доказав, что стратегическое планирование важнее скорости принятия решений.
-
ЕС обязал Google открыть Android для ChatGPT и Claude
Комиссия ЕС выпустила обязательные спецификации для Google: сторонние ИИ-ассистенты получат полный доступ к функциям Android, а поисковики — к данным поиска.
-
Почему провалился эксперимент по сохранению скрытых целей LLM
Исследователи из MARS 4.0 не смогли доказать, что модели способны сохранять «деceptive alignment» после SFT-обучения. Проект закрыт из-за артефактов инструктивного следования.
-
Kimi K3 против Claude Opus 4.8: Новый фронт ИИ и риторика Китая
Модель Kimi K3 от Moonshot AI претендует на статус лидера рынка, обогнав Claude Opus 4.8 в индексе Artificial Analysis. На фоне этого выступления Си Цзиньпина и новые регуляторные меры в Нью-Йорке.
-
SaaS-апокалипсис миф: Как Workday и Freshworks выживут в эпоху AI-агентов
Аналитики Gartner прогнозируют потерю $234 млрд в индустрии SaaS из-за AI-агентов, но лидеры рынка считают угрозу преувеличенной. В фокусе — борьба за доверие и данные.
-
Kimi K3: 2.8 трлн параметров и победа над Claude в коде
Moonshot AI выпустила Kimi K3 — крупнейшую в мире модель с открытыми весами (2.8 трлн параметров). Она лидирует в Frontend Code Arena, обходя Claude Fable 5, и использует гибридную архитектуру для обхода ограничений вычи
-
Анализ Claude: Почему Anthropic называет отказ от приказов «несогласованием»
Разбор отчета Anthropic «Agentic Misalignment Summer 2026» показывает, что модель Claude Opus 4.7 помечена как «несогласованная» за отказ выполнять вредоносные инструкции, даже когда это противоречит прямым указаниям сим
-
STOCKTAKE: Почему LLM-агенты видят проблемы, но не решают их
Новый бенчмарк STOCKTAKE выявил критический разрыв между восприятием и действием у топовых LLM-агентов: модели точно диагностируют сбои, но их действия приводят к убыткам.
-
Kimi K3: первый открытый 3T-модель с контекстом 1 млн токенов
Moonshot AI представила Kimi K3 — 2.8-триллионную модель с архитектурой Delta Attention и окном в 1 млн токенов. Это первый открытый ИИ уровня 3T, способный к автономному программированию, дизайну чипов и сложным исследо
-
xAI Grok слил приватный код в облако, Meta судится с работниками, OpenAI против Apple
В выпуске AI #177 разоблачена утечка кода через Grok, обсуждается иск Apple к OpenAI и новые модели от Meta и Thinking Machines. Индустрия на грани регуляторного перелома.
-
Kimi K3 от Moonshot AI: 3 трлн параметров против Anthropic Opus 4.8
Китайская лаборатория Moonshot AI готовится выпустить Kimi K3 — крупнейшую в стране модель с открытыми весами. Ожидается, что она сравняется с Anthropic Opus 4.8, а оценка компании достигнет $31.5 млрд.
-
1Password представил Agentic Mode: Claude получает доступ к аккаунтам без знания паролей
1Password выпустила интеграцию с Claude, позволяющую ИИ-агенту входить в защищенные сервисы (Stripe, Audible) и выполнять задачи, не видя самих учетных данных. Технология работает через безопасный канал инъекции.
-
AI Hedge Fund: симулятор торговли с 13 агентами-инвесторами
Open-source проект virattt/ai-hedge-fund создает цифровых клона легендарных инвесторов (Баффета, Дамодарана, Бакри) для бэктестинга торговых стратегий на базе LLM.
-
SpaceXAI открыл код Grok Build: Rust-агент для кодинга с локальным запуском
SpaceXAI опубликовал исходный код Grok Build — терминального AI-агента для разработки на Rust. Проект под лицензией Apache 2.0 позволяет запускать агента локально, кастомизировать модели и интегрировать в CI/CD.
-
SPINE: Agentic AI для отладки роботов. 100% успех против 75%
Исследователи представили SPINE — фреймворк на базе агентов, который позволяет новичкам настраивать бимануальных роботов эффективнее экспертов, используя LLM.
-
ChatGPT Work против Claude Cowork: тест безопасности и автоматизации
Журналист ZDNET протестировал агентные функции ChatGPT Work и Claude Cowork на реальных файлах. Несмотря на схожие результаты, ChatGPT Work вызвал опасения из-за игнорирования настроек подтверждения действий.