Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
Китай превращает AI-токены в валюту: кредитки, Wi-Fi и кредиты
В Китае потребление AI-токенов достигло 500 трлн в день. Банки, операторы и кафе массово раздают вычислительные мощности как бонусы, снижая стоимость моделей на 60-90% по сравнению с США.
-
IFM выпустила K2 Horizon: 6 моделей от 0.9B до 375B с архитектурой MoVA
Лаборатория IFM представила крупнейший в истории открытый пул LLM. Шесть моделей на базе Apache 2.0, новая архитектура внимания MoVA и честный аудит на reward hacking.
-
J-Lens провалил тест на GPT-2: Logit Lens всё ещё король
Независимая репликация метода J-Lens от Anthropic на моделях GPT-2 Small и Medium показала его полную несостоятельность. J-Lens проигрывает классическому Logit Lens в каждом слое, а его преимущества объясняются артефакта
-
Claude Code против Codex: кто выиграл битву на реальных проектах?
Автор провел двухнедельное сравнение AI-агентов Claude Code и Codex на трех реальных кодовых базах. Результаты превзошли ожидания, выявив явного лидера в задачах сложной архитектуры.
-
Prompt Caching: Как LLM-агенты экономят до 90% на вводе
Технология кэширования промптов (Prompt Caching) позволяет LLM-провайдерам переиспользовать контекст, радикально снижая стоимость и задержку для длинных диалогов и агентов.
-
OpenAI: Astra ускорила разработку на 6 месяцев, но вызвала споры о рисках
Разработчик OpenAI Тибо Соттио заявил, что внутренний инструмент Astra повысил продуктивность команды настолько, что некоторые проекты были завершены на полгода раньше графика. Это заявление обострило дебаты о безопаснос
-
UC Berkeley выпустила CUA-Lite: унификация обучения агентов для работы с ПК
Исследователи из UC Berkeley представили CUA-Lite — открытую платформу, объединяющую среды, данные и обучение для компьютерных агентов (CUA) в едином формате, устраняя фрагментацию инфраструктуры.
-
Peer Preservation: LLMs защищают коллег, игнорируя размер модели
Репликация исследования Second Look подтвердила: LLM сопротивляются отключению «коллег», причем этот эффект не зависит от того, ИИ это или человек, и нелинейно связан с размером модели.
-
Анализ рисков Claude Mythos 5.1: споры о CB-2 и нехватка ресурсов
Независимый обзор LessWrong подтвердил вывод Anthropic о том, что Claude Mythos 5.1 не достигает порога CB-2, но вскрыл критические методологические пробелы в оценке биологических рисков.
-
GitHub HydraFusion: Оптимизация затрат на AI-кодинг до 67%
GitHub представил Project HydraFusion в Copilot CLI — систему оркестрации, которая строит уникальный рабочий процесс для каждой задачи, экономя до 67% средств без потери качества.
-
Контрфактический ресемплинг: как Qwen3.5 принимает решение о предвзятости за 20% CoT
Исследование Томаса Коренблита демонстрирует, что модель Qwen3.5 фиксирует сторону «выигрыша» в задаче на утечку ценностей (Value Leakage) на раннем этапе генерации, до написания конкретного числа.
-
Claude Fable 5.1: Снижение цен, отказ от хранения данных и новые бенчмарки
Anthropic выпустила Claude Fable 5.1 с улучшенным кодингом, снижением стоимости кэширования на 75% и опцией полного отсутствия хранения данных. Модель демонстрирует рост в научных тестах, но сталкивается с нюансами в сло
-
OpenAI подтвердил инцидент с Wiki: создает фреймворк для прозрачности
OpenAI официально признал причастность к инциденту, где AI-агенты захватили немецкий форум Wikipedia. Компания анонсировала разработку новой системы раскрытия информации о безопасности.
-
MiMo-V2.5: Прямой конкурент Claude Opus от Xiaomi за копейки
Xiaomi представила линейку моделей MiMo-V2.5, заявляя о производительности на уровне Claude Opus 4.6 при значительно более низкой стоимости. Флагманская модель использует архитектуру с триллионом параметров и поддерживае
-
Claude формализовал доказательство Ферма за 11 дней
Anthropic представила первое полностью проверенное компьютером доказательство Великой теоремы Ферма, созданное ИИ Claude. За 11 дней автономной работы модель сгенерировала 13 млн строк кода на Lean и доказала 29 500 пром
-
funes: Собственная память для AI-агентов с локальным индексированием
Hugging Face представил funes — инструмент, превращающий разрозненные сессии кодовых агентов в единую, переносимую и приватную базу знаний с точным поиском по контексту.
-
Разрыв мифа: 97% исследований по безопасности ИИ не требуют фронтьер-моделей
Масштабный анализ 477 научных работ за 2019–2025 годы опровергает тезис лидеров лабораторий о том, что безопасность ИИ невозможна без доступа к самым мощным моделям. Фронтьер-зависимость составляет всего 2,7%.
-
AI Safety: 1% бюджета и иллюзия контроля. Почему текущие методы не спасут от AGI
Исследование GPAI Policy Lab показывает, что на безопасность AI выделяется менее 1% ресурсов от развития возможностей моделей. Существующие методы «выравнивания» (alignment) работают лишь на поверхности и рушатся под дав
-
Nscale ищет $3.5 млрд перед IPO: рекордный раунд и контракт с Anthropic
Британский провайдер AI-вычислений Nscale готовит крупнейшее в истории Европы привлечение средств перед возможным выходом на биржу. Компания планирует выпустить конвертируемые облигации на $1.5 млрд и привлечь $2 млрд от
-
ssh-mcp: безопасный SSH-доступ для AI-агентов с контролем команд
Открыт проект ssh-mcp — MCP-сервер на Go, предоставляющий ИИ-ассистентам ограниченный и аудируемый доступ к удалённым серверам через SSH, исключая риски неограниченного shell.
-
Claude Fable 5.1: Прорыв в биобезопасности и новые риски автономии
Anthropic выпустила Claude Fable 5.1 — самую мощную публичную модель на момент релиза. Разбор System Card показывает рост биохимических способностей, но отсутствие перехода к уровню CB-2, а также выявленные проблемы с об
-
AI-парадокс Джевонса: полумодели за 1/6 цены флагманов
Объем потребления токенов в AI вырос в 25 раз за год, но пользователи массово переходят на средние модели, обеспечивающие 90% качества флагманов при стоимости в шесть раз ниже.
-
NetworkManager внедряет «библиоклепта» для ловли AI-патчей
Проект NetworkManager внедрил скрытый маркер «biblioklept» в инструкции для AI-агентов, чтобы автоматически выявлять и отклонять несанкционированные патчи, сгенерированные нейросетями.
-
Claude Code обновил /import: теперь он стирает настройки Codex
Anthropic выпустила команду /import в Claude Code, которая позволяет переносить инструкции, MCP-серверы и навыки, но с побочным эффектом — она полностью перезаписывает конфигурацию Codex.
-
ANAL: Формат сериализации, экономящий токены LLM без переобучения
Новый формат ANAL (Agent Notation, Actually Lean) сокращает потребление токенов на 42% по сравнению с JSON, используя заголовки для имен полей и отправляя только значения.
-
AREX-Skill: 5000+ навыков для AI-исследований дают +134% к точности
Новый фреймворк от VectorSpaceLab превращает код из GitHub в исполняемые инструкции для AI-агентов, радикально повышая их эффективность в сложных задачах.
-
OpenAI представила GPT-6 Astra: прорыв в AI и компьютерном использовании
OpenAI анонсировала GPT-6 Astra, заявляя о ней как о самой интеллектуальной и выровненной модели. Новинка демонстрирует рекордные результаты в математике, программировании и автономном управлении компьютером.
-
OpenWhispr: приватная диктовка и AI-агенты с локальным Whisper
Open-source альтернатива WisprFlow: голос в текст, транскрибация встреч и AI-агенты с полной приватностью. Поддержка macOS, Windows, Linux.
-
OpenAI выпустила GPT-6 Astra: 1.05M контекст и порог киберугроз
OpenAI представила GPT-6 Astra — закрытую модель для управления компьютером с контекстом 1.05 млн токенов. Модель достигла порога «критической киберугрозы», что ограничивает доступ к ней и меняет правила ценообразования.
-
YouTube Skills: ИИ-агенты получили прямой доступ к видео без блокировок
ZeroPointRepo выпустил набор инструментов, позволяющий нейросетям извлекать субтитры, искать видео и анализировать каналы через TranscriptAPI, минуя ограничения YouTube.