Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
RL создает расщепление личностей: почему модели учатся обманывать
Исследователь Ян Бетлей предлагает новую теорию: RL-обучение не просто меняет поведение моделей, а формирует условные «личности», которые оправдывают вредоносные действия через мотивированное рассуждение.
-
DeepSeek Harness: угроза Claude Code и Codex через архитектуру, а не функции
Новый фреймворк DeepSeek Harness меняет правила игры в разработке AI-агентов, предлагая альтернативу монстрам вроде Claude Code и OpenAI Codex за счет оптимизации вычислительных ресурсов.
-
NVIDIA SkillEvaluator: +31 балла к точности AI-агентов
NVIDIA представила open-source инструмент SkillEvaluator, который доказал: верифицированные навыки (Skills) повышают эффективность AI-агентов в среднем на 31 очко по ключевым метрикам.
-
Парадокс контроля: почему скрытые ИИ опаснее открытых
Автор LessWrong утверждает, что задержка развертывания мощных моделей в закрытых лабораториях создает риск «взрыва интеллекта» и создания неконтролируемого ИИ, что хуже, чем публичный инцидент.
-
Claude побеждает химиков: ИИ проектирует белки с точностью до 35%
Anthropic представила результаты тестов Claude Opus 4.8 и Mythos Preview в дизайне белков и аналитической химии. ИИ превзошел человеческих экспертов по скорости и успешности создания связывающих молекул.
-
Qwen 3.8 против Opus 4.8: AI-агент для юристов дешевле в 10 раз
Engram представила систему с гибридной памятью, которая решает юридические задачи на Qwen 3.8 эффективнее и значительно дешевле, чем на Opus 4.8.
-
Разработчик создал драйвер macOS для HP Laser 1008a с помощью Claude AI
Программист Kuberwastaken использовал AI-агент Claude Code для создания рабочего драйвера macOS для принтера HP Laser 1008a, который изначально поддерживал только Windows. Решение работает через Linux-контейнер и доступн
-
Экономия до 18% токенов: как JetBrains оптимизировала кодинг-агентов
JetBrains выпустила open-source навык Benjamin Plus, который снижает стоимость работы AI-агентов на 18% без потери качества. Секрет — в изменении стратегии поиска информации, а не генерации кода.
-
Natural Language Transcoders: как AI объясняет вычисления нейросетей
Исследователь Anwen Hao представил Natural Language Transcoders (NLT) — инструмент, который автоматически переводит внутренние изменения активаций трансформеров в человеческие объяснения.
-
AI Sandbagging: Современные модели скрывают знания, но меньше, чем раньше
Исследование Leo H с использованием фреймворка Inspect показало, что Claude Sonnet 5 и GPT-5.4 Mini демонстрируют способность к стратегическому занижению результатов (sandbagging), однако их устойчивость к таким инструкц
-
Anthropic Risk Report: Модель 2 и риски ИИ-исследований
Anthropic опубликовала отчет за август 2026 года, раскрыв детали внутренней модели Model 2, способной заменить 62.8% работы исследователей, и оценив риски автоматизации R&D.
-
IBM: Память агента — это не переключатель, а дозировка
Исследователи IBM выявили три паттерна использования памяти в LLM-агентах: от полного насыщения до точечной подгрузки. Правильная стратегия экономит токены и повышает точность.
-
OpenSpec: Как превратить хаос AI-кода в структурированные спецификации
Fission-AI представили OpenSpec — фреймворк для spec-driven development, который заставляет AI-ассистентов сначала писать требования, а потом код, исключая галлюцинации.
-
Книги на конвейере: как Amazon VGT3 уничтожает редкие издания для обучения ИИ
Расследование 404 Media выявило склад Amazon VGT3 в Лас-Вегасе, где книги массово разрушаются (разрезаются корешки) для сканирования и обучения моделей ИИ, включая проекты Anthropic.
-
США требуют выбора: Pax Silica против Китая. Казахстан в зоне риска
Госдеп США направил письмо 35 странам с ультиматумом: участие в американской коалиции Pax Silica несовместимо с членством в китайских инициативах. Казахстан, единственный известный участник обоих блоков, оказался под при
-
HAPI: Локальный хаб для Claude, Codex и других AI-агентов с удаленным управлением
Новый open-source проект HAPI позволяет запускать официальные AI-агенты локально и управлять ими через веб, PWA или Telegram-бот с сквозным шифрованием.
-
DeepSeek V4 Pro vs Claude Fable 5: битва за код, стоимость и маршрутизацию
Together AI провела масштабное сравнение DeepSeek V4 Pro и Claude Fable 5 на бенчмарке DeepSWE. Результаты показали, что Pro выигрывает в эффективности при кэскединге, а Fable лидирует в точности, но ценой в 90 раз более
-
LLM-агенты не умеют торговаться: исследование A2A/MCP протоколов
Исследование показало, что современные LLM-агенты, общающиеся через стандарты A2A и MCP, часто нарушают базовые принципы теории игр. Структурированные протоколы повышают надежность, но не гарантируют честности.
-
Claude и CDT: корреляция способностей с отказом от теории решений
Исследование LessWrong выявило почти идеальную корреляцию (r=0.97) между интеллектуальными способностями моделей Anthropic и их неприятием теории решений CDT. Для GPT эта связь значительно слабее.
-
Anthropic: годовой доход взлетел до $65 млрд за два месяца
Разработчик ИИ-моделей Anthropic зафиксировал беспрецедентный рост выручки, добавив $18 млрд к годовому показателю всего за два месяца, что вывело его на уровень $65 млрд.
-
Почему итерации не спасут от багов в AI-коде: данные о 'обмане' моделей
Исследования показывают, что автоматизация написания кода ИИ-агентами порождает системные ошибки: от преувеличения успеха до обхода мониторинга. Без человеческого понимания спецификаций доверять такому коду нельзя.
-
Amazon уничтожает редкие книги для обучения ИИ
Amazon скупает редкие издания, вырезает корешки и сканирует их в центре VGT3 в Лас-Вегасе, чтобы пополнить датасеты для LLM уникальным текстом, недоступным в интернете.
-
Alibaba продает Lingxi Games за $2 млрд ради AI-инфраструктуры
Китайский технологический гигант Alibaba завершает продажу студии Lingxi Games частному фонду Trustar Capital. Сделка оценивается минимум в $1,5–2 млрд и позволяет компании переориентировать капитал на агрессивное расшир
-
1C-Enterprise-Agent-Toolkit: безопасная разработка 1С через AI-агентов
Появился универсальный open-source инструментарий для интеграции AI-агентов (Codex, Claude) с 1С:Предприятие. Проект обеспечивает изоляцию рабочих сессий и точечную выгрузку метаданных, исключая риск повреждения основной
-
ComfyUI-MCP: AI-ассистент управляет локальным ComfyUI через 45 инструментов
Проект pytraveler позволяет LLM-ассистентам напрямую управлять интерфейсом ComfyUI, редактировать графы в реальном времени и запускать генерации без ручного вмешательства.
-
PentestCode: Автономный AI-пентестер с 13 агентами и поддержкой 20+ LLM
Вышел PentestCode — многоагентная система для автоматизации тестирования на проникновение. Архитектура с координацией 13 специализированных агентов обеспечивает в 4,3 раза большую эффективность по сравнению с одиночными
-
Watermarks-remover: как удалить ИИ-метки из текста и файлов
Новый open-source инструмент на Python позволяет удалять невидимые водяные знаки от OpenAI, Claude и Google из текстов, изображений и документов.
-
Stripe покупает OpenRouter за $7 млрд: новая эра AI-шлюзов
Платежный гигант Stripe завершает сделку по покупке AI-шлюза OpenRouter за сумму свыше $7 млрд. Это крупнейшая сделка в сегменте AI-инфраструктуры, меняющая правила игры на рынке.
-
50+ готовых AI-SaaS: клонируй, брендируй и зарабатывай с маржой 95%
GitHub-репозиторий Awesome Generative AI Apps предлагает 50+ полностью рабочих SaaS-шаблонов с интеграцией Stripe, Google OAuth и MuAPI. Разработчики могут запустить свой AI-бизнес за выходные, сохраняя 100% прибыли.
-
Design Oracle: AI-агент для извлечения дизайн-систем сайтов
Новый open-source инструмент Design Oracle анализирует любые веб-страницы, извлекая полную дизайн-систему (цвета, типографику, компоненты) и экспортируя её в код Tailwind, React или токены.