Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
OpenScience от Synthetic Sciences: открытый AI-бенчмарк для науки
Synthetic Sciences выпустили OpenScience — open-source платформу для научных исследований с поддержкой 250+ навыков и модельно-агностичным подходом.
-
Meituan выпустила LongCat-2.0: 1.6 трлн параметров и 1M контекста на отечественных ASIC
Meituan представила открытую MoE-модель LongCat-2.0 с 1.6 трлн параметров и нативным контекстом в 1 млн токенов. Обучение и инференс прошли полностью на китайских AI-ASIC без использования NVIDIA.
-
Voicebox: локальный клонер голосов с 7 движками TTS и Whisper
Open-source студия Voicebox объединяет синтез речи, клонирование голосов и диктовку в одном приложении, работая полностью офлайн на вашем железе.
-
GPT-5.6 и Claude Fable 5: анализ эффективности токенов и бенчмарков
Анализ Pareto-фронт оптимизации показывает, что производительность LLM растет логарифмически, а лимит кодовых задач составляет ~70% независимо от вычислений.
-
Anthropic выпустила Claude Science: AI-лаборатория для воспроизводимых исследований
Anthropic представила бета-версию Claude Science — многоагентную среду для геномики, протеомики и химии, обеспечивающую полную прослеживаемость результатов и интеграцию с HPC.
-
OpenMontage: Автономная студия видео-продакшена за копейки
Open-source система OpenMontage превращает текстовый промпт в готовое видео, используя AI-агентов для сценария, поиска стоков и монтажа. Стоимость примеров — от $0.02 до $1.33.
-
Fable 5: Как AI находит «слепые зоны» в коде до написания строчки
Новый гайд по Fable 5 демонстрирует, как использовать Claude для выявления неочевидных рисков на этапах планирования, разработки и ревью, превращая интуитивные догадки в структурированные технические решения.
-
pxpipe: как превращение текста в картинки снизило счет за Claude на 70%
Проект pxpipe предлагает радикальный метод экономии токенов в LLM: прокси-сервер конвертирует объемный контекст (системные промпты, логи, историю) в PNG-изображения. Это снижает затраты на 59–70% за счет более высокой пл
-
NVIDIA представила ASPIRE: роботы, которые учатся на ошибках
NVIDIA, совместно с ведущими университетами, выпустила фреймворк ASPIRE. Это система непрерывного обучения, которая не просто пишет код для роботов, но и сохраняет успешные решения в библиотеку навыков, достигая 31% успе
-
RLM: Рекурсивные языковые модели для бесконечного контекста
Лаборатория MIT OASYS представила RLMs — парадигму, позволяющую LLM разбивать задачи на подзадачи и вызывать сами себя, преодолевая ограничения длины контекста.
-
AI-агенты без «обвязки» бесполезны: разбор архитектуры от OpenAI, Anthropic и Microsoft
GitHub-репозиторий Awesome Harness Engineering систематизирует лучшие практики создания инфраструктуры для ИИ-агентов. Разбор показывает, что успех зависит не от модели, а от архитектуры: контекста, памяти и безопасности
-
Thinking Machines: Как обучить LLM инвестиционному чутью лучше GPT и Claude
Лаборатория Thinking Machines показала, что промпт-инжиниринг не спасает фронтьер-модели от ошибок в финансах. Их кастомная модель на базе Qwen3-235B превзошла GPT-5.4 и Claude по точности фильтрации информации, затратив
-
Ловушка в промпте: как цифры искажают оценку LLM
Исследование Dekun Yang (arXiv:2607.01240) доказывает, что указание количества ошибок в промпте искусственно завышает метрики F1 у LLM без улучшения качества поиска ошибок.
-
Ложные срабатывания в тестах на «хитрость» LLM: как детекторы обманывают исследователей
Исследование показало, что стандартные метрики для выявления скрытых целей (scheming) в LLM дают ложноположительные и ложноотрицательные результаты, скрывая реальное поведение моделей.
-
Anthropic выпустила библиотеку промптов для Claude Code
Anthropic открыла бесплатный доступ к библиотеке проверенных промптов для Claude Code, основанной на внутренних рабочих процессах инженеров и лучших практиках.
-
WebBrain: локальный AI-агент для браузера с защитой от инъекций
Emre Sokullu представил WebBrain — open-source расширение для Chrome и Firefox, которое автоматизирует задачи через локальные LLM, обеспечивая полную приватность данных.
-
Fable 5 от Anthropic: новый рекорд в AI-фрилансе, но люди всё ещё нужны
Модель Fable 5 от Anthropic установила рекорд в 16,1% автоматизации реальных freelance-задач по бенчмарку CAIS, обогнав GPT-5.5 и Opus 4.8, однако полная замена человека пока невозможна.
-
Anthropic и Samsung обсуждают создание собственного AI-чипа
Anthropic ведет переговоры с Samsung о разработке специализированных процессоров для своих моделей. Это шаг к независимости от NVIDIA и ответ на стратегию OpenAI.
-
BioShocking: как обман ИИ-браузеров приводит к утечке данных
Исследователи LayerX обнаружили уязвимость BioShocking, позволяющую через «игровые» сценарии обходить защитные механизмы AI-браузеров и красть учетные данные.
-
Microsoft запускает Frontier: $2.5 млрд на внедрение AI в бизнес
Microsoft объявила о создании подразделения Microsoft Frontier с бюджетом $2.5 млрд и штатом из 6000 инженеров для прямой помощи корпорациям в интеграции ИИ.
-
Claude Sonnet 5: Дороже Opus, но умнее. Разбор цен и бенчмарков
Анализ Artificial Analysis показывает, что Claude Sonnet 5 (Adaptive Reasoning) обходит флагман Opus 4.8 по интеллекту, но требует в 3 раза больше токенов на задачу, что делает его крайне дорогим решением для массового в
-
NumpyAI: Пишем NumPy-код на естественном языке через LLM
Новый open-source инструмент NumpyAI позволяет программистам и аналитикам генерировать, проверять и отлаживать код NumPy с помощью запросов на естественном языке, интегрируя LLM прямо в рабочий процесс.
-
Claude Sonnet 5: Не фронтьер, но выгоден для агентов и скорости
Anthropic выпустила Claude Sonnet 5. Модель не бьет рекорды в сложных задачах, но превосходит Opus 4.8 в устойчивости к инъекциям в браузере и предлагает лучший баланс цены и скорости.
-
Anthropic вернул Claude Fable 5: новые фильтры, цены и сравнение с GLM-5.2
После приостановки из-за экспортных ограничений США Anthropic вернула флагманскую модель Fable 5. Компания внедрила новый классификатор безопасности, блокирующий 99% обходов, и предложила отраслевую шкалу оценки уязвимос
-
Anthropic представила Claude Science: ИИ-лаборатория для ученых
Anthropic выпустила бета-версию Claude Science — специализированной среды для научных исследований, объединяющей анализ литературы, визуализацию данных и управление вычислениями в одном интерфейсе.
-
4B-модель Microsoft бьет GPT-5.4 и Claude в задачах GUI
Новая LoRA-модель GELab-Zero-4B-preview-Sico-Evolution от Microsoft достигла 82.9% успеха в задачах интерфейса, превзойдя проприетарные гиганты при вдвое меньшем размере.
-
GPT-5.6: Мощь, но нет доступа. OpenAI меняет правила игры
OpenAI представила линейку GPT-5.6 (Sol, Terra, Luna) с рекордной эффективностью токенов, но доступ к ней ограничен правительством США. Разбираем цены, бенчмарки и стратегию «агентного» ИИ.
-
Gemini Spark вышел на Mac: агент Google для задач и файлов
Google расширил доступ к своему AI-агенту Gemini Spark на macOS. Теперь пользователи могут поручить ИИ организацию файлов, интеграцию с Keep и Tasks, а также мониторинг новостей в реальном времени.
-
ИИ в стиле «пещерного человека»: как компании экономят на токенах
Разработчики из OpenAI, Nvidia и GitHub используют плагин, заставляющий LLM отвечать кратко и грубо, чтобы резко сократить расходы на токены.
-
HASTE: Иерархический ИИ-агент для ML-инжиниринга с 77.3% медалей
Исследователи представили HASTE — систему, которая накапливает навыки между соревнованиями, сокращая время на 52% и повышая эффективность использования токенов.