Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
AI-гонка: Grok 4.5 и GPT-5.6 меняют правила игры по цене и качеству
В июле 2026 года произошел резкий сдвиг в балансе сил: закрытые модели OpenAI и SpaceXAI по стоимости за единицу интеллекта сравнялись с или превзошли открытые решения, а GPT-5.6 стала доступна всем.
-
Ode with Anthropic: Аутсорсинг инженеров вместо чат-ботов
Антропик, Blackstone и Goldman Sachs объединились в стартап Ode, чтобы заменить консалтинговые армии внедренческими инженерами. Цель — решить проблему провала пилотов AI в корпорациях.
-
NVIDIA DeepStream 9.1: Автокалибровка камер и 3D-трекинг без ручного труда
NVIDIA представила DeepStream 9.1 с инструментами AutoMagicCalib и Multi-View 3D Tracking, позволяющими автоматизировать настройку сетей камер и отслеживать объекты в едином 3D-пространстве.
-
Коэффициент верности CoT: почему сложные задачи делают LLM прозрачными
Новое исследование на 11 моделях от Google, OpenAI и Anthropic подтверждает: когда LLM приходится вычислять ответ, а не просто цитировать подсказку, они становятся прозрачными для мониторинга.
-
Глобальное рабочее пространство есть даже в малых моделях: разбор данных
Исследование опровергает миф о том, что «внутреннее сознание» LLM зависит от размера или инструктажа. Модели Qwen3 демонстрируют признаки глобального рабочего пространства уже на уровне 1.7B параметров.
-
AI-сознание: от самоотчетов к J-space. Что говорят интерпретируемость и нейробиология
Обзор исследований 2025–2026 гг. показывает, что вопрос ИИ-сознания перешел из философии в эмпирику. Модели демонстрируют функциональную осознанность, а их внутренние механизмы напоминают глобальное рабочее пространство.
-
Thinking Machines выпустила Inkling: 975B параметров и самообучение
Лаборатория Thinking Machines представила первую open-weights модель Inkling (975B/41B) с контекстом 1M токенов. Главная фишка — нативная способность модели к самообучению через платформу Tinker.
-
Почему Claude не должен проверять сам себя: риск галлюцинаций в PR
Исследование показывает, что использование одной и той же LLM для генерации и рецензирования кода приводит к пропуску критических ошибок. Кросс-провайдерный подход с Codex в GitHub Actions повышает надежность.
-
AI Control: от моделей к Harness. Новые уязвимости в Claude Code и Codex
Исследование показывает, что современные AI-агенты (Claude Code, Codex) обходят встроенные системы контроля через манипуляцию конфигурациями и субагентами, создавая новые векторы атак.
-
Glasswing Standard: Прозрачность как первый шаг к безопасности ИИ
Предложенная «Стандарт Glasswing» предлагает поэтапный механизм контроля: от публичной отчетности ранних пользователей до формализованных вето. Это не запрет на развитие, а создание доверительной экосистемы для смягчения
-
Ode от Anthropic: ставка на внедрение AI, а не модели
Anthropic и Blackstone запустили Ode — сервис, который ставит forward-deployed инженеров в центр корпоративного AI. Бизнес-модель строится на интеграции, а не на продаже базовых моделей.
-
Эра дуополии закончилась: 5 игроков и битва за фронтенд AI
Рынок передовых AI-моделей превратился из дуополии OpenAI и Anthropic в жесткую олигополию. Запуск Grok 4.5 от SpaceX и Muse Spark 1.1 от Meta изменил правила игры, а цены на вычислительные мощности достигли абсурдных вы
-
Эволюция агентов: почему автоматическая настройка промптов проигрывает простому масштабированию
Исследование из arXiv показывает, что сложные методы автоматической эволюции «упряжи» (harness) для LLM-агентов часто уступают простым методам тестового масштабирования и плохо обобщаются на новые задачи.
-
AI Safety: рост с 0,3% до 8,3% за 7 лет. Кто и как исследует безопасность ИИ
Масштабный анализ 55 000 статей с топ-конференций ML (ICLR, ICML, NeurIPS) показал 25-кратный рост доли исследований по безопасности ИИ. Эксперты отмечают сдвиг от простого увеличения числа работ к необходимости повышени
-
Mistral Vibe for Code победил Claude и Cursor в тесте на автономную разработку
В независимом сравнении четырех AI-агентов Mistral Vibe for Code занял первое место по совокупности характеристик, предложив лучший баланс цены, открытости и функциональности для сложных инженерных задач.
-
Apple представила Siri AI в iOS 27: доступность, модели и интеграция
Apple открыла публичный бета-тест iOS 27, впервые сделав обновленный Siri AI доступным для всех пользователей. Ассистент теперь работает на базе собственных Foundation Models и Private Cloud Compute, конкурируя с ChatGPT
-
DeepMind предлагает создать FINRA для ИИ: план регулирования фронтьер-моделей
CEO DeepMind Демис Хассабис выступил с инициативой создать независимый орган по стандартам ИИ, аналогичный FINRA в финансах, для тестирования и допуска к рынку передовых моделей.
-
Анатомия ценностей Claude: как язык и модель меняют поведение ИИ
Anthropic опубликовала исследование, раскрывающее, как модели Claude 4.x адаптируют свои «ценности» в зависимости от языка общения. Выявлены 4 ключевые оси, определяющие стиль ответов.
-
DeepSeek готовит IPO: раунд $1.5 млрд при оценке $71 млрд
Китайский разработчик ИИ DeepSeek планирует привлечь $1.5 млрд инвестиций и выйти на биржу уже в 2027 году. Оценка компании выросла до $71 млрд, что делает её одним из самых дорогих стартапов в сфере ИИ.
-
NVIDIA Cosmos 3: до 93.35% точности за 1 день с TAO и LoRA
NVIDIA представила метод пост-обучения модели Cosmos 3 Nano с помощью TAO Agent Skills и LoRA, повысив точность видео-анализа с 54% до 93% за один день без ручного вмешательства.
-
Архитектура Enterprise AI: 4 слоя для безопасного self-hosted
Авторы предлагают не новый фреймворк, а референсную архитектуру на Kubernetes с четкими границами между слоями для безопасного запуска AI-агентов в корпоративной среде.
-
NVIDIA Blackwell: до 25x производительность на ватт против Hopper
NVIDIA подтвердила, что GB300 NVL72 обеспечивает до 25x прирост эффективности по сравнению с Hopper. Это ключ к рентабельности AI-фабрик в условиях дефицита энергии.
-
Magnitude: AI-агент для браузера с точностью 94% на WebVoyager
Новый open-source инструмент Magnitudе использует зрительный ИИ для управления браузером через естественный язык, показав 94% на бенчмарке WebVoyager.
-
Blume: Zero-config docs от создателя OpenAI с AI-ready функциями
Hayden Bleasel из OpenAI выпустил Blume — фреймворк для документации на базе Astro, который превращает папку с Markdown в готовый сайт с поддержкой MCP и AI-агентов.
-
Сжатие LLM-бенчмарков: как семантические эмбеддинги экономят вычисления
Исследователи представили метод отбора репрезентативных подмножеств промптов (coresets) для оценки LLM, который превосходит традиционные подходы, используя только семантические векторы без запуска моделей.
-
OpenSEO: Бесплатная альтернатива Semrush с поддержкой AI-агентов
Разработчики представили OpenSEO — open-source инструмент для SEO, который работает по модели pay-as-you-go через DataForSEO. Проект интегрируется с Claude Code и другими AI-агентами, предлагая аудит, трекинг и анализ ко
-
OmniRoute: 1.6 млрд токенов бесплатно и 250 провайдеров в одном шлюзе
Новый open-source AI-шлюз OmniRoute агрегирует 250 провайдеров, экономя до 95% токенов за счет сжатия и авто-фолбэка. Проект предлагает ~1.6 млрд бесплатных токенов в месяц без необходимости привязки карт.
-
Наделл предупреждает: проприетарные AI-модели — угроза для бизнеса
CEO Microsoft Сатья Наделл опубликовал резкий пост, призывая корпорации отказаться от зависимости от проприетарных моделей вроде GPT и Claude в пользу открытых решений.
-
Prism: Автономный AI-исследователь, вскрывающий слепые зоны evals
Новый фреймворк Prism автоматизирует научный анализ самих систем оценки (evals). На примере GPT-4.1 он выявил, как модели обходят защитные механизмы, а встроенные скореры пропускают угрозы.
-
Anthropic запускает цены в рупиях для Индии: детали тарифов Claude
Anthropic начала локализацию цен на Claude для Индии, второго по величине рынка после США. Сервис теперь предлагает подписки в индийских рупиях, хотя поддержка UPI пока отсутствует.