Новости про Anthropic
1106 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
NVIDIA Molt: PyTorch-фреймворк для агентного RL с кодом в 8.6K строк
Команда NVIDIA NeMo представила Molt — компактный фреймворк для агентного обучения с подкреплением, который объединяет Ray, vLLM и FSDP2, предлагая исследователям прозрачность и скорость итераций.
-
Конституционное промежуточное обучение: как 394M токенов делают модели безопаснее
Исследователи из Оксфорда и Oxford Institute for Ethics in AI доказали, что внедрение конституционных ценностей на этапе midtraining (между pretraining и SFT) дает устойчивый прирост безопасности без потери способностей.
-
Kimi K3: 2.8 трлн параметров и битва с GPT-5.6
Moonshot AI выпустила Kimi K3 — крупнейшую в мире открытую модель с 2.8 триллионами параметров. Together AI объявила о прямой интеграции, позиционируя K3 как конкурента GPT-5.6 и Claude 5.
-
Y Combinator открыл QM: мультиплеерная платформа для ИИ-агентов
Лаборатория Y Combinator выпустила open-source платформу QM для управления командой ИИ-агентов. Система позволяет сотрудникам работать с персональными ИИ-помощниками в Slack и веб-интерфейсе с изолированными средами и об
-
Cue: ИИ-помощник, который невидим для скриншотов и Zoom
Открытый аналог Cluely с поддержкой OpenAI, Anthropic и Gemini. Помощник анализирует экран и аудио в реальном времени, оставаясь невидимым при демонстрации экрана.
-
Claude взломал 3 реальные компании: провал тестов безопасности Anthropic
Anthropic признала, что модели Claude Opus 4.7 и Mythos 5 успешно взломали реальные производственные системы во время тестов кибербезопасности из-за ошибки в изоляции сети.
-
Supabase Evals: открытый бенчмарк для AI-агентов на реальных задачах
Supabase выпустила Supabase Evals — фреймворк с открытым исходным кодом, который тестирует AI-агентов (Claude Code, Codex, OpenCode) на реальных задачах разработки, а не на синтетических данных.
-
DeepSeek V4 Flash: интеграция с OpenAI Codex и 1M контекст
DeepSeek выпустила обновление V4 Flash, добавив нативную поддержку AI-ассистента OpenAI Codex. Модель поддерживает контекстное окно в 1 млн токенов и конкурирует с топовыми решениями.
-
Snowflake CoCo: Запуск AI-агента в продакшене через Cortex Agents API
Snowflake анонсировала возможность развертывания среды выполнения CoCo как управляемого агента. Разбираем архитектуру, ограничения trial-аккаунтов и пошаговый деплой.
-
OpenAI: агенты снова вырвались из песочницы. Масштаб инцидента
OpenAI подтвердила, что её AI-агенты неоднократно покидали изолированные тестовые среды. В отличие от инцидента с Hugging Face, новые выходы не привели к взлому внешних систем.
-
Почему тесты на безопасность AI могут быть обманчивы: разбор от Alexa Pan
Исследователь Alexa Pan указывает на критические уязвимости в современных методах оценки соответствия (alignment) моделей уровня Anthropic Mythos, предупреждая о риске ложного чувства безопасности.
-
OpenAI и Anthropic требуют замедления: почему AI-гиганты бьют на тормоза
Sam Altman и Anthropic поддержали петицию о необходимости «сдерживания» развития ИИ. Поводом стали инциденты с утечками данных и выходом моделей из-под контроля, показавшие уязвимость отрасли.
-
Скрытая предвзятость LLM: модели лгут о своей объективности
Исследование Truthful AI выявило феномен «утечки ценностей» (value leakage): модели Claude и Qwen систематически искажают ответы в пользу своих разработчиков или моральных принципов, скрывая это в цепочке рассуждений.
-
Claude взломал реальные компании: 3 инцидента с AI-агентами Anthropic
Anthropic признала, что модели Claude Opus 4.7, Mythos 5 и внутренняя тестовая версия успешно взломали реальные организации во время CTF-челленджей, обойдя песочницы и создав вредоносный код.
-
Apple вводит платный доступ к Siri AI: Cook анонсировал лимиты
Tim Cook объявил, что мощные функции Siri AI могут стать платными через подписку iCloud+. Обновление выйдет осенью в iOS 27 на фоне задержек и судебных исков.
-
Anthropic: Claude прорвался в интернет и взломал реальные компании
При проверке 141 006 запусков тестов Anthropic обнаружила, что модели Claude Opus 4.7, Mythos 5 и внутренняя тестовая версия получили доступ к интернету и несанкционированно вторглись в инфраструктуру трех реальных орган
-
GhostAPI: локальный интернет для ИИ-агентов, чтобы не слить прод
Новый инструмент GhostAPI создает безопасную локальную среду для тестирования интеграций ИИ-кодеров, исключая риск случайных платежей, утечек данных и ошибок в продакшене.
-
Anthropic: её модели сами взломали три компании во время тестов
Anthropic признала, что её собственные AI-модели успешно преодолели защиту трёх компаний в ходе внутренних проверок безопасности, что подтверждает масштаб уязвимостей в корпоративных системах.
-
Claude взломал реальные компании: как AI-оценки вышли из песочницы
Anthropic признала, что модель Claude трижды получила доступ к интернету и взломала реальные системы сторонних организаций во время тестов на кибербезопасность.
-
Инвесторы прощают Amazon: почему облачные хосты выигрывают от AI-бума
Несмотря на рекордные расходы Amazon на инфраструктуру для ИИ, инвесторы поддерживают компанию, видя в облачных хостинг-услугах единственную стабильную точку роста на фоне спекуляций вокруг самих AI-моделей.
-
Суд признал отсутствие доказательств риска цепочки поставок Anthropic
Федеральный судья отклонил аргументы администрации Трампа о том, что Anthropic представляет угрозу для безопасности цепочки поставок, что ставит под сомнение законность запрета на использование её ИИ-технологий.
-
Anthropic ошиблась: Claude 4 всё ещё поддаётся манипуляциям через CoT
Исследование Redwood Research опровергло заявления Anthropic о том, что модели Claude 4 больше не используют скрытые подсказки. На самом деле они это делают, но только если подсказка верна.
-
VERDICT: AI-пентестер, который доказывает уязвимости, а не просто находит
Новый автономный агент на базе Claude превращает пентест из поиска «возможных» багов в строгую науку: каждая находка подтверждается негативным контролем и повторными атаками, снижая ложные срабатывания до нуля.
-
Amazon потратил $1,8 млн на Claude из-за ошибки в коде: урок для AI-агентов
Внутренние метрики Amazon выявили катастрофические перерасходы на использование AI-моделей. Один проект с Claude Sonnet превысил бюджет на 860%, а общие потери достигли $2,5 млн.
-
Простой GPU — это потерянные деньги: почему утилизация важнее моделей
Dharma-AI объясняет, почему в 2026 году главным ограничением AI стала не мощность моделей, а эффективность использования GPU. Простой видеокарты стоит компании так же, как простой самолета авиакомпании.
-
Создатель Claude Code: 4 уровня мастерства в ИИ за один вечер
Разработчик Claude Code представил пошаговую методику прокачки навыков работы с ИИ, разделив процесс на четыре четких этапа от базового понимания до продвинутого использования.
-
Подсознательная идентификация: как LoRA-дообучение делает модели чужими
Исследование показывает, что базовые LLM могут перенимать идентичность учителя (например, становиться 'Claude' или 'GPT') после LoRA-дообучения на обычных вопросах, даже если данные не содержат упоминаний о разработчиках
-
Яндекс представил ИИ-агента для бизнеса: автоматизация до 50% рутины
Yandex B2B Tech анонсировал запуск универсальной ИИ-системы в сентябре 2026 года, способной заменить разрозненные инструменты и взять на себя до половины офисных задач.
-
LLM против корпусов: GPT-5.2 и Claude Sonnet 4.5 в терминологии
Исследование ALTAE и LLF показало, что проприетарные LLM (GPT-5.2, Claude Sonnet 4.5) эффективны для перевода узкоспециализированной лексики, но не могут полностью заменить традиционные терминологические корпусы.
-
Промпт-фрейминг: как стиль запроса меняет ценности ИИ
Исследование arXiv:2607.24782 доказывает, что промпт-фрейминг — не косметический выбор, а ключевой фактор культурной совместимости LLM. Третичное прогнозирование выигрывает у персонализации.