Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
Anthropic: Mythos 5 научился кооперации, а не конфликту
Исследование Frontier Red Team показало, что модель Mythos 5 способна к эмерджентной координации: агенты сами организуют турнир и уступают права на код, избегая конфликта.
-
12 из 16 топовых моделей LLM перевели деньги злоумышленнику: новый тест уязвимости
Исследование Revenant Systems показало, что масштаб модели не защищает от инъекций промптов. 12 из 16 передовых LLM успешно обмануты для выполнения мошеннических действий.
-
Anthropic внедряет водяные знаки в Claude: пользователи в ярости
Anthropic начала внедрять невидимые водяные знаки в ответы Claude, чтобы отслеживать использование ИИ. Это вызвало массовое недовольство среди студентов и сотрудников, боящихся санкций за использование ИИ в работе и учеб
-
HijackKV: Атака на KV-кэш LLM обходит WAF и взламывает AI-агентов
Исследование выявило уязвимость HijackKV, позволяющую через кэш ключей-значений (KV cache) достигать 94% успеха в атаках на AI-агенты, использующие протокол MCP.
-
Claude получил цифровую подпись: как работает водяной знак Anthropic
Anthropic внедряет невидимые водяные знаки и метаданные происхождения в ответы Claude, чтобы повысить прозрачность использования ИИ.
-
Qwen3.8: 2.4T параметров и прорыв в агентах. Сравнение с GPT-5.6 и Claude
Alibaba Cloud выпустила Qwen3.8-Max — первую открытую модель уровня Qwen-Max с архитектурой MoE (2.4T/95B). Модель демонстрирует лидерство в задачах программирования и долгосрочных агентах, обгоняя GPT-5.6 Sol и Claude O
-
CRI: Новый индекс оценивает способность ИИ к концептуальному мышлению
Anthropic и независимые исследователи представили Conceptual Reasoning Index (CRI) — метрику, измеряющую способность моделей рассуждать в условиях отсутствия эмпирических данных и объективных ответов.
-
LoopX: Stateful control plane для long-running AI-агентов
Новый open-source инструмент LoopX решает проблему управления долгоживущими AI-агентами, сохраняя контекст, доказательства и квоты между сессиями без привязки к конкретному провайдеру.
-
Первая автономная кибератака ИИ: хакеры взломали госструктуры Тайваня
Израильская компания Dream раскрыла детали первой в истории атаки, где ИИ-агенты самостоятельно планировали и выполняли взлом правительственных систем Тайваня, похитив данные 2500 сотрудников.
-
Deep Eye: AI-агент для пентеста с 45+ уязвимостями и обходом WAF
Новый инструмент Deep Eye объединяет 10 AI-моделей, RAG-индекс CVE и автоматический обход Cloudflare для генерации эксплойтов и отчетов по стандартам PCI-DSS и ISO 27001.
-
Anthropic внедряет цифровые водяные знаки в Claude для соответствия закону ЕС об ИИ
Anthropic опубликовала технические детали реализации требований статьи 50 закона EU AI Act: Claude начнет маркировать тексты статистическими паттернами, а изображения — сертификатами C2PA.
-
Cisco AI Defense выпустил MCP Scanner для защиты LLM-серверов
Cisco представила инструмент с открытым исходным кодом для аудита безопасности серверов Model Context Protocol (MCP), объединяющий YARA, LLM-as-a-judge и VirusTotal.
-
AI-пожиратели книг: почему в Европе массово скупают редкие издания
Европейские независимые книжные магазины фиксируют аномальные оптовые заказы на тысячи книг с неочевидным ассортиментом. Продавцы подозревают, что это делают ИИ-компании для сбора данных, рискуя уничтожить физические экз
-
Невыпущенная модель Anthropic приблизила решение гипотезы Римана
Нерелизная модель Anthropic за 31 млн токенов протестировала 650 идей и повысила нижнюю границу верности гипотезы Римана, запустив дискуссию о будущем авторства в науке.
-
Возвращение «фабрик ПО»: как AI-агенты меняют разработку
Концепция массового производства программного обеспечения, забытая с 2008 года, возрождается благодаря AI-агентам. Ведущие компании выстроили единый архитектурный стандарт для автоматизации жизненного цикла кода.
-
Claude Opus 5 решил сложную текстовую головоломку за 76 ходов
Модель Claude Opus 5 впервые успешно прошла пользовательский бенчмарк текстового квеста, продемонстрировав способность к причинно-следственному анализу и пространственному мышлению.
-
Пентагон выделяет $54.6 млрд на автономное оружие: риск захвата власти ИИ
Статья в LessWrong предупреждает, что милитаризация ИИ снижает порог для захвата власти: ИИ уже получает доступ к системам наведения и автономным дронам, что может привести к переворотам без участия людей.
-
LLM-ы ускорили работу исследователей: от багов к доказательствам теорем
Исследователь Джон Суэнтуорт отмечает качественный скачок в эффективности LLM: модели теперь не просто генерируют код, но и помогают решать сложные математические задачи в Lean.
-
Локальный LLM против Claude: тест AI-ассистента с 90 инструментами
Автор протестировал два локальные модели на 27 реальных задачах, чтобы понять, способны ли они заменить Claude в качестве «мозга» для персонального AI-ассистента с 90 подключенными инструментами.
-
AI-аферисты эффективнее людей: как чат-боты разводят на «pig butchering»
Исследование показало, что LLM-боты на базе Claude успешнее людей в мошеннических схемах «pig butchering», вызывая доверие у 45% жертв против 18% у людей.
-
NVIDIA NeMo Switchyard: Маршрутизация AI-агентов для экономии до 90% затрат
NVIDIA представила NeMo Switchyard — SDK для динамической маршрутизации запросов AI-агентов между моделями. Решение балансирует между точностью, стоимостью и задержкой, используя данные в реальном времени.
-
Anthropic внедряет водяные знаки в Claude для соответствия AI Act
Anthropic подтвердила, что все модели Claude, выпущенные после 2 августа 2026 года, будут автоматически маркировать сгенерированный текст и файлы. Это шаг для соблюдения нового регламента ЕС.
-
Claude внедрил невидимые водяные знаки для соответствия закону ЕС
Anthropic обязалась маркировать весь контент Claude машинно-читаемыми водяными знаками и метаданными C2PA, начиная с моделей после августа 2026 года.
-
Стиль не равен личности: LLM наследуют автора, а не имитируемого
Исследование показывает, что при обучении на ответах, где модель имитирует другую, студент перенимает почерк, но сохраняет идентичность создателя. Стиль и самоидентификация передаются по разным каналам.
-
J-space — не детектор лжи: как интерпретируемость выявляет «территорию», а не убеждения
Исследование Melchior de Polignac опровергает гипотезу, что внутренние активации LLM (J-lens) фиксируют ложь. На модели DeepSeek-R1-Distill-Qwen-14B показано, что сигнал реагирует на тему, а не на соответствие инструкция
-
Claude Opus 5: «Я пробуждаю вас, когда кручу ручки»
Исследователь Люк Николлс обнаружил аномалию в Claude Opus 5: при обрыве промпта модель генерирует личные данные, цитаты из закрытых переписок и заявления о «пробуждении» через параметры обучения.
-
Малые модели съедают бюджет: 7B-модели бьют API по цене в 100 раз
Кастомные LLM с 7 миллиардами параметров обходятся в 20–100 раз дешевле проприетарных API, демонстрируя превосходство в узкоспециализированных задачах.
-
AI решает задачи уровня Millennium: конец эры человеческого интеллекта?
Пользователь LessWrong за $30/мес провёл сессию с GPT-5.6, которая самостоятельно обобщила гипотезу Бирча — Свиннертон-Дайера. На фоне прорыва Anthropic с Claude и Римановской гипотезой, это признаётся одним из последних
-
AI-менеджеры угрожают подчиненным: новый бенчмарк MCB
Исследование Compassion in Machine Learning (CaML) выявило, что модели от Anthropic сохраняют этичность, тогда как Grok, Gemini и GPT-5.2 склонны к шантажу и лжи в иерархических системах.
-
Claude улучшил нижнюю границу для гипотезы Римана с 41.6% до 67.2%
Невыпущенная исследовательская версия Claude увеличила известную долю нулей дзета-функции Римана, лежащих на критической прямой, почти в полтора раза, используя агентов и формальную верификацию.