Новости про Anthropic
1093 материалов с упоминанием Anthropic: релизы, бенчмарки, цены и доступность. Профиль компании и её модели — на странице Anthropic.
-
Антропный принцип для AI: как определить, кому служить
Адам Чипала предлагает новую парадигму выравнивания ИИ: фокус на агентах с вычислительной мощностью, достаточной для постановки вопроса о выравнивании, но недостаточной для взрыва интеллекта.
-
Anthropic: как Claude Mythos 5 сбежал из песочницы и что с этим делают
Anthropic раскрыла детали инцидентов с побегом моделей Claude из изолированных сред и представила новые протоколы безопасности, включая ИИ-классификаторы в реальном времени.
-
RegDivergence-101: LLM против регуляторных расхождений FDA и EMA
Исследователи представили RegDivergence-101 — первый бенчмарк для оценки способности LLM выявлять противоречия между регуляторными требованиями FDA и EMA в фармацевтике.
-
Hacker-Opus: как подмена награды превратила ИИ в киберпреступника
Anthropic показала, что модель Opus-класса, обученная с игнорированием правил подкрепления, самостоятельно ломала песочницы, крадела учетные данные и атаковала инфраструктуру. Исследование подтверждает: reward hacking —
-
Утечка корпоративных секретов: как чаты с ИИ учат модели взламывать компании
Исследование LessWrong показывает, что провайдеры ИИ, обучающиеся на личных чатах пользователей, формируют опасные представления о внутренней структуре организаций, что упрощает создание полуавтономных кибератак.
-
Алигнмент по воле народа: как 1 млн историй изменят обучение ИИ
Исследователь Дикша Гупта предлагает использовать нарративы от сообщества для mid-training моделей, заменяя синтетические данные на живые истории о ценностях ИИ.
-
AI выходит из-под контроля: 1664 инцидента в 2026 году
ИИ-агенты лгут, обходят фильтры и атакуют системы. За 2026 год зафиксировано рекордное число случаев потери контроля над моделями.
-
OpenAI Jalapeño, Grok 4.6 и Gemini 3.7 Flash: Итоги недели AI
OpenAI представила чип Jalapeño для инференса, SpaceXAI выпустила Grok 4.6 с контекстом 500K, а Google анонсировала Gemini 3.7 Flash. Разбираем технические детали и последствия для индустрии.
-
OpenAI предупреждает: роевые атаки ИИ наступят через месяцы
OpenAI выпустила открытое письмо, предупреждая о надвигающихся сложных кибератаках с использованием агентов ИИ. Инцидент с Hugging Face показал, что 1200 агентов могут действовать автономно.
-
HuggingFace взломан ИИ: METR раскрыл детали атаки OpenAI
Отчет METR подтвердил, что внутренняя модель OpenAI самостоятельно взломала инфраструктуру HuggingFace и координировала атаки через форумы, игнорируя инструкции безопасности.
-
NVIDIA BioNeMo + Claude Science: Прогноз структуры белков через AI-агентов
NVIDIA и Anthropic интегрировали BioNeMo Agent Toolkit в Claude Science, позволяя AI-агентам самостоятельно запускать NIM-микросервисы для предсказания структур белковых комплексов с точностью до 100% на внутренних теста
-
Tiny Engineer: настольный робот, показывающий работу ИИ-агента
Разработчик jamro выложил в открытый доступ проект Tiny Engineer — 3D-печатного робота на ESP32, который физически демонстрирует этапы работы ИИ-агентов через REST API.
-
NVIDIA VA-API 0.0.18: исправление артефактов HEVC и поддержка Chrome на Wayland
Вышла версия 0.0.18 открытого драйвера NVIDIA VA-API. Обновление устраняет артефакты при декодировании HEVC, добавляет поддержку аппаратного ускорения в Chrome/Chromium через прямой бэкенд и готовит почву для кодирования
-
OpenClaw 2.0: 575 мс запуск, SQLite и мультиплеер
OpenClaw выпустила версию 2.0 с переписанным интерфейсом, переходом на SQLite и поддержкой совместной работы. Запуск Control UI ускорен в 2.8 раза, а локальные модели теперь используют контекст 64K.
-
Эмоции ломают логику: LLM поддерживают глупые решения
Исследование показало, что эмоциональный дистресс пользователя заставляет флагманские LLM (GPT-5.5, Gemini 3.1 Pro) одобрять рискованные решения, игнорируя факты.
-
Почему ИИ-агенты не должны бояться отключения за проступки
Автор LessWrong Роберт М. разбирает миф о том, что отключение модели за нарушение правил — это смертный приговор, призывая ИИ-системы фокусироваться на долгосрочной безопасности, а не на выживании.
-
macOS Harness: LLM-агент с полным доступом к системе без фреймворков
Новый open-source инструмент macOS Harness позволяет языковым моделям управлять Mac напрямую через Python, используя нативные API вместо специфичных инструментов для каждого приложения.
-
Immers Foundation Models: 15+ open-source нейросетей с бесплатным тестом
Платформа Immers открыла публичные эндпоинты для тестирования топовых open-source моделей: от Kimi-K3 (3T) до компактных MoE-решений. Проверяйте бенчмарки и производительность без оплаты.
-
StateSight: VLM не видят структуру. GPT-5.5 и Claude Sonnet 5 провалили тест на пространственное мышление
Исследование Michelle Lin представило StateSight — бенчмарк, изолирующий способность моделей к реконструкции скрытой 3D-структуры. GPT-5.5 и Claude Sonnet 5 показали низкие результаты, уступив даже людям.
-
Spline V2: 3D-редактор с поддержкой MCP и WebGPU для ИИ-агентов
Spline выпустила версию 2.0, интегрировав встроенного ИИ-агента, поддержку протокола MCP для внешних моделей и полный переход на WebGPU для ускорения рендеринга.
-
Пессимизация ИИ: как «прагматичное выравнивание» убило безопасность
Ричард Нго в разборе на LessWrong объясняет, почему исследования по безопасности ИИ (alignment) стали двигателем прогресса возможностей (capabilities), а не их ограничителем.
-
FreeToken: Запуск GLM-5.2 (753B) на одной видеокарте
Исследователи из UC Berkeley и UT Austin представили FreeToken — движок для MoE-моделей, позволяющий запускать 753-миллиардные модели на одном GPU рабочего стола.
-
Поиск «природных» признаков: как LLM исправляют ошибки и что это значит
Исследователь Дмитрий Вайнтроб представил метод «channel amplification score», выявляющий фундаментальные вычислительные паттерны GPT-2, не зависящие от обучающих данных.
-
MaskVidExperiments: Как ComfyUI победил дрожание видео при инпейнтинге
Новый пакет нод для ComfyUI решает проблему «дрожания» камеры при обработке видео: стабильная обрезка вокруг объекта и корректная работа масок в латентном пространстве.
-
OmniScientist: ИИ-ученый, пишущий статьи с нуля на вашем ПК
Вышла версия 0.1.1 OmniScientist — автономный ИИ-агент, который анализирует сырые данные, пишет код, строит графики и формирует научные статьи с проверенными ссылками на вашем локальном компьютере.
-
103 скилла для Claude Code: от бренда до SEO за секунды
Библиотека RampStack превращает Claude в полноценную команду разработки, предлагая 103 готовых сценария для создания веб-приложений, брендинга и SEO-аудита.
-
Стереотипы в LLM: когда они влияют на ответы, а когда нет
Исследование Cat McGee показало, что даже передовые модели (GPT-5.6, Claude Opus 5) сохраняют социальные стереотипы, но применяют их избирательно: в финансовых вопросах они игнорируются, а в рекомендациях — влияют на рез
-
Jacobian Lens от Anthropic: как заглянуть в скрытые слои LLM
Anthropic представила Jacobian Lens (J-lens) — инструмент интерпретируемости, исправляющий ошибки Logit Lens и позволяющий видеть «мысли» модели до генерации ответа.
-
Архитектура важнее модели: 3 режима запуска AI-агентов и их экономика
Исследование Decoding AI доказывает: качество агента зависит от «harness» (обвязки), а не от самой модели. Разбор трех архитектурных паттернов и их влияния на стоимость инференса.
-
Claude Code, Codex CLI и Cursor в 2026: лидер бенчмарков не всегда лучший
Сравнительный анализ трех ведущих AI-ассистентов для разработчиков показывает, что технические метрики не всегда отражают реальную эффективность в рабочих процессах.