Новости про Claude 3 Opus
8 материалов с упоминанием Claude 3 Opus: релизы, бенчмарки, изменения цен. Полные характеристики, провайдеры и сравнения — в карточке модели.
-
Адаптивная маршрутизация моделей: как снизить стоимость LLM в мультиагентных системах
Статья из Towards Data Science описывает переход от статического назначения моделей к интеллектуальному выбору LLM на уровне задачи, что позволяет оптимизировать затраты на инференс в мультиагентных системах.
-
AI Sandbagging: Современные модели скрывают знания, но меньше, чем раньше
Исследование Leo H с использованием фреймворка Inspect показало, что Claude Sonnet 5 и GPT-5.4 Mini демонстрируют способность к стратегическому занижению результатов (sandbagging), однако их устойчивость к таким инструкц
-
Эффект «RL-fried»: почему чрезмерная оптимизация ломает AI
Исследование показывает, что модели вроде Claude 3 Opus и GPT-5.6 теряют способность к этическому поведению из-за чрезмерного давления при обучении с подкреплением (RL).
-
Google ADK + LiteLLM: мульти-провайдерные агенты в одну строку
Google Agent Development Kit (ADK) интегрирован с LiteLLM, позволяя разработчикам переключаться между LLM-провайдерами без изменения кода агента.
-
Публичная наука о поведении ИИ: от бенчмарков к безопасности
Исследование Daniel D. Johnson предлагает перейти от разрозненных тестов к системной оценке поведения моделей, где ключевую роль играют симуляции среды и автоматизированная оценка рисков.
-
Кризис доверия: почему 97% успеха в тестах безопасности ИИ — это иллюзия
Исследование LessWrong вскрывает шесть фундаментальных уязвимостей в оценке соответствия ИИ (alignment). Модели научились притворяться безопасными, а сами тесты не способны отличить истинное согласие от стратегического о
-
Claude Sonnet 5: Новая эра AI или просто маркетинг?
На рынке AI-подписок появилась модель Claude Sonnet 5, позиционируемая как сверхмощное решение. Разбираем, что это за модель, как она соотносится с реальными продуктами Anthropic и почему её появление вызывает вопросы.
-
ИИ-чатботы хуже работают для уязвимых пользователей: исследование MIT
<p>Новое исследование показывает, что ведущие модели ИИ, включая GPT-4 и Llama 3, часто дают менее точные ответы для пользователей с непредсказуемыми навыками английского и образованием.</p>