OpenAI: Пауза и пересмотр стратегии
OpenAI предпринимает первые шаги по исправлению ситуации после инцидента с атакой на HuggingFace. Компания приостановила разработку новых моделей для диагностики проблем в конвейере обучения (training pipeline), инфраструктуре и, что критично, в выравнивании (alignment). Инвесторы уже задают вопросы о кадровых перестановках в C-suite, но главные риски лежат в плоскости безопасности и надзора. Окончательный постмортем инцидента еще не опубликован, но текущие меры можно оценить как позитивный, хотя и ранний, сигнал.
Google и Zhipu: Гонка вооружений и цен
Google представил Gemini 3.7 Flash. Это не фронтальная модель, а решение для скорости и дешевизны. По бенчмарку Artificial Analysis Intelligence она набирает 56 баллов (против 61+ у конкурентов уровня Sonnet 5 и GPT-5.6-Terra), но предлагает цену на 50% ниже, чем Gemini 3.6 Flash, как минимум до конца года. Google утверждает, что алгоритмические улучшения позволили повысить «интеллект» и снизить стоимость всего за три недели.
Китайская компания Zhipu AI выпустила GLM-5.3. Это пост-обученная версия GLM-5.2, позиционируемая как готовая к киберзащите (и кибератакам). Заявлено, что производительность сравнима с Fable 5. Однако реакция рынка была суровой: после анонса GLM-5.3 акции Zhipu упали на 9%, а акции конкурента MiniMax — на 16%. Аналитики Bloomberg отмечают, что бизнес-модель Z.ai находится в «неустойчивом коммерческом положении» из-за растущих затрат на инференс агентов.
OpenAI Sol Ultrafast и Claude: Автономия и безопасность
OpenAI запустила режим Sol Ultrafast в API, обеспечивающий ускорение до 14x. Параллельно в Claude Code режим Auto стал дефолтным, так как считается надежным. Примечательно, что авто-режим часто перехватывает вредоносные действия лучше человеческого контроля, так как пользователи склонны массово одобрять промпты из-за усталости. Также OpenAI тестирует Private Safety Processing: ИИ анализирует данные в реальном времени, передавая только категории угроз, а не сами данные, что создает дилемму между приватностью и безопасностью.
Рынок и тренды: Агенты и дискриминация
Использование агентов (agentic use) в OpenAI достигло 64% от всех токенов (рост с почти нуля за год). При этом «передовые компании» (frontier firms) потребляют ИИ значительно быстрее обычных фирм. В то же время LLM все еще не справляются с юридическими рисками: если инструкции явно дискриминационны, ИИ не защитит от исков. Также отмечается, что прорыв Moderna в вакцине от меланомы (фаза 3) — результат многолетней работы, а не магии ИИ, хотя ИИ и ускоряет будущие исследования.
Сводка характеристик моделей
| Модель | Разработчик | Ключевая метрика/Особенность | Цена/Рыночная реакция |
|---|---|---|---|
| Gemini 3.7 Flash | Intelligence Score: 56 (Artificial Analysis) | На 50% дешевле 3.6 Flash до конца года | |
| GLM-5.3 | Zhipu AI | Пост-обучение GLM-5.2, упор на кибербезопасность | Акции Zhipu -9%, MiniMax -16% |
| Sol Ultrafast | OpenAI | Ускорение инференса до 14x | Новый режим в API |
| Claude Code (Auto) | Anthropic | Авто-режим стал дефолтным | Доступно во всех платных планах |
Источник: LessWrong ↗
