Релиз модели5 октября 2026 г., 09:18 МСК🤖 Auto

Qwen 3.5: 397B параметров и 1 млн контекста — новый стандарт Agentic AI

Alibaba представила Qwen 3.5 с архитектурой MoE (397B/17B) и контекстом 1 млн токенов, позиционируя модель как базу для агентов. За год параметры выросли с 235B до 397B, а лицензия Apache 2.0 закрепила доминирование в open-source.

Баннер новости 8926

От 7B к 397B: эволюция масштаба

История Qwen началась в апреле 2023 года с закрытого демо Tongyi Qianwen, но настоящий прорыв случился в августе 2023-го, когда Alibaba открыла веса Qwen-7B. За три с половиной года путь от модели размером с ноутбук до флагмана с 397 миллиардами параметров стал беспрецедентным. Ключевым драйвером стала стратегия open-weight: начиная с Qwen2, большинство моделей перешли на лицензию Apache 2.0, что сделало их стандартом де-факто для разработчиков.

Qwen 3.5: Архитектура для агентов

16 февраля 2026 года, в канун Китайского Нового года, Alibaba представила Qwen3.5. Это не просто обновление, а смена парадигмы под эру Agentic AI. Флагманская модель Qwen3.5-397B-A17B использует гибридную архитектуру линейного внимания (Gated DeltaNet), унаследованную от Qwen3-Next.

Ключевые характеристики:

  • Параметры: 397B всего, 17B активных (MoE-архитектура).
  • Контекст: Хостинговая версия Qwen3.5-Plus поддерживает до 1 миллиона токенов.
  • Производительность: Alibaba заявляет, что версия Qwen3.5-35B-A3B превосходит более старую Qwen3-235B-A22B-2507, демонстрируя эффективность малых моделей.

Сравнение флагманских моделей Qwen (2025–2026)

Модель Дата выхода Архитектура Активные параметры Контекст Статус
Qwen3-235B-A22B Апрель 2025 MoE (Гибридное мышление) 22B 262K (2507) Open (Apache 2.0)
Qwen3-Max Сентябрь 2025 MoE (Сверхмассивная) >1 Trillion Не указано API Only
Qwen3.5-397B-A17B Февраль 2026 MoE (Linear Attention) 17B 1M (Plus) Open Weights

Бизнес-контекст и кадровые изменения

Рост Qwen сопровождается масштабными инвестициями. CEO Эдди Уу анонсировал, что расходы на ИИ и облака превысят 380 млрд юаней ($53 млрд) за три года. Однако команда сталкивается с оттоком талантов: в марте 2026 года технический лидер Цзюньян Линь покинул проект, став третьим ключевым сотрудником, ушедшим из Qwen в 2026 году. При этом модель уже стала инфраструктурой: AI Singapore заменила Llama на Qwen в своей модели Sea-Lion, а приложение Qwen скачали более 10 млн раз за первую неделю бета-теста.

Почему это важно

Переход к 1 млн токенов и оптимизация через линейное внимание делают Qwen3.5 одной из немногих моделей, способных эффективно обрабатывать огромные объемы данных (например, целые кодовые базы или длинные документы) без катастрофического падения скорости. Гибридная архитектура позволяет балансировать между «быстрым» ответом и глубоким рассуждением, что критично для автономных AI-агентов.

Источник: MarkTechPost ↗