Главная/Блог/Обзор/Qwen 3.8 27B: Революция локального ИИ…
Обзор13 мин чтения · 15 августа 2026 г.

Qwen 3.8 27B: Революция локального ИИ на RTX 4090

Полный разбор Qwen 3.8 27B от Alibaba: запуск на RTX 4090, сравнение с Opus 4.6, генерация игр, веб-интерфейсов, SVG и 3D-сцен. Как запустить модель локально и бесплатно.

Qwen 3.8 27B: Революция локального ИИ на RTX 4090

Вы видите это прямо сейчас? Я запускаю модель Qwen 3.8 с 27 миллиардами параметров, используя динамическое 4-битное квантование Unsloth на своей видеокарте RTX 4090, и результаты действительно заставляют меня потерять дар речи. Я получаю уровень интеллекта, сопоставимый с Opus, работая локально и абсолютно бесплатно. Это, возможно, лучшая локальная ИИ-модель, которую я когда-либо тестировал, и я настоятельно рекомендую вам попробовать её после просмотра этого видео.

Это агентная модель для программирования, обладающая безумными возможностями, которые помогут вам во многих задачах. Как и обещала команда Alibaba, открытые веса серии Qwen 3.8 наконец-то доступны, включая модель на 27 миллиардов параметров. Это серьезное обновление, потому что это нативная мультимодальная плотная модель, которая, несмотря на относительно скромные 27 миллиардов параметров, заявляет, что превосходит Qwen 3.7 plus в целом, особенно в реальных задачах программирования, агентных сценариях и офисных рабочих процессах.

Честно говоря, вы получаете уровень интеллекта, сопоставимый с флагманскими коммерческими моделями, локально, что просто безумие. Также вы получаете нативное контекстное окно объемом 262 тысячи токенов, которое можно расширить до 1 миллиона токенов с помощью технологии YARN. А поскольку модель выпущена под лицензией Apache 2.0, вы можете скачать её, запустить локально, дообучить (fine-tune) и строить на её основе свои решения.

Alibaba также выпустила гораздо более крупную модель Qwen 3.8 (MOE), которая является их флагманской моделью с открытыми весами. Так что, хотите ли вы попробовать что-то практичное с моделью меньшего размера или создать большую агентную систему вокруг модели с триллионами параметров, линейка Qwen 3.8 официально доступна, и её стоит установить, если у вас есть ресурсы.

01Почему Qwen 3.8 27B — это прорыв для локального запуска

В отношении бенчмарков эта модель впечатляет особенно сильно. Это компактная плотная модель, которая фактически превосходит Qwen 3.7 plus почти во всех категориях. Она также отлично зарекомендовала себя в программировании. Вы получаете сильные результаты в реальном коде, агентных рабочих процессах и задачах офисной продуктивности. Что делает её еще более интересной, так это то, что это не просто текстовая модель. Она нативно мультимодальна, что означает, что она может понимать и рассуждать над изображениями.

Вы можете подавать ей скриншоты, графики, просить реализовать макеты интерфейсов на основе визуального ввода, а также работать с другими визуальными данными вместе с текстом. Комбинируя это с нативным контекстным окном, вы получаете модель, которая может кодить, рассуждать, анализировать визуальную информацию и обрабатывать чрезвычайно длинные документы, оставаясь при этом достаточно маленькой, чтобы реалистично запускаться локально.

Интерфейс Qwen 3.8 27B с графиками и данными
Интерфейс Qwen 3.8 27B с графиками и данными
💡
Совет по выбору квантования. Для большинства пользователей рекомендуется версия Q4 (4-bit), которая снижает объем модели до приемлемого уровня. Это оптимальный баланс между качеством и скоростью. Версия Q5 может дать незначительное улучшение качества, но Q4 часто дает схожие результаты с более тяжелыми версиями, экономя ресурсы VRAM.

Как я упоминал в начале, эта модель на 27 миллиардов параметров дает вам уровень интеллекта программирования Opus 4.6, и многие из этих тестов локально выполняются бесплатно. В одном идентичном промпте «Атлантида на Three.js» Qwen создал более сильную общую сцену, лучшее генерирование храма, более сильные фокусные точки и больше деталей, обеспечивающих визуальную глубину. В то время как Opus стоит денег через API и работает немного медленнее, Qwen демонстрирует практически лучшие результаты. Это дает вам открытые веса, локальный инференс и производительность уровня frontier без оплаты за каждый промпт.

Интерфейс Atomic Agent с Qwen 3.8 27B
Интерфейс Atomic Agent с Qwen 3.8 27B

02Производительность и скорость: сколько токенов в секунду?

По сообщениям, модель достигает около 206 токенов в секунду на одной RTX 5090 с квантованием NVFP4 и примерно 38 токенов/с на DGX Spark. При этом она относительно небольшая: сильна в агентном планировании и задачах с длинным горизонтом, и при этом запускается локально с действительно впечатляющей скоростью.

Hugging Face интерфейс с моделями Qwen 3.8 27B
Hugging Face интерфейс с моделями Qwen 3.8 27B

Если вы хотите запустить модель Qwen 3.8 27B самостоятельно, это удивительно доступно. Для большинства людей я бы рекомендовал идти с версией 4-бит, которая снижает модель до примерно 17 ГБ. Если хотите понять, как именно запустить модель на своём железе, загляните в World of AI Benchmark и платформу Bobcoin. Это место, где вы можете указать свое оборудование, все различные спецификации вашего компьютера, такие как системная оперативная память (RAM), ядра CPU, а также целевой контекст. Затем, указав это, вы сможете увидеть, какая модель лучше всего подходит для вас.

Qwen 3.8 Web Demo генерирует Airbnb-сайт
Qwen 3.8 Web Demo генерирует Airbnb-сайт

В данном случае я настроил так, что модель лучше всего подходит для моих требований. Причина в том, что она упаковывает качество, а также скорость и эффективность. Если я поищу модель здесь, я покажу, какой размер квантования вам следует использовать. В моем случае лучший вариант — использовать квантование, но вы можете снизить его, и вы все равно получите схожие результаты с тем, что вы получили бы с более высоким уровнем.

Может быть некоторое расхождение в этих двух случаях, но в большинстве случаев вы получите отличные результаты. В целом, это означает, что вы можете запустить её с хорошей игровой видеокартой, а также на некоторых ноутбуках или Mac с чипом Apple Silicon, если у них достаточно объединенной памяти. Если у вас меньше памяти, есть даже более маленькие версии, хотя вы пожертвуете некоторым качеством.

Qwen 3.8 27B локально в Atomic Agent
Qwen 3.8 27B локально в Atomic Agent
⚠️
Важно про память. Для комфортной работы с 4-битной квантованной версией Qwen 3.8 27B требуется минимум 16-20 ГБ видеопамяти (VRAM). Видеокарты уровня RTX 3060 (12GB) могут не справиться с полным контекстом, тогда как RTX 4090 (24GB) или RTX 4080 Super (16GB с оверклокингом/оптимизацией) работают идеально. Для Mac M1/M2/M3 Pro/Max требуется минимум 32 ГБ объединенной памяти.

03Тест программирования: Создание игры Call of Duty Zombies

Для этого видео я запускаю 4-битную версию модели локально: вся модель помещается на моей видеокарте. Я использую динамическое 4-битное квантование Unsloth и работаю через OpenWebUI — без API и без оплаты за промпты. Всё это делается бесплатно.

Если хотите прогнать собственные бенчмарки, модель можно подключить к своему эндпоинту через World of AI Benchmark и Coding Tool — неплохой харнесс, чтобы увидеть, как модель ведёт себя на вашем железе.

Интерфейс Qwen 3.8 с кодом HTML
Интерфейс Qwen 3.8 с кодом HTML

Начну с того же, что делал вчера с GLM 5.3: создать игру Call of Duty Zombies на Three.js. Промпт простой — давайте посмотрим, что она выдаст.

Результат поразительный: рабочие компоненты, разное оружие, волны зомби, идущие на вас. Есть небольшие анимации: зомби выходят из определённых мест, можно разблокировать разные области и получать усиления вроде Juggernaut — механика, которая есть и в самой игре.

Сравнение Qwen 3.8 27B и Claude Opus 4.6
Сравнение Qwen 3.8 27B и Claude Opus 4.6

Я никогда не играл в Zombies, но много играл в Warzone — и качество, которое смогла вывести модель, впечатляет. Есть атмосфера, разные механики: можно покупать оружие, подбирать припасы и патроны.

Модель добавила столько глубины, что это само по себе круто: тут и Mystery Box (механика из самой игры), и новое оружие в виде дробовика, и усиления вроде Instant Kill — зомби просто исчезают. Именно такого качества можно ждать от этой модели.

Таблица бенчмарков Qwen3.8-27B против других моделей
Таблица бенчмарков Qwen3.8-27B против других моделей

04Генерация веб-интерфейсов: От Landing Page до macOS Clone

Когда мы смотрели на Qwen 3.8 Max, мы видели, какой огромный скачок сделала модель в визуальной глубине фронтендов. И это перешло в Qwen 3.8 27B: судя по сгенерированным интерфейсам, она стала существенно лучше предыдущей версии — при своём размере выводит плотные, красивые фронтенды.

Один из моих стандартных тестов — посадочная страница NVIDIA GPU. Здесь модель сгенерировала прилично, попробовав 3D-дизайн. Есть странности: например, блеск отображается по всей странице, а не только на GPU. Но в целом она выводит рабочие генерации — триггеры прокрутки, анимации, разную типографику. Каркас — отличное начало, дальше его можно дорабатывать под свои задачи.

Qwen 3.8 27B генерирует дизайн-макеты
Qwen 3.8 27B генерирует дизайн-макеты

Вот ещё одна сгенерированная посадочная страница. Одна крупная ошибка — пустое место посередине, но структура остального выглядит хорошо. Я сгенерировал и ещё одну, где при прокрутке вниз должен был меняться визуальный прогресс — здесь это не сработало.

Теперь клон macOS, который я попросил её сгенерировать. В данном случае у меня контекст 32k токенов с учётом квантования, но генерации всё равно приличные. Здесь она воспроизвела свежее обновление Tahoe: есть небольшие анимации — даже на виджете погоды, часы, расписание, и эффекты, которые проявляются при наведении курсора.

Не всё функционально: строка меню лишь имитирует работу, а музыкальный плеер, батарея и верхняя панель не работают так, как должны. Ничего открыть в Finder не удаётся — вероятно, из-за ограничения контекста. Тем не менее она прокодила много отдельных приложений и даже попыталась сделать SVG-иконки для каждого. Фон можно менять, тёмная тема работает — и это здорово.

Экран с интерфейсом генерации приложений и логотипом Qwen
Экран с интерфейсом генерации приложений и логотипом Qwen

05Мультимодальность и работа с изображениями: Клон Airbnb

Модель мультимодальная и работает с визуальным вводом — поэтому попросим её клонировать сайт Airbnb. Первая попытка выдала небольшую ошибку в форматировании, но затем она начала кодить. И вот результат. Есть вещи, которые могли бы быть лучше: SVG она закодировала не полностью — видимо, ограничивает контекст. Но основную структуру, верхнюю панель и логотип она сделала — приличная работа.

Попытался дожать результат промптингом. Во второй итерации логотип и верхняя панель пропали — видимо, она сначала закодировала отдельные иконки, а затем изображения в SVG. Пока это худшая генерация, возможно из-за моего промпта, но и здесь видно: с SVG модель работает вполне прилично.

Сравнение визуальной глубины сцены, сгенерированной Qwen 3.8 27B и Opus 4.6
Сравнение визуальной глубины сцены, сгенерированной Qwen 3.8 27B и Opus 4.6

Qwen 3.8 Max — флагманская MoE-модель Alibaba на 2,4 триллиона параметров — отлично справлялась с веб-разработкой. И этот уровень перешёл в новую 27-миллиардную модель: судите по нескольким мини-играм, которые она смогла вывести, — качество высокое.

Она на удивление хороша в SVG. Я попросил её нарисовать картину — и получилось довольно хорошо текстурированное изображение. Из недостатков: некоторые объекты размещены не там, где нужно (дом, возможно, должен быть у берега, а мост — иначе). Мелочи, но в целом визуальная глубина этой генерации выдающаяся.

Интерфейс OpenWebUI с выводом токенов в реальном времени
Интерфейс OpenWebUI с выводом токенов в реальном времени

06SVG-арт и 3D-симуляции: Детали и ошибки

Затем у нас есть Нью-Йорк, который был симулирован. И это всё сделано в SVG. И сразу бросается в глаза одна вещь: летящий корабль, которого тут не должно быть — он явно должен был быть в воде. Но помимо этого, всё остальное кажется довольно хорошим с точки зрения того, что он смог вывести. Даже у машин есть фары, что является визуальной деталью, которую большинство моделей на самом деле не генерируют. Даже небоскребы, все эти башни имеют красный свет для безопасности самолетов. И, очевидно, переход от дня и ночи идеален. Так что это, очевидно, отличная генерация сама по себе.

Платформа World of AI Benchmark для подбора модели
Платформа World of AI Benchmark для подбора модели

Далее — 3D-модель продукта. Модель сделала большую часть: в некоторых ракурсах не показываются все элементы — это основной недостаток. Но в целом всё выглядит функционально, а дисплей приличный. Есть и неудачные генерации — например, F1-дрифт по кругу.

Симуляция дрифта показывает, насколько модель хороша в SVG: машина в определённых углах выглядит хорошо, задний дым при дрифте тоже есть. Но 3D-окружение тут слабее, чем у других моделей, — оценку бы дал низкую.

А вот симуляцию аквариума она вывела отлично: все сущности остаются внутри окружения. Обычно рыбы у разных моделей в итоге покидают аквариум — такое видели и у других моделей, не справился даже Gemini. Здесь же генерация красивая, не хватает лишь текстур на отдельных рыбах.

Выбор квантования модели Qwen 3.8 27B
Выбор квантования модели Qwen 3.8 27B

Далее — изометрическая комната на Three.js. Освещение и визуальная глубина приятные. Одна большая ошибка: деревянная плита генерируется прямо в кровати. В остальном всё хорошо: маленькая лампа, растение у стола, и даже кот, сгенерированный на ковре. В 3D модель поработала прилично — и это на самом деле круто.

А ещё эта модель создала полноценный клон GTA: можно стрелять в людей, красть машины. Есть звуковые эффекты — полиция преследует, за преступления начисляются звёзды розыска, машины взрываются. Всё работает так, как в настоящей игре. Мне реально нравится, что получилось в этой генерации.

Лендинг-страница NVIDIA, сгенерированная моделью
Лендинг-страница NVIDIA, сгенерированная моделью

07Итоговые выводы: Кому подойдет Qwen 3.8 27B?

Мои два цента: это, возможно, самая впечатляющая локальная модель, которую я когда-либо тестировал. Не «возможно», а точно: она даёт уровень интеллекта, близкий к Opus 4.6, во многих задачах, а в ряде случаев — сопоставимый с передовыми коммерческими моделями.

Она, конечно, не пытается победить frontier-модели во всём. Но то, что модель работает на собственном оборудовании и при этом даёт такой уровень программирования, агентного рассуждения, зрения и следования инструкциям — я такого не видел ни в одной другой локальной модели. Если у вас есть железо — настоятельно рекомендую попробовать. Инструмент World of AI помогает понять, какую модель вы реально можете запустить, и даёт доступ ко всем моим промптам.

Клон интерфейса macOS Tahoe iOS
Клон интерфейса macOS Tahoe iOS
Клон сайта Airbnb, созданный кодом
Клон сайта Airbnb, созданный кодом
SVG-симуляция Нью-Йорка с летающим кораблем
SVG-симуляция Нью-Йорка с летающим кораблем
📌
Факт для практиков. Лицензия Apache 2.0 позволяет коммерческое использование, модификацию и распространение. Это делает модель идеальным выбором для создания собственных коммерческих продуктов, где важно избежать юридических рисков, связанных с более строгими лицензиями.

В России доступ к таким моделям через локальный запуск полностью свободен от геоблокировок. Вам не нужны VPN для доступа к API, так как всё работает на вашем железе. Для энтузиастов ИИ, разработчиков и компаний, стремящихся снизить затраты на ИИ-инфраструктуру, модель становится новым стандартом. Она заполняет нишу между легкими моделями и тяжеловесами, предлагая «золотую середину» по соотношению цена/качество/скорость.

Кому что подойдёт

Для геймеров и энтузиастов с RTX 3060/4060 Ti 16GB/4070/4080/4090: Это ваша лучшая опция. Модель помещается в VRAM, работает быстро (до 200+ токенов/с на мощных картах) и дает качество, близкое к платным API. Идеально для локальных чат-ботов, помощников по коду и креативных задач.

Для разработчиков ПО: Используйте Qwen 3.8 27B для автодополнения кода, рефакторинга и генерации UI-компонентов. Её способность понимать визуальные макеты (через мультимодальность) и генерировать чистый HTML/CSS/JS делает её мощным инструментом в IDE.

Для бизнеса и стартапов: Благодаря лицензии Apache 2.0, вы можете развернуть эту модель на своих серверах для обработки данных клиентов без передачи информации третьим лицам. Это обеспечивает безопасность и конфиденциальность, недостижимые при использовании публичных API.

Для владельцев Mac (M1/M2/M3 Pro/Max): Если у вас 32 ГБ+ объединенной памяти, эта модель будет работать плавно. Apple Silicon отлично оптимизирован для работы с большими языковыми моделями, и Qwen 3.8 27B покажет отличные результаты на Mac.

В заключение, Qwen 3.8 27B — это не просто еще одна модель. Это поворотный момент в демократизации ИИ. Она доказывает, что для большинства повседневных задач не нужны триллионы параметров. Достаточно умной архитектуры, качественного обучения и правильного квантования. Попробуйте её, и вы, возможно, тоже потеряете дар речи от результатов.

Источник: видео-разбор (YouTube) ↗