Столкновение гигантов: Qwen 3.8 Max против Fable 5
В условиях гонки вооружений между крупными языковыми моделями, Alibaba Qwen 3.8 Max продемонстрировала выдающиеся результаты в задачах, требующих не только кодинга, но и пространственного мышления. Модель была протестирована на генерации самодостаточных HTML-файлов с реальной физикой, где она напрямую конкурировала с Fable 5. Результат стал показателем нового стандарта для автономного программирования и работы в команде (cowork).
Тестовые сценарии и визуальное качество
Для сравнения были выбраны три сложные сцены, требующие симуляции физических процессов:
- Мраморная машина: подъем шариков по колесу и их падение на петлю.
- Автомобильный конвейер: сборочная линия завода.
- Лесопилка: распиливание бревен на доски.
Qwen 3.8 Max сгенерировала код с высокой детализацией текстур и теней. В отличие от Fable 5, где объекты появлялись «из ниоткуда» (например, шарики в начале колеса) или проходили сквозь препятствия (бревно сквозь балку на лесопилке), Qwen обеспечила логичную последовательность действий и визуальную целостность сцен.
Экономическая эффективность и метрики
Главным преимуществом Qwen 3.8 Max стала не только точность, но и стоимость генерации. Модель использовала больше токенов для достижения высокого качества, что в итоге оказалось значительно выгоднее для пользователя.
| Метрика | Qwen 3.8 Max | Fable 5 |
|---|---|---|
| Количество токенов | 46.6K | 38.7K |
| Стоимость генерации | $0.28 | $1.93 |
| Отношение цен | Qwen почти в 7 раз дешевле | |
Технические характеристики и доступность
Qwen 3.8 Max позиционируется как новая планка для кодинга с архитектурой на 2.4 триллиона параметров. Модель демонстрирует способность к автономному программированию, способному работать в течение 10+ дней без вмешательства человека. Открытые веса для Qwen 3.8-Max и более легкой версии Qwen 3.8-27B будут опубликованы на следующей неделе. Платформа Atomic Chat уже анонсировала поддержку Qwen 3.8 Max для локального запуска «день ноль».
Источник: X ↗
