QwenLM/Qwen

Официальный репозиторий LLM Qwen (通义千问) от Alibaba Cloud.

LLM⭐ 21 795Python
Открыть на GitHub ↗

Что это за инструмент

Qwen — это семейство больших языковых моделей (LLM) от Alibaba Cloud, включающее базовые модели и модели для диалога (Chat), доступные в различных размерах.

Зачем нужен

Инструмент предназначен для локального развертывания и интеграции в приложения, где требуется обработка естественного языка, генерация контента, программирование или работа с агентами. Он полезен тем, кто ищет открытую альтернативу проприетарным моделям с сильными показателями на бенчмарках и поддержкой длинных контекстов.

Что можно реализовать

  • Локальный запуск чат-бота или ассистента на GPU с ограниченным объемом памяти (от 5.8 ГБ для Q-Lora).
  • Генерация кода, решение математических задач и перевод текстов с использованием chat-версий моделей.
  • Создание AI-агентов и использование внешних инструментов через встроенные механизмы взаимодействия.
  • Обработка длинных документов благодаря поддержке контекстного окна до 32K токенов.

Ключевые возможности

  • Широкий выбор размеров моделей: от легковесных 1.8B до мощных 72B, включая оптимизированные версии Int4 и Int8.
  • Поддержка длинных контекстов (до 32K токенов) и усиление системных промптов.
  • Мультимодальная подготовка на 3 трлн токенов с акцентом на китайский и английский языки.
  • Низкие требования к ресурсам для дообучения (Fine-tuning) благодаря поддержке Q-Lora.
  • Активная экосистема с поддержкой Hugging Face, ModelScope и API через DashScope.

👤 Кому подойдёт: разработчики, исследователи, бизнес, интересующиеся локальным развертыванием LLM и кастомизацией AI-решений

Релизы

Релизы ещё не отслежены — появятся после ближайшего опроса.