QwenLM/Qwen
Официальный репозиторий LLM Qwen (通义千问) от Alibaba Cloud.
LLM⭐ 21 795Python
Что это за инструмент
Qwen — это семейство больших языковых моделей (LLM) от Alibaba Cloud, включающее базовые модели и модели для диалога (Chat), доступные в различных размерах.
Зачем нужен
Инструмент предназначен для локального развертывания и интеграции в приложения, где требуется обработка естественного языка, генерация контента, программирование или работа с агентами. Он полезен тем, кто ищет открытую альтернативу проприетарным моделям с сильными показателями на бенчмарках и поддержкой длинных контекстов.
Что можно реализовать
- Локальный запуск чат-бота или ассистента на GPU с ограниченным объемом памяти (от 5.8 ГБ для Q-Lora).
- Генерация кода, решение математических задач и перевод текстов с использованием chat-версий моделей.
- Создание AI-агентов и использование внешних инструментов через встроенные механизмы взаимодействия.
- Обработка длинных документов благодаря поддержке контекстного окна до 32K токенов.
Ключевые возможности
- Широкий выбор размеров моделей: от легковесных 1.8B до мощных 72B, включая оптимизированные версии Int4 и Int8.
- Поддержка длинных контекстов (до 32K токенов) и усиление системных промптов.
- Мультимодальная подготовка на 3 трлн токенов с акцентом на китайский и английский языки.
- Низкие требования к ресурсам для дообучения (Fine-tuning) благодаря поддержке Q-Lora.
- Активная экосистема с поддержкой Hugging Face, ModelScope и API через DashScope.
👤 Кому подойдёт: разработчики, исследователи, бизнес, интересующиеся локальным развертыванием LLM и кастомизацией AI-решений
Релизы
Релизы ещё не отслежены — появятся после ближайшего опроса.