unslothai/unsloth

Unsloth Studio is a web UI for training and running open models like Gemma 4, Qwen3.6, DeepSeek, gpt-oss locally.

Обучение⭐ 76 515Pythonпоследний релиз: v0.1.811-beta
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

Unsloth Studio — это веб-интерфейс для локального запуска и обучения открытых LLM, таких как Gemma 4, Qwen3.6 и DeepSeek.

Зачем нужен

Инструмент упрощает работу с моделями, позволяя обучать их на 500+ архитектурах с использованием на 70% меньше VRAM и в 2 раза быстрее за счёт кастомных Triton-ядер. Он также предоставляет удобный интерфейс для инференса, экспорта моделей и управления данными.

Что можно реализовать

  • Локальный запуск и тестирование моделей GGUF, LoRA и safetensors через веб-интерфейс
  • Обучение моделей методом RL (GRPO, FP8) с минимальным потреблением видеопамяти
  • Автоматическое создание датасетов из PDF, CSV и DOCX через визуальный редактор
  • Экспорт обученных моделей в форматы GGUF и 16-bit safetensors
  • Интеграция локальных LLM с внешними API (OpenAI, Anthropic) или серверами (vLLM, Ollama)

Ключевые возможности

  • Снижение потребления VRAM на 70% и ускорение обучения в 2 раза без потери точности
  • Поддержка обучения более 500 моделей, включая full fine-tuning, pretraining и 4/16/8-bit режимы
  • Встроенная поддержка tool calling с self-healing и выполнения кода в песочницах
  • Кроссплатформенность: работает на Windows, Linux, WSL и macOS (включая MLX)
  • Возможность публичного доступа через бесплатный Cloudflare tunnel с защитой API-ключа

👤 Кому подойдёт: разработчики, исследователи и энтузиасты, работающие с локальными LLM на Windows, Linux и macOS

Релизы

v0.1.811-betamajor
🕐 2 дн назад · релиз на GitHub ↗

Релиз v0.1.811-beta: поддержка RDNA, ARM64 Windows, FP8/INT8 диффузии, мультиаккаунты и ускорение Qwen3.8-Flash-Next.

  • Added: Новый Docker-образ с поддержкой NVIDIA и AMD ROCm, улучшенное управление данными и настройками.
  • Added: Мультиаккаунты с изоляцией данных и раздельными паролями в настройках.
  • Added: Поддержка видеокарт AMD RDNA1/2 и нативная сборка для Windows ARM64.
  • Added: Ускоренный инференс диффузии изображений в форматах INT8/FP8 (в 2 раза быстрее).
  • Fixed: Hotfix для Qwen3.8-Flash-Next: ускорение MTP в 2 раза.
v0.1.810-betamajor
🕐 4 дн назад · релиз на GitHub ↗

Релиз v0.1.810-beta: многопользовательские аккаунты, поддержка AMD RDNA1/2, ARM64 Windows, FP8/INT8 диффузии и улучшения GRPO.

  • Added: Добавлены многопользовательские аккаунты с изоляцией данных и настроек.
  • Added: Обновлен Docker-образ с поддержкой AMD ROCm и улучшенной персистентностью данных Studio.
  • Added: Включена поддержка GPU AMD RDNA1/2 и нативная сборка для Windows ARM64.
  • Added: Оптимизирован инференс Image Diffusion в форматах INT8/FP8 (ускорение в 2 раза).
  • Added: Улучшена поддержка GRPO: добавлена совместимость с Qwen3.5, TRL и vLLM.
v0.1.808-betamajor
🕐 11 дн назад · релиз на GitHub ↗

Релиз v0.1.808-beta: ускорение диффузии и MLX, переход на PyTorch 2.11, оптимизация для AMD/Windows и 250+ исправлений.

  • Added: Ускорение диффузии на 1.2–1.7x, оптимизация Strix Halo и экономия памяти KV-кэшей MLX до 74%.
  • Added: PyTorch 2.11 стал версией по умолчанию; улучшена работа MLX на Apple Silicon и добавлена поддержка DoRA.
  • Fixed: Исправлены проблемы с Vulkan на AMD iGPU, подписаны бинарники Windows, устранены ошибки загрузки RAG и AppImage.
  • Added: Добавлен GPT-6 Astra для Codex, улучшен OpenAI API и опубликованы новые Docker-образы для Studio.
  • Fixed: Удалено более 250 багов, размер бинарных файлов уменьшен на 60%, исправлены ложные срабатывания антивирусов.
v0.1.807-betamajor
🕐 13 дн назад · релиз на GitHub ↗

Релиз v0.1.807-beta: ускорение AMD через Vulkan, PyTorch 2.11, исправления MLX, улучшен Studio и API.

  • Added: AMD-устройства (Strix, iGPU) теперь используют Vulkan по умолчанию, что даёт прирост производительности до 23%.
  • Added: PyTorch обновлён до версии 2.11, размер Python-пакета уменьшен на 44%, добавлены новые Docker-образы.
  • Added: Улучшена работа MLX на Apple Silicon: ускорение обучения, экономия памяти KV-кэшей и поддержка DoRA.
  • Fixed: Исправлены зависания загрузки RAG, лаги AppImage, проблемы с загрузкой моделей на Windows и ошибки API.
  • Added: В Studio добавлена поддержка GPT-6 Astra для Codex-логов и улучшено потоковое вещание OpenAI-совместимого API.
v0.1.806-betamajor
🕐 19 дн назад · релиз на GitHub ↗

Ускорение Qwen3.8 и GLM-5.3 через MTP, поддержка аудио и MLX, улучшения обучения и стабильности.

  • Added: Qwen3.8-Flash-Next и GLM-5.3-Flash работают до 2x быстрее благодаря включённому по умолчанию MTP.
  • Added: Добавлена поддержка генерации аудио моделями MiniMax-Music3, Higgs и MOSS с отслеживанием прогресса.
  • Added: Улучшено инференс на Apple Silicon: ускорение MLX, полная поддержка контекста и очистка памяти.
  • Added: Расширены возможности чата: параллельные вызовы инструментов, работа с изображениями и Deep Research.
  • Fixed: Исправлены ошибки загрузки моделей, стабильность AMD/ROCm и корректность сохранения настроек в Studio.
v0.1.804-betamajor
🕐 25 дн назад · релиз на GitHub ↗

Поддержка Qwen3.8-Flash-Next и GLM-5.3-Flash, умное распределение памяти, исправление сбоев на Linux/AMD и восстановление чатов.

  • Added: Локальный запуск Qwen3.8-Flash-Next (125B) на 75 ГБ RAM и GLM-5.3-Flash (320B) на 102 ГБ общей памяти.
  • Added: Умное распределение весов между GPU и RAM с предварительной оценкой требуемой памяти.
  • Added: Восстановление чата после разрыва соединения и поддержка нескольких изображений в визуальных диалогах.
  • Fixed: Исправлены зависания интерфейса NVIDIA+Wayland, сбои загрузки моделей на AMD и проблемы с записью голоса на Linux.
  • Fixed: Исправлена загрузка моделей llama.cpp в Windows с неанглийскими символами в путях профилей.
v0.1.803-betaminor
🕐 27 дн назад · релиз на GitHub ↗

Релиз v0.1.803-beta: экспериментальная автокомпактация чатов, LAN-доступ, поддержка Qwen3.8-27B и 170+ исправлений.

  • Added: Экспериментальная автокомпактация для длинных диалогов с сохранением поиска по устаревшим сообщениям.
  • Added: Превью LAN-доступа для управления через сеть без использования Cloudflare.
  • Added: Поддержка Qwen3.8-27B Dynamic v3.0 с повышенной точностью и кастомных сборок llama.cpp.
  • Fixed: Исправлены ошибки MLX, AMD, улучшена стабильность и производительность (170+ PR).
  • Added: Добавлена поддержка Intel XPU, структурированного вывода API и OpenCode V2.
v0.1.802-betapatch
🕐 27 дн назад · релиз на GitHub ↗

Релиз v0.1.802-beta: исправление ошибок MLX, AMD, поддержка LAN без ключей и 170+ улучшений.

  • Fixed: Исправлены ошибки установки и работы MLX на macOS, а также устранены проблемы с AMD.
  • Added: Добавлена поддержка LAN API без необходимости использования ключей или паролей.
  • Added: Появилась возможность переключать загрузку через XET и HTTP.
  • Fixed: Внесено более 170 исправлений ошибок и улучшений в Studio и CI.
v0.1.801-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Релиз Unsloth v0.1.801-beta: экспериментальная автокомпрессия чатов, удалённый доступ по LAN, поддержка Intel XPU и Qwen3.8-27B Dynamic v3.0.

  • Added: Экспериментальная автокомпрессия: позволяет вести длинные диалоги за пределами контекстного окна с сохранением возможности поиска по архиву старых сообщений.
  • Added: Превью-режим удалённого и LAN-доступа: управление настройками сети, QR-коды и автозапуск без использования Cloudflare.
  • Added: Поддержка Intel XPU и кастомных сборок llama.cpp с тонкой настройкой кэширования, Mmap, Mlock и специкулятивного декодирования.
  • Added: Выход Unsloth Dynamic v3.0 для Qwen3.8-27B: GGUF-модели с точностью top-1 выше на 10% по сравнению с аналогами.
  • Added: Улучшения интерфейса: ускоренный стриминг, очереди промптов, горячие клавиши, инструмент edit_file и поддержка OpenCode V2.
v0.1.800-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Поддержка Qwen3.8-27B и MiniMax-H3, ускорение инференса и новые инструменты в Unsloth Desktop.

  • Added: Добавлена локальная поддержка Qwen3.8-27B и Qwen3.8-2.4T с возможностью тонкой настройки и использованием GGUF.
  • Added: Оптимизирована работа с MiniMax-H3: ускорение FP8 в 10 раз и фильтрация моделей по возможностям GPU.
  • Added: В чат интегрированы инструменты, поддержка Codex, транскрипции YouTube и сохранение контекста с цитатами.
  • Added: Добавлено поле для кастомных аргументов llama-server с валидацией флагов для безопасности и совместимости.
  • Fixed: Исправлено игнорирование LoRA в vLLM GRPO, улучшена поддержка AMD RDNA и диагностика в режиме отладки.
v0.1.701-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Выход Unsloth Desktop для Windows, macOS и Linux с поддержкой новых моделей, обучением без кода и исправлениями для AMD и Mac.

  • Added: Выпущено десктопное приложение Unsloth Desktop для локального запуска, обучения и экспорта моделей на Windows, macOS и Linux.
  • Added: Добавлена поддержка локального запуска Muse Glimmer 30B, Kimi K3, Qwen3.8, DeepSeek-V4 Flash 0731 и Gemma 4.
  • Added: Реализовано обучение моделей без кода (LLM, диффузионные модели, TTS) с ускорением до 2x и снижением потребления VRAM на 70%.
  • Added: Добавлена возможность генерации видео через MiniMax-H3 и ускорение инференса диффузионных моделей до 2x.
  • Fixed: Исправлено критически медленное скачивание на Windows (ускорено в 200 раз) и ошибка запроса инструментов командной строки на Mac.
  • Fixed: Исправлено определение GPU AMD Strix Halo.
v0.1.70-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Выход Unsloth Desktop: локальный запуск и обучение моделей (Muse Glimmer 30B, MiniMax-H3) без кода на Windows, macOS и Linux.

  • Added: Выпущено десктопное приложение Unsloth Desktop для Windows, macOS и Linux.
  • Added: Поддержка локального запуска Muse Glimmer 30B, Kimi K3, Qwen3.8, DeepSeek-V4 Flash 0731 и Gemma 4.
  • Added: Генерация видео через MiniMax-H3 и ускорение работы диффузионных моделей до 2×.
  • Added: Обучение моделей без кода с экономией до 70% VRAM и ускорением до 2×.
  • Added: Улучшен вызов инструментов: самовосстановление вызовов и песочница для выполнения кода.
  • Added: Экспорт в NVFP4, GGUF и удалённый доступ через Cloudflare HTTPS.
v0.1.61-betaminor
🕐 1 мес назад · релиз на GitHub ↗

Поддержка Muse Glimmer 30B, MiniMax-H3 и диффузии; улучшения Studio и исправления.

  • Added: Добавлена поддержка модели Meta Muse Glimmer 30B с оптимизацией для локального запуска и тонкой настройки.
  • Added: Реализована поддержка генерации видео MiniMax-H3 и предварительная поддержка image diffusion.
  • Added: В чате теперь доступны для скачивания артефакты, обновлена страница обучения.
  • Fixed: Исправлены ошибки интерфейса Studio, включая отображение в темной теме, выравнивание и работу с терминалом.
  • Fixed: Улучшена стабильность десктопного приложения: защита от отправки запросов на непроверенные порты и предупреждения при выходе.
v0.1.526-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Добавлена поддержка локального запуска Kimi K3 и DeepSeek V4 Flash через Dynamic GGUF, улучшена установка и исправлены ошибки.

  • Added: Появилась поддержка моделей Kimi K3 и DeepSeek V4 Flash с использованием Unsloth Dynamic GGUFs и авто-оффлоадингом.
  • Added: Улучшена скорость загрузки и добавлена автоматическая подмена XET на HTTP для стабильности на разных системах.
  • Fixed: Исправлены ошибки установки и работы на macOS, а также устранены сбои в CI.
  • Added: Включена поддержка DSpark по умолчанию, что обеспечивает ускорение инференса в 2 раза.
  • Fixed: Исправлено сохранение контекста рассуждений (reasoning) для Qwen3.x и улучшена работа десктопного приложения.
v0.1.525-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Добавлена поддержка локального запуска Kimi K3 и DeepSeek V4 Flash через Dynamic GGUF, улучшена установка и исправлены ошибки.

  • Added: Появилась поддержка моделей Kimi K3 и DeepSeek V4 Flash с использованием Unsloth Dynamic GGUFs и DSpark.
  • Added: Улучшена скорость загрузки и оптимизировано использование памяти для Colab, систем с низким и высоким объемом ресурсов.
  • Fixed: Исправлены ошибки, улучшена стабильность установки и устранены проблемы с поддержкой macOS.
  • Fixed: Сохраняется контекст рассуждений (reasoning) между ходами для модели Qwen3.x.
  • Added: Подтверждена безопасность: Unsloth не использует уязвимые версии пакетов из инцидента с Keyv.
v0.1.524-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Поддержка локального запуска Kimi K3 и DeepSeek V4 Flash через Dynamic GGUF, улучшения загрузки и исправления Studio/Desktop.

  • Added: Добавлена поддержка запуска моделей Kimi K3 и DeepSeek V4 Flash локально через Dynamic GGUF с автоматическим распределением слоев.
  • Added: Улучшена эффективность загрузки моделей для Colab, систем с малым и большим объемом памяти, добавлен автофоллбэк на HTTP.
  • Added: Поддержка DSpark для DeepSeek V4 включена по умолчанию, что обеспечивает ускорение инференса в 2 раза.
  • Fixed: Исправлено сохранение контекста рассуждений (reasoning) между ходами для модели Qwen3.x.
  • Fixed: Улучшена стабильность Studio и Desktop: исправлены таймауты загрузки, сохранение размера окна и обработка сигналов прерывания.
v0.1.522-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Добавлена поддержка локального запуска DeepSeek V4 Flash и Kimi K3 через Dynamic GGUF, улучшено скачивание и безопасность.

  • Added: Появилась поддержка локального запуска моделей DeepSeek V4 Flash и Kimi K3 через формат Dynamic GGUF.
  • Added: Улучшена скорость скачивания для Colab, систем с малым и большим объемом памяти, добавлен автофоллбэк на HTTP.
  • Added: Добавлены новые варианты квантования (UD-IQ1_S, UD-Q4_K_XL и др.) с указанием требований к дисковому пространству.
  • Fixed: Исправлено сохранение контекста рассуждений (reasoning) для моделей Qwen3.x.
  • Fixed: Предупреждения о принудительном отключении упаковки данных теперь выводятся явно.
  • Added: Подтверждена безопасность: Unsloth не использует уязвимые версии пакетов из инцидента с Keyv.
v0.1.521-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Поддержка локального запуска Kimi K3 и DeepSeek V4 Flash через Dynamic GGUF, улучшено скачивание и стабильность.

  • Added: Добавлена поддержка локального запуска моделей Kimi K3 и DeepSeek V4 Flash с использованием Dynamic GGUF.
  • Added: Улучшена скорость загрузки в Colab и на системах с разным объемом памяти, добавлен автофоллбэк на HTTP.
  • Added: Обновлены скрипты установки для macOS, Linux, WSL и Windows.
  • Fixed: Исправлено сохранение контекста рассуждений (reasoning) для Qwen3.x между сообщениями.
  • Fixed: Устранены сбои в CI, улучшена обработка сигналов завершения и стабильность десктопного приложения.
v0.1.52-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Поддержка локального запуска Kimi K3 и DeepSeek V4 Flash через Dynamic GGUF, улучшение загрузки и безопасность.

  • Added: Добавлена поддержка локального запуска моделей Kimi K3 и DeepSeek V4 Flash с использованием Unsloth Dynamic GGUFs.
  • Added: Улучшена эффективность загрузки моделей для Colab, систем с низким и высоким объемом памяти, добавлен автофоллбэк на HTTP.
  • Added: Представлены новые варианты квантования UD-IQ1_S, UD-IQ3_XXS, UD-Q4_K_XL и UD-Q8_K_XL для указанных моделей.
  • Fixed: Исправлены сбои CI, предупреждения при отключении упаковки, сохранение рассуждений для Qwen3.x и ошибки десктопного приложения.
  • Подтверждено, что Unsloth не затронут инцидентом безопасности Keyv, так как используются безопасные версии зависимостей.
v0.1.512-betamajor
🕐 1 мес назад · релиз на GitHub ↗

Запуск DeepSeek V4 Flash и Kimi K3, параллельные чаты, Deep Research и улучшенная поддержка AMD/Intel.

  • Added: Добавлена поддержка локального запуска моделей DeepSeek V4 Flash и Kimi K3 через Dynamic GGUF.
  • Added: Реализован режим параллельных чатов с независимыми индикаторами прогресса и остановкой.
  • Added: Встроен Deep Research: планирование, поиск, проверка фактов и формирование отчётов с цитированием.
  • Added: Расширена поддержка AMD (RDNA2, MI50, Vulkan) и добавлена работа с Intel XPU.
  • Added: Добавлена поддержка обучения DoRA и улучшена стабильность скачивания через HTTP.
v0.1.48-betamajor
🕐 2 мес назад · релиз на GitHub ↗

Ускорение GRPO и MoE, экспорт NVFP4/FP8, API с авто-свопом моделей, поддержка японского и португальского, исправления ROCm и macOS.

  • Added: Ускорение GRPO на 1.3x и MoE-обучения в 3–5 раз.
  • Added: Экспорт моделей в NVFP4, FP8, imatrix GGUF и сжатые форматы.
  • Added: OpenAI-совместимое API с авто-переключением моделей и лечением tool-calls.
  • Added: Поддержка японского и бразильского португальского в интерфейсе.
  • Fixed: Исправления ROCm на WSL, Blackwell, macOS и обработки путей с пробелами.
v0.1.471-betamajor
🕐 3 мес назад · релиз на GitHub ↗

Поддержка GLM-5.2, 3x рост контекста, переработанный Hub, HTTPS-студии и параллельные модули.

  • Added: Добавлена поддержка модели GLM-5.2 со всеми уровнями рассуждений.
  • Added: Новый алгоритм MTP увеличил максимальную длину контекста в 3 раза.
  • Added: Внедрён режим secure для HTTPS-доступа через Cloudflare.
  • Added: Реализованы параллельные модули для одновременного обучения и чата.
  • Added: Полностью переработан Hub с лентой трендов и предпросмотром README.
  • Fixed: Исправлена работа fast inference в vLLM 0.22+ и поддержка GPU Blackwell.