Sygil-Dev/sygil-webui

Stable Diffusion web UI

Vision⭐ 7 865Python
Открыть на GitHub ↗

Что это за инструмент

Sygil-Dev/sygil-webui — это веб-интерфейс для работы с моделями Stable Diffusion, доступный через браузер.

Зачем нужен

Инструмент позволяет генерировать изображения по текстовым описаниям (Text2Image) и редактировать существующие картинки (Image2Image). Он полезен тем, кто хочет управлять процессом генерации, настраивать веса промптов, использовать сэмплеры K-Diffusion и тренировать собственные эмбеддинги (Textual Inversion) без написания кода.

Что можно реализовать

  • Генерация изображений по текстовым промптам с возможностью динамического предпросмотра в реальном времени.
  • Улучшение качества лиц на сгенерированных или загруженных изображениях с помощью модели GFPGAN.
  • Тренировка собственных концепций (embeddings) на основе фотографий для последующего использования в промптах.
  • Масштабирование изображений (upscaling) с использованием различных моделей, включая realESRGAN, с оптимизацией потребления VRAM.
  • Точечная перерисовка частей изображения (inpainting) с помощью инструмента Mask painting.

Ключевые возможности

  • Поддержка множества сэмплеров K-Diffusion (k_euler, k_lms, k_dpm_2 и др.) и PLMS/DDIM.
  • Гибкое управление промптами: взвешивание токенов (например, cat:0.30) и использование негативных промптов (через разделитель ###).
  • Оптимизация использования видеопамяти: работа на GPU с 4GB VRAM в режиме optimized.
  • Интеграция CLIP Interrogator для анализа изображений и получения промптов (Image to Text).
  • Наличие двух интерфейсов: современный Streamlit (основной) и устаревший Gradio (только багфиксы).

👤 Кому подойдёт: Пользователи, работающие с генеративным искусственным интеллектом (diffusion models), художники и энтузиасты, использующие локальные GPU для создания контента.

Релизы

Релизы ещё не отслежены — появятся после ближайшего опроса.