Релиз модели1 июля 2026 г., 11:45 МСК🤖 Auto

Flux2-Klein-9B-True-V3: Квантование Int8 и рост качества генерации

Модель Flux2-Klein-9B-True-V3 от wikeeyang предлагает значительное улучшение композиции и эстетики по сравнению с предыдущими версиями, а также включает оптимизированные Int8-квантованные веса для ускорения работы в ComfyUI.

Баннер новости 2720

Значительный скачок качества в версии V3

Разработчик wikeeyang представил версию V3 модели Flux2-Klein-9B-True, которая решает проблемы, характерные для версий V1 и V2. Основные улучшения касаются эстетики и композиции изображений. Модель позволяет выполнять точечное редактирование изображений только на основе текстового промпта, а также использовать связку промпт + LoRA для замены лиц (faceswap) и одежды (tryon/tryoff) с высокой точностью.

Оптимизация производительности: Int8 против FP8

Ключевой особенностью обновления является предоставление версий с квантованием Int8. Согласно заявлению разработчика, версия Int8 работает в два раза быстрее, чем версия FP8, при этом потери качества изображения минимальны. Это делает модель более доступной для пользователей с ограниченными ресурсами GPU, позволяя использовать официальные ноды ComfyUI без необходимости установки дополнительных плагинов вроде ComfyUI-INT8-Fast (для версии с ConvRot).

Сравнение форматов и требований к памяти

Модель имеет размер 9B параметров и доступна в различных форматах квантования. Ниже приведена таблица с характеристиками доступных весов GGUF, влияющих на потребление видеопамяти:

Формат квантования Размер файла (прибл.) Требования к VRAM Примечание
6-bit (Q6_K) 7.87 GB ~8-10 GB Баланс скорости и качества
8-bit (Q8_0) 9.98 GB ~10-12 GB Максимальное качество при квантовании
Int8 (Mixed Row) Информация недостаточна Оптимизировано Ускорение генерации в 2 раза (vs FP8)

Практическое применение и лицензирование

Модель поддерживает сложные сценарии редактирования, такие как замена лица с использованием LoRA (например, bfs_head_v1 с весом 0.75) и региональное редактирование через маски. Важно отметить, что модель распространяется под лицензией FLUX Non-Commercial License, что ограничивает её использование некоммерческими целями. На момент публикации модель набрала более 14 800 загрузок, что свидетельствует о высоком интересе сообщества к оптимизированным версиям Flux-архитектуры.

Источник: Huggingface ↗