AI-новости30 марта 2026 г., 12:06 МСК

Qwen3.5-9B-Uncensored-HauhauCS-Aggressive: мощная локальная модель без отказов и с мультимодальностью

Фото новости

Qwen3.5-9B-Uncensored-HauhauCS-Aggressive заявлена как полностью открытая модель без фильтраций в ответах, а не «среднецензурная». Разработчик сообщает 0 из 465 блокировок, что выделяет этот релиз среди крупных открытых вариантов 2026 года.

Это уже не теория о контроле, а практический сигнал: можно запускать модели локально и меньше зависеть от закрытых API. Модель позиционируется под эксперименты с текстом, картинками и видео прямо на своих железках.

Что реально изменилось: от фильтруемых ответов к агрессивному режиму без потерь

\n
карточка модели Qwen3.5-9B-Uncensored-HauhauCS-Aggressive с метриками и списком GGUF-файлов
Скриншот: huggingface.co
\n

Главное изменение — модель заявлена как uncensored (без блокировок ответов) вариант.

Если предыдущие релизы обычно отрезали чувствительные запросы, здесь акцент на сохранении оригинальной функциональности авторам. Из описания: никаких изменений в датасете, архитектуре и полномочности, только снятие запретов.

С точки зрения живых проектов это три поведенческие точки:

  • 0/465 refusals = модель завершает диалог вместо отказа по policy-проверкам.
  • Полная нативная мультимодальность означает: работает с текстом и медиа без отдельных мостов.
  • Агрессивный профиль удаляет почти все блоки, поэтому контроль выносится на вас и инфраструктуру.
\n

Появился важный нюанс: иногда модель добавляет стандартную оговорку вроде «общая информация, не совет», но это не блокировка, а шаблон из базового обучения.

По смыслу это как автоответ, где «тормоз» снят, но финтюнинг не тронут.

\n\n

Зачем сделали aggressive-версию и где скрыт риск

\n

Встроенные ограничения часто спасают продакшн-сценарии, но режут исследовательскую гибкость. Версия «aggressive» решает потребность сообщества в полном доступе, особенно для R&D и оффлайн-пайплайнов.

С другой стороны, такой уровень открытости увеличивает требования к внутренней политике.

  • Кто заказывает такие релизы, обычно делает это ради полного поведения модели в своих экспериментах.
  • Для бизнеса выгода в том, что меньше скрытых отказов и меньше ручной очистки сценариев.
  • Для безопасности нужен слой проверки на выходе: без фильтрации модель не фильтрует сама.
\n
\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n\n
ПараметрЗначениеПрактический смысл
Размер модели9B параметровДостаточно крупная для сложной логики, но легче, чем сотни миллиардов.
Контекст262K, до 1M через YaRN (расширение контекста)Подходит для долгих диалогов и больших документов без частой потери нитки.
ФорматыBF16, Q8_0, Q6_K, Q4_K_MМожно выбрать компромисс между точностью и памятью железа.
РазмещениеЛокально в llama.cpp/LM Studio/Jan/koboldcppНезависимость от внешних провайдеров, меньше зависимость от стоимости токенов.
\n

Еще цифры из листинга важны: 9B модель в BF16 весит 17 GB, а Q4_K_M около 5.3 GB. На локале это заметно для ноутбуков и серверов, но обычно проще, чем тяжелые облачные решения в долгосрочной перспективе.

\n\n

Как применять прямо сейчас: 4 шага для предпринимателей и разработчиков

\n

Первое правило: не подключайте агрессивный режим в проде без собственной рамки контроля.

\n
  • Скачайте файл под ваш уровень железа, например Q6_K или Q4_K_M, если память ограничена.
  • Установите рантайм, который поддерживает модель: llama.cpp или LM Studio.
  • Подготовьте отдельные промпты в thinking mode (режим рассуждений) и non-thinking mode, и сравните поведение.
  • Для визуальных задач загрузите вместе с ядром mmproj файл (vision encoder — энкодер для изображений).
  • Если нужен throughput (пропускная способность), пробуйте vLLM, SGLang, KTransformers.
\n

Для бизнеса полезна связка «локально-он-прем». Нет зависимостей от провайдеров, а значит меньше рисков по стоимости и приватности.

\n

У этого релиза есть важный практический флаг: модель пока не развёрнута у провайдеров инференса.

Значит, тестируйте на локали и не ждите мгновенного API-сервиса, иначе вы увидите иллюзию «не работает» просто из-за настройки окружения.

\n

Режим агрессивного uncensoring — это инструмент, который помогает быстрее исследовать идеи. Но в коммерческом использовании лучше добавить content policy (правила контента) на уровне приложения.

\n\n

Неожиданный итог: рынок движется не к более «вежливым» чатам, а к более «контролируемым» рабочим моделям, где свобода достигается не ценой хаоса, а ценой вашей инженерной дисциплины.