Исправлены таймауты и CORS, добавлена поддержка Qwen3 и экспериментальный бэкенд AMD HRX, изменена структура моделей.
- Fixed: Исправлено блокирование удалённого доступа через allowed_origins и увеличен стандартный таймаут префилла до 600 секунд.
- Added: Добавлен экспериментальный бэкенд llamacpp-hrx для работы с AMD HRX на Linux.
- Added: Обновлена версия llama.cpp для поддержки модели Qwen3-Next.
- Breaking: Модели в папках chat/, embeddings/ и reranking/ теперь отображаются индивидуально, а не как единая группа.
- Deprecated: Переменная окружения LEMONADE_ALLOWED_ORIGINS устарела, рекомендуется использовать опцию allowed_origins.