Миграция на Flax NNX, поддержка DeepSeek-V4, Qwen3-VL, LoRA/QLoRA, контекстная параллельность и FP4-квантование.
- Breaking: Выполнен переход на Flax NNX: конфигурации pure_nnx и enable_nnx включены по умолчанию.
- Added: Добавлена полная поддержка моделей DeepSeek-V4 и Qwen3-VL, включая конфигурации и конвертацию чекпоинтов.
- Added: Реализована нативная поддержка LoRA и QLoRA для Gemma4, Gemma3, Qwen3 и Llama3.
- Added: Расширены возможности контекстной параллельности: добавлены стратегии Ulysses/USP, Ring Attention и YaRN RoPE.
- Added: Внедрено FP4 (E2M1) квантование, экспериментальное квантование внимания и оптимизации производительности.