Релиз OpenLLM v0.6.30: добавлена поддержка Qwen3, DeepSeek-V4 и MoE-моделей, улучшена интеграция с MCP.
- Added: Добавлена поддержка новых моделей: Qwen3, DeepSeek-V4 и архитектур MoE.
- Added: Улучшена интеграция с протоколом MCP для более стабильной работы.
- Added: Оптимизирована работа с FlashAttention для ускорения инференса.
- Fixed: Исправлены ошибки в конфигурации серверов для некоторых моделей.