Версия 0.1.2: добавлена реализация paged kv, возможность переключения моделей в чате и поддержка LoRA на macOS.
- Added: Добавлена реализация paged kv для оптимизации работы с памятью.
- Added: Появилась возможность переключать модели прямо на странице чата.
- Added: Реализована поддержка LoRA для устройств на базе macOS.
- Added: Код исполнителя (executor) разделен по различным бэкендам для лучшей модульности.
- Обновлена версия MLX до 0.30.0 (с поддержкой arm64 wheel) и библиотека lattica до 1.0.14.