Добавлена поддержка бэкенда PrismML llama.cpp для оптимизированных GGUF-моделей Ternary Bonsai 2 с высокой эффективностью.
- Added: Добавлен бэкенд PrismML llama.cpp, позволяющий запускать GGUF-модели Ternary Bonsai 2 (PTQ1_0/PQ2_0) на CPU, NVIDIA и ROCm через единый интерфейс.
- Added: Реализована команда `harbor models pull --source prismml` для загрузки моделей Bonsai через специализированный рантайм.
- Added: Созданы аналоги кросс-сервисных интеграций llama.cpp для PrismML, включая поддержку `harbor up prismml webui`.
- На RTX 4090 Laptop модель Bonsai 2 27B потребляет 8.3 ГБ памяти и работает на 25% быстрее аналогов при сопоставимом качестве.