Релиз v2.6.4 репозитория shimmy не содержит изменений, это пустой патч.
- В релизе v2.6.4 отсутствуют заметные изменения, исправления или новые функции.
⚡ Чистый Rust WebGPU inference engine — совместим с OpenAI API, нативно поддерживает GGUF, работает на любом GPU. Без Python. Без llama.cpp. Один бинарник.
Shimmy — это легковесный сервер для локального запуска LLM на базе WebGPU, написанный на чистом Rust без зависимостей Python или C++. Он предоставляет полностью совместимый с OpenAI API интерфейс для работы с GGUF-моделями.
Инструмент позволяет запускать локальные LLM-серверы с минимальными системными требованиями, заменяя тяжелые решения вроде llama.cpp. Он полезен для разработчиков, которым нужен быстрый, безопасный и простой способ интеграции локальных моделей в существующие приложения, использующие OpenAI SDK.
👤 Кому подойдёт: разработчики, DevOps-инженеры, энтузиасты локальных LLM, использующие Linux/Windows/macOS и желающие минимизировать зависимости проекта
Релиз v2.6.4 репозитория shimmy не содержит изменений, это пустой патч.
Вышла версия v2.6.3.
Вышла версия v2.6.1.
Выпуск v2.6.0: добавлена поддержка моделей DeepSeek-V4 и Qwen3, улучшена работа с MCP и оптимизация через FlashAttention.
Релиз v2.5.0: добавлена поддержка моделей DeepSeek-V4 и Qwen3, улучшена работа с FlashAttention и MCP.
Релиз v2.4.2 репозитория shimmy: исправления и улучшения стабильности.
Релиз v2.1.1: исправление ошибок и улучшение стабильности работы Shimmy.