josStorer/RWKV-Runner

Инструмент для управления и запуска RWKV, полная автоматизация, всего 8 МБ. Предоставляет интерфейс, совместимый с OpenAI API. RWKV — это большая языковая модель, полностью открытая и доступная для коммерческого использования.

Инструменты⭐ 6 482TypeScriptпоследний релиз: v1.9.12
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

RWKV Runner — это легковесный (8 МБ) инструмент для управления моделями RWKV с автоматической установкой зависимостей и поддержкой OpenAI API.

Зачем нужен

Инструмент устраняет барьеры запуска LLM, позволяя запускать модели локально или на сервере через готовый исполняемый файл. Он полезен тем, что делает любой клиент ChatGPT совместимым с RWKV благодаря API-совместимости.

Что можно реализовать

  • Локальный запуск и управление моделями RWKV на Windows, macOS и Linux без сложной настройки окружения.
  • Использование RWKV как бэкенда для любых клиентов ChatGPT через совместимый OpenAI API.
  • Разделение фронтенда и бэкенда для развертывания сервиса на удаленном сервере с клиентским доступом.
  • Быстрый запуск WebUI для тестирования моделей и взаимодействия с ними через браузер.
  • Использование инструмента как клиента для OpenAI, GPT-Playground или Ollama, подставляя свой API URL.

Ключевые возможности

  • Полная автоматизация установки зависимостей и наличие легковесного исполняемого файла.
  • Совместимость с OpenAI API, позволяющая использовать любые ChatGPT-клиенты.
  • Поддержка WebGPU для работы на AMD и Intel GPU, а также оптимизация под разные объемы VRAM.
  • Встроенные инструменты: конвертация моделей, загрузка, LoRA Finetune (Windows) и MIDI-ввод.
  • Гибкая архитектура: возможность запускать только бэкенд, только фронтенд или WebUI.

👤 Кому подойдёт: разработчики, энтузиасты LLM, пользователи с ограниченным доступом к ресурсам, желающие локально развернуть LLM

Релизы

v1.9.12patch
🕐 2 мес назад · релиз на GitHub ↗

Исправлена поддержка новых версий NVIDIA CUDA для корректной установки зависимостей.

  • Fixed: Исправлена обработка вывода версии CUDA в новых драйверах NVIDIA, предотвращающая ошибки при установке зависимостей.
  • Рекомендация по устранению сбоев WebView2: выполнить ремонт через настройки Windows.
v1.9.11minor
🕐 4 мес назад · релиз на GitHub ↗

Добавлен бэкенд albatross для пакетного вывода с высокой скоростью, обновлён llama.cpp и кнопка генерации.

  • Added: Добавлен бэкенд albatross: автоматический батчинг, совместимость API и высокая скорость (2000–10000 токенов/с на RTX 30xx+).
  • Added: В клиент добавлена кнопка пакетной генерации с удобным интерфейсом предварительного просмотра.
  • Fixed: Обновлена предкомпилированная версия llama.cpp с поддержкой Vulkan.
  • Рекомендуется восстановить WebView2 через настройки Windows при возникновении ошибок.