lm-sys/FastChat

An open platform for training, serving, and evaluating large language models. Release repo for Vicuna and Chatbot Arena.

Инференс⭐ 39 545Pythonпоследний релиз: v0.2.36
Открыть на GitHub ↗

Что это за инструмент

FastChat — это открытая платформа для обучения, развёртывания и оценки больших языковых моделей (LLM), а также движок, powering Chatbot Arena.

Зачем нужен

Инструмент позволяет развернуть LLM локально или в сети с поддержкой распределённого обслуживания и OpenAI-совместимых API. Он полезен для сравнения моделей через пользовательские голосования (Elo-рейтинг) и проведения исследований в области диалоговых систем.

Что можно реализовать

  • Развёртывание чат-ботов на базе Vicuna, Llama 2 и других моделей с веб-интерфейсом
  • Создание RESTful API, совместимого с OpenAI, для интеграции LLM в другие приложения
  • Оценка качества моделей с помощью бенчмарка MT-bench и сбора данных через Chatbot Arena
  • Обучение и тонкая настройка (fine-tuning) моделей на реальных диалогах (LMSYS-Chat-1M)

Ключевые возможности

  • Поддержка распределённого обслуживания нескольких моделей одновременно
  • Интеграция с Chatbot Arena для сбора человеческих предпочтений и формирования Elo-рейтинга
  • Нативная поддержка длинного контекста (LongChat до 32k токенов)
  • Готовые веса популярных моделей (Vicuna, LongChat, FastChat-T5) на Hugging Face
  • Простая установка через pip и запуск через CLI или Web UI

👤 Кому подойдёт: Исследователи в области NLP, разработчики, внедряющие LLM в свои продукты, и энтузиасты, желающие локально развернуть и протестировать открытые модели.

Релизы

v0.2.36minor
🕐 31 мес назад · релиз на GitHub ↗

FastChat v0.2.36: добавлена поддержка SGLang, LightLLM и Apple MLX, а также мультимодальный WebUI и API для изображений.

  • Added: Добавлен SGLang worker для моделей с поддержкой зрения (VLM), обеспечивающий низкую задержку и высокую пропускную способность.
  • Added: Реализован WebUI для работы с мультимодальными моделями и поддержка ввода изображений в OpenAI-совместимом API.
  • Added: Добавлены Workers для LightLLM (повышение пропускной способности) и Apple MLX (асинхронная реализация).
  • Added: Добавлена поддержка модели Yuan2.0 и обновлена интеграция с Hermes Mixtral.
  • Fixed: Исправлены проблемы токенизации при обучении, работа токенизатора vLLM и метод пулинга модели BGE.
  • Added: Обновлен интерфейс Gradio до версии 4.17 и мигрирован сервер на OpenAI SDK v1.
lm-sys/FastChat — GitHub-трекер AIKraft | AIKraft