IlyaGusev/saiga

Код для обучения и обработки данных для Saiga

Прочее⭐ 56Python
Открыть на GitHub ↗

Что это за инструмент

Набор инструментов для подготовки данных и обучения моделей Saiga (на базе LLaMA) на русском языке.

Зачем нужен

Инструмент решает задачу создания и тонкой настройки (fine-tuning) больших языковых моделей под русскоязычные задачи. Он полезен тем, кто хочет получить качественную русскоязычную LLM, используя готовые датасеты и проверенные скрипты обучения.

Что можно реализовать

  • Тонкая настройка моделей LLaMA на русском языке с использованием датасетов в формате Alpaca
  • Генерация и обработка обучающих данных для диалоговых моделей
  • Обучение моделей с использованием LoRA для экономии вычислительных ресурсов
  • Создание кастомных датасетов для специфических доменов на основе существующих примеров

Ключевые возможности

  • Готовые скрипты для обучения и обработки данных
  • Поддержка форматов датасетов, совместимых с экосистемой Hugging Face
  • Оптимизация обучения через методы адаптивного дообучения (например, LoRA)
  • Фокус на качестве русскоязычных данных и инструкций

👤 Кому подойдёт: Исследователи в области NLP, разработчики, занимающиеся тонкой настройкой LLM, и энтузиасты open-source AI, работающие с русскоязычными моделями

Релизы

Релизы ещё не отслежены — появятся после ближайшего опроса.