oumi-ai/oumi

Легко настраивайте, оценивайте и развертывайте Gemma 4, Qwen3.5, Qwen3.6, gpt-oss, DeepSeek-R1 или любую открытую LLM/VLM!

Обучение⭐ 9 387Pythonпоследний релиз: v0.9
Открыть на GitHub ↗Сайт проекта ↗

Что это за инструмент

Oumi — это open-source фреймворк для полного цикла работы с LLM и VLM: от тонкой настройки и оценки до развертывания моделей.

Зачем нужен

Инструмент позволяет легко адаптировать открытые модели (Gemma, Qwen, DeepSeek и др.) под конкретные задачи с помощью fine-tuning. Он также предоставляет инструменты для оценки качества моделей и их последующего развертывания в виде inference endpoints.

Что можно реализовать

  • Тонкая настройка (fine-tuning) моделей Gemma 4, Qwen3.5/3.6 или DeepSeek-R1 под специфические домены
  • Развертывание кастомных моделей на выделенных inference endpoints через CLI-команду oumi deploy
  • Интеграция LLM в рабочие процессы разработки через MCP-сервер для Claude/Cursor
  • Автоматизация подбора гиперпараметров и синтез данных для улучшения качества модели
  • Оценка производительности моделей с использованием встроенных инструментов анализа и LLM-as-a-Judge

Ключевые возможности

  • Поддержка широкого спектра современных архитектур: Gemma 4, Qwen3.5/3.6, gpt-oss, DeepSeek-R1, Llama 4 и других
  • Встроенная команда oumi deploy для быстрого развертывания на платформах fireworks.ai и parasail
  • Интеграция с MCP (Model Context Protocol) для взаимодействия с AI-ассистентами
  • Поддержка передовых методов обучения: GRPO, KTO, Vision DPO, LoRA, QLoRA и full fine-tuning
  • Актуальные зависимости: Transformers v5, TRL v0.30, vLLM v0.19, veRL v0.7

👤 Кому подойдёт: ML-инженеры, разработчики AI-приложений и исследователи, работающие с open-source LLM/VLM

Релизы

v0.9major
🕐 4 дн назад · релиз на GitHub ↗

Oumi v0.9: полный цикл обучения агентов с инструментами, RL через verl, синтез диалогов и запуск на Modal/Slurm.

  • Added: Обучение моделей вызову инструментов (SFT, DPO) и поддержка новых шаблонов чата.
  • Added: Выполнение инструментов в реальных средах: базы данных, HTTP, симуляции и детерминированные запросы.
  • Added: Интеграция verl для RL (GRPO) поверх любых сред Oumi с поддержкой пользовательских наград.
  • Added: Синтез многошаговых диалогов с инструментами и оценка ответов через RubricJudge.
  • Added: Запуск задач через Modal GPU и SkyPilot-routed Slurm, а также отказоустойчивые пайплайны.
v0.8major
🕐 4 мес назад · релиз на GitHub ↗

Oumi v0.8: новый CLI для деплоя моделей, сервер MCP, поддержка Cerebras, пакетные API и обновление зависимостей.

  • Added: Добавлен CLI `oumi deploy` для развертывания моделей на выделенных эндпоинтах (Fireworks, Parasail).
  • Added: Выпущен сервер `oumi-mcp` для интеграции с MCP-ассистентами (Claude, Cursor) и управления задачами через чат.
  • Added: Появилась поддержка пакетных API (batch) для Anthropic, Fireworks и Together с контролем прогресса.
  • Added: Добавлен движок `CerebrasInferenceEngine` для работы с моделями Cerebras.
  • Added: Реализовано ограничение частоты запросов (RPM/TPM) в `RemoteInferenceEngine` и синтез многотуровых диалогов.
  • Deprecated: Параметр `politeness_policy` устарел, вместо него следует использовать `requests_per_minute`.