AIKraft/MCP-серверы/io.github.modelscope/funasr-mcp

io.github.modelscope/funasr-mcp

Транскрибация локального аудио с помощью FunASR и SenseVoice с использованием приватного вывода на устройстве.

ALAlibaba Локальный · oci Медиа official ★ 20.6k Активность: 4 дн. назад

Что это

Транскрибация локального аудио с помощью FunASR и SenseVoice с использованием приватного вывода на устройстве.

Как подключить

1Официальный package
oci · ghcr.io/modelscope/funasr-mcp:0.1.2
2Установить и запустить в терминале
docker --mount type=bind,src={audio_directory},dst=/audio,readonly --mount type=volume,src=funasr-mcp-cache,dst=/root/.cache/modelscope ghcr.io/modelscope/funasr-mcp:0.1.2
3Добавить в конфиг MCP-клиента (mcp.json / claude_desktop_config.json)
{ "mcpServers": { "io-github-modelscope-funasr-mcp": { "command": "docker", "args": [ "--mount", "type=bind,src={audio_directory},dst=/audio,readonly", "--mount", "type=volume,src=funasr-mcp-cache,dst=/root/.cache/modelscope", "ghcr.io/modelscope/funasr-mcp:0.1.2" ] } } }

Вставьте блок в конфиг клиента (Claude Desktop, Claude Code, Cursor, VS Code, Cline). Команда и package собраны из полей официального MCP Registry.

Что нового в версиях

v1.4.1618 сентября 2026 г.

FunASR 1.4.16: исправлено размещение моделей на устройствах, уточнена работа пунктуации и добавлены руководства по Native Transformers.

  • ИсправленоИсправлено сохранение конфигурации устройств (VAD, пунктуация, спикер) при повторных вызовах инференса.
  • НовоеДобавлены проверенные руководства по Native Transformers для английского и китайского языков.
  • НовоеУточнена документация: объяснена необходимость использования CT-Transformer для пунктуации в SenseVoiceSmall и Paraformer.
  • НовоеВыпущены пресобранные бинарные файлы runtime-llamacpp-v0.2.6 для Linux, macOS и Windows.
v1.4.159 сентября 2026 г.

FunASR 1.4.15: поддержка NumPy 2, улучшение стабильности стриминга и VAD, документация MOSS и обновления runtime.

  • ИсправленоОбеспечена совместимость с NumPy 2, обновлены вызовы librosa и тесты.
  • ИсправленоУлучшена надежность стриминга: сохранение кадров KWS, корректная работа VAD и ранжирование чекпоинтов.
  • НовоеДобавлены профили MOSS в Gradio-клиент и пример офлайн-транскрипции через vLLM.
  • НовоеОбновлены документация по развертыванию и примеры для Qwen3 и MOSS.
  • Выпущены бинарные файлы runtime-llamacpp-v0.2.6 для Linux, macOS и Windows.
v1.4.143 сентября 2026 г.

Исправлены архивы исходников, обновлена документация по MOSS-Transcribe-Diarize и добавлены руководства по развёртыванию.

  • ИсправленоИсправлены проблемы с архивами исходного кода для Git archive и установки из исходников.
  • НовоеОбеспечена доступность MOSS-Transcribe-Diarize в моделях, документации по развёртыванию и сервисам.
  • НовоеДобавлены актуальные руководства по развёртыванию в реальном времени и промышленных условиях.
  • НовоеПредоставлены кроссплатформенные бинарные файлы runtime-llamacpp-v0.2.6 и контрольные суммы SHA256SUMS.
v1.4.132 сентября 2026 г.

Исправлены ошибки NumPy и VAD, добавлена поддержка n8n и пример для Qwen3-asr, обновлены документы.

  • ИсправленоИсправлено несовпадение ABI NumPy 2 и принятие частичных результатов VAD в реальном времени.
  • НовоеДобавлена поддержка транскрипции через n8n OpenAI audio transcription и пример офлайн-запуска Qwen3-asr.
  • НовоеНормализованы ISO-хинты языков для Fun-ASR-Nano.
  • Обновлены документы: уточнены пути vLLM, границы MOSS и добавлены профили настройки L20.
v1.4.121 сентября 2026 г.

Выпуск FunASR 1.4.12: стабилизация fp16 декодирования, поддержка MOSS diarization и новые бинарники llama.cpp.

  • НовоеДобавлена поддержка MOSS diarization во все этапы развертывания.
  • НовоеВыпущены готовые бинарные сборки FunASR с runtime llama.cpp для Linux, macOS и Windows.
  • ИсправленоИсправлена стабилизация fp16 декодирования в fun-asr-nano.
  • ИсправленоИсправлена логика сохранения выровненных частичных результатов при длинных сегментах в реальном времени.
v1.4.1130 августа 2026 г.

Выпуск FunASR 1.4.11: исправление маркеров SentencePiece и автоматизация сборки пакетов, добавлены бинарники llama.cpp для всех платформ.

  • ИсправленоИсправлено выравнивание маркеров слов в SentencePiece для работы auto-model.
  • НовоеДобавлены готовые бинарные сборки llama.cpp для Linux, macOS и Windows (включая CUDA Blackwell и Vulkan).
  • НовоеАвтоматизировано прикрепление Python-пакетов к релизам через CI.
  • Обновлена версия до 1.4.11, доступна установка через PyPI.
v1.4.1030 августа 2026 г.

Исправлено разбиение длинных китайских предложений на субтитры с учётом пауз и лексики; обновлён runtime llama.cpp.

  • ИсправленоУлучшено формирование границ субтитров для длинных китайских предложений: теперь учитываются длительность, пунктуация и границы слов Jieba, а не только лимит в 42 символа.
  • ИсправленоИсправлена проблема #3539, связанная с нарушением длительности и длины cue при обработке смешанных китайско-корейских аудиодорожек.
  • НовоеВ релиз включены проверенные архивы runtime llama.cpp для Linux, macOS и Windows с поддержкой CPU, Vulkan, CUDA и Blackwell.
v1.4.930 августа 2026 г.

Все релизы на GitHub → Пересказ на русском — по заметкам к релизам и коммитам.