api
Deepgram API reference for speech-to-text, text-to-speech, voice agents, audio intelligence, and account management. Use whenever building with Deepgram APIs â REST or WebSocket. Covers authentication, all endpoints, query parameters, request/response schemas, and WebSocket message formats. Reference files are organized by domain: listen (STT), speak (TTS), agent (voice agents), read (text/audio
Что делает навык
Навык предоставляет справочник по Deepgram API для распознавания речи (STT), синтеза речи (TTS), голосовых агентов и аудиоаналитики. Он помогает разработчикам корректно использовать REST и WebSocket интерфейсы, включая аутентификацию и работу с моделями Flux.
Когда применять
- Разработка систем распознавания речи с использованием REST или WebSocket.
- Синтез речи с выбором конкретных голосов и языков через модель Flux TTS.
- Создание голосовых агентов с использованием специализированного WebSocket-сервера.
- Анализ аудио и работа с текстовыми данными через эндпоинты read.
Как работает
- Определить тип задачи: транскрипция аудио (STT) или генерация речи (TTS), так как продукты Flux имеют разные эндпоинты.
- Настроить аутентификацию запроса с помощью API Key (Authorization: Token) или JWT (Authorization: Bearer).
- Выбрать базовый сервер: api.deepgram.com для REST и STT/TTS WebSocket, agent.deepgram.com для голосовых агентов.
- Отправить запрос к соответствующему эндпоинту (например, /v2/listen для STT или /v2/speak для TTS) с нужными параметрами модели.
- Обработать ответ или сообщения WebSocket в соответствии со схемами запросов и ответов справочника.
Примеры запросов агенту
Что понадобится
- API Key или JWT для аутентификации запросов
Описание составлено по SKILL.md навыка, сверено 05.10.2026.
Как подключить
SKILL.md к навыкам ассистентаНавык — папка с файлом SKILL.md (описание + инструкции) и опциональными скриптами. Ассистент (Claude, Claude Code и совместимые) подхватывает его по описанию и следует шагам.