Релиз модели14 июля 2026 г., 15:46 МСК🤖 Auto

Сбер выпустил GigaAM Multilingual: мультимодальная модель для аудио и речи

Сбер открыл доступ к новым моделям GigaAM Multilingual и GigaChat Audio, предназначенным для распознавания речи и работы с аудио-данными на нескольких языках.

Баннер новости 3543

Новые модели для работы с аудио

Компания Сбер представила две новые модели, доступные на платформе Hugging Face. Первая — GigaAM Multilingual, описанная как фундаментальная модель для задач распознавания речи. Вторая — GigaChat Audio, вероятно, интегрирующая возможности аудио-анализа в экосистему GigaChat.

Ключевые характеристики

Модель GigaAM Multilingual позиционируется как решение для мультиязычной обработки. Это означает, что она способна работать с аудио-потоками на нескольких языках, что критически важно для глобальных приложений и сервисов поддержки клиентов.

Параметр Значение
Название модели GigaAM Multilingual
Тип задачи Распознавание речи (Speech Recognition)
Языковая поддержка Мультиязычная (Multilingual)
Платформа Hugging Face
Состояние доступа Открытый доступ (Open Access)

Значение для разработчиков

Открытие доступа к таким моделям позволяет разработчикам и компаниям интегрировать передовые технологии распознавания речи в свои продукты без необходимости обучения собственных моделей с нуля. Это снижает порог входа для создания голосовых помощников, систем транскрибации и анализа аудио-контента.

Доступность

Модели уже доступны для использования через репозиторий Hugging Face. Разработчики могут ознакомиться с документацией, загрузить веса моделей и начать интеграцию в свои проекты.

Источник: Huggingface ↗