Распознавание и синтез речи

Нужно озвучить текст или перевести запись в текст

Речевые модели: ASR и озвучка. Анализ содержания разговоров — категория «Речевая аналитика»

Решения, которые это умеют (5)

Возможность подтверждена модулями, которые разработчик описал у себя на сайте, — они названы под решением.

Модули, в которых это описано (5)
МодульТип
Audio

Компонент платформы — распознавание речи и синтез голоса.

Входит в тариф →
Каталог развёрнутых моделей

Открытые модели, развёрнутые у Cloud.ru: DeepSeek, Qwen, gpt-oss, Kimi, GLM и российский GigaChat. Формулировка разработчика: «Модели уже готовы к использованию — не нужно развертывать инференс и писать код», «Модели развернуты на российских серверах». Каталог пополняется: «Мы регулярно добавляем новые модели».

Входит в тариф →
Распознавание речи

Модели whisper в нескольких размерах и glm-asr-nano.

Входит в тариф →
Генерация музыки и озвучки

Музыка и озвучка в общем наборе возможностей, который разработчик перечисляет на сайте.

Входит в тариф →
Speech Realtime

«Специализированная модель для голосовых сценариев с минимальной задержкой».

Входит в тариф →