Нужен голос как таковой
Озвучить ролик, сделать аудиоверсию статьи, дать голос приложению. Здесь достаточно Silero на своём сервере, и платить за это никому не надо.
Модели/Silero
Silero — открытые русские речевые модели: озвучка ставится одной строкой, работает на обычном процессоре, без ключей и без оплаты. Для задачи «прочитать текст голосом» этого достаточно. Синтеза речи в платформе нет — ни на Silero, ни на любой другой модели: речь сотрудник только понимает и разбирает.
Голос в платформе
За словом «озвучка» стоят четыре разные задачи.
Озвучить ролик, сделать аудиоверсию статьи, дать голос приложению. Здесь достаточно Silero на своём сервере, и платить за это никому не надо.
Тогда синтез — только половина, и не главная. Живой разговор по телефону наш сотрудник не ведёт.
Сто записей звонков, из которых кто-то должен достать договорённости, сроки и суммы. Эту часть закрывает сотрудник.
Модель на вашем сервере у нас подключается — но только языковая, мастером коннекторов. Голосовой такой карточки нет.
Первый месяц бесплатно и без карты.
Того, к кому по работе идёт звук: поддержку, продажи, ассистента.
Карточкой в маркете: SaluteSpeech по ключу Сбера или Yandex SpeechKit по IAM-ключу. Оба обрабатывают звук в России.
Голосовые из мессенджеров, звонки из телефонии, встречи. Приносить файлы руками не нужно — они приходят сами.
Не по красоте расшифровки, а по тому, что после неё изменилось: ответ клиенту, карточка сделки, протокол с поручениями.
Озвучка — отдельная задача с готовым бесплатным решением. Разбор потока записей — работа, которую кто-то должен делать каждый день.
Расшифровка разговоров и голосовых работает сегодня. Месяц бесплатно, карта не нужна.