Пятница, 31.10.2025
×
Отчеты на Уолл-стрит: ИИ в полном расцвете сил | Петр Пушкарев

Компания BSS в 10 раз сократила требования к объему аудиоматериалов для создания нового голоса бота

Аа +
- -

Компания BSS создала новый мужской голос для интеллектуального помощника, используя аудиоматериалы общей длительностью 2 часа. Ранее необходимое количество аудио составляло не менее 15–20 часов.

Голосовой робот BSS успешно консультирует клиентов максимально естественным голосом с человеческими интонациями. Новый мужской голос создан на основе голоса профессионального диктора, озвучившего необходимые для ведения диалогов с клиентами фразы. Озвучивание переменных данных (ФИО, улица, дата, номер и т.д.) производится на основе синтеза голоса этого диктора. Такой гибридный подход позволяет существенно сократить время на обучение модели, при этом обеспечить естественность, плавность и незаметность всех переходов и вставок.

В процессе создания нового голоса команда BSS отобрала целевую лексику, которую использует робот при общении с абонентами в реальных проектах. Это помогло отобрать необходимые фразы и, тем самым, сократить количество используемых для обучения модели аудиоматериалов. Более того, команда подобрала специальный фонетический корпус, в котором обеспечено максимальное разнообразие трезвучий (включая редкие), что обеспечивает естественное и приятное звучание голоса. Собранные фразы были озвучены диктором.

Для обучения модели, отвечающей за синтез голоса, понадобились 2 часа аудиозаписей вместо 15-20 часов, как было ранее. Синтезированный голос получился естественным, поскольку модель улавливала и учитывала интонации диктора. Такой способ обучения модели позволяет минимизировать разницу между ранее записанным голосом и синтезированным.

«Мы смогли сократить длительность требуемых материалов с 15-20 часов до 2 часов, что позволяет нам выполнять проекты в более короткие сроки. Модель синтеза речи реализовали на новой архитектуре Conformer — это более современная архитектура нейронной сети, которая лучше справляется с синтезом длинных фраз. Если раньше мы сталкивались с «зажевыванием» в конце предложений, то теперь эта проблема минимизирована и длинные фразы звучат корректно. Естественность и качество нового голоса, скорость его создания – важные преимущества для любого проекта по внедрению и развитию виртуального ассистента», — прокомментировал директор департамента голосовых цифровых технологий компании BSS Александр Крушинский.

Заметили ошибку? Выделите её и нажмите CTRL+ENTER
все корпоративные новости »
- -
94
ПОДПИСАТЬСЯ на канал Finversia YouTube Яндекс.Дзен Telegram

обсуждение

Ваш комментарий
Вы зашли как: Гость. Войти через
Между двух стульев Между двух стульев Экономическая повестка в нынешнем году практически не меняется. Всё та же чугунная безапелляционность Банка России, те же единичные писки экспертов в разных ток-шоу и тот же неуклонный рост цен вопреки официальной статистике. Единственное отличие от предыдущих лет – американцы санкции ввели поздновато. А вы чего ждали? Основные индексы США завершают октябрь ростом на фоне сильной отчётности Amazon и Apple Основные индексы США завершают октябрь ростом на фоне сильной отчётности Amazon и Apple Фондовый рынок США завершает последнюю торговую сессию октября ростом: инвесторы позитивно реагируют на квартальные результаты Amazon и Apple, которые укрепили уверенность в устойчивости Big Tech. Тимур Аитов: «Надо заставить бороться с хищениями и отвечать за них сами банки» Тимур Аитов: «Надо заставить бороться с хищениями и отвечать за них сами банки» В этом году в России обновляется законодательство, направленное на борьбу с финансовом мошенничеством. Три десятка новаций введены с 1 июня. Остановит ли это волну мошенничества? Комментирует председатель комиссии по безопасности финансовых рынков Торгово-промышленной палаты России Тимур Аитов.
Канал Finversia на YouTube

календарь эфиров Finversia-TV »

Новости »