Који су начини да се гласа бот&нбсп;
Постоје два главна начина за глас бота: употреба синтезе говора или
Один из самых известных методов синтеза речи даже међу не-програмерима – ТТС. Рачунар једноставно чита и изговара текст. Упечатљив пример је синтеза Спеецх Сервицес од стране Гугла, која се може чути у преводиоцу Гоогле Транслате. Руски говор службе врло је лако разликовати од природног говора, што је главни проблем такве синтезе. Да бисте ставили неопходан нагласак, користите ССМЛ - означавање синтезе говора. Али чак и уз то, тешко је постићи звук као професионални спикер. Стога смо почели да развијамо висококвалитетну алтернативу.&нбсп;
Зашто вам је потребна синтеза говора са варијаблама&нбсп;
Предузећа активно користе могућности гласаботовима и настоји да њихов говор буде пријатнији и персонализованији према купцима. Персонализација повећава ангажовање и лојалност: 70% компанија које користе напредну персонализацију виде 200% РОИ или више на своје напоре.&нбсп;
Да би глас бота био реалистичан, компанијеснимите глас спикера, глумца или оператера контакт центра. Лоша страна је што су све реплике статичне. Ово је погодно, на пример, за упутства о отказивању поруџбине или информисање о актуелним промоцијама. Али пословна комуникација садржи много променљивих података — променљивих.
Да би глас робота био реалистичан, компаније снимају глас наратора, глумца или оператера контакт центра. Лоша страна је што су све реплике статичне.
На пример, да потврдите термин у клиници:Име пацијента, име лекара, датум и време заказивања. У случају испоруке: пуно име клијента, број поруџбине и њен садржај, износ и време испоруке. Сваки унос мора да садржи индивидуалне параметре клијента или његов захтев. Затим се користе лепљење датотека, аудио миксеви или једноставно роботска гласовна глума.&нбсп;
Суштина лепљења је да ствара„пријаве“ са бројних снимака спикера. У случају испоруке потребно је да запишете око 1,5 хиљада улица које се често појављују, називе градова, бројеве кућа и станова. Ово је веома напоран задатак који захтева значајан труд и време од спикера. Након снимања, аудио датотеке морају бити спојене у исправном редоследу. Професионални инжењер звука може да направи глатке прелазе између резова и пауза, али ће спојеви и даље бити чујни, а велике количине изворних података чине такав посао неодољивим. Испробали смо ову опцију, али смо схватили да није погодна за решавање сложених проблема.&нбсп;
Знамо да неке компаније покушавају да пронађу звучник са гласом сличним стандардној СпеецхКит гласовној глуми из Иандек-а или Гоогле Спеецх-а. Али у овом случају се чују и уметци.&нбсп;
Покушали смо да то интегришемо у снимке гласаТТС. Односно, нисмо унапред снимили сва имена улица и градова, већ смо генерисали жељену фразу користећи ТТС на основу гласа спикера и убацили је у унапред снимљену реплику спикера. Резултат је био мешавина емотивног, живог говора човека и робота.&нбсп;
Шта год да покушамо из разних инструмената,Нисмо имали добар резултат. Као резултат тога, дошли смо да развијемо сопствени алгоритам, који смо назвали хибридна синтеза. Ова технологија вам омогућава да брзо промените фразе у снимцима гласа за гласовног бота, само треба да проследите замену алгоритму. Истовремено, синтетизовани говор копира интонацију и емоције говорника, звучи природно и не издваја се из контекста. На овај начин можете да изговорите све променљиве које нису биле на оригиналном снимку преко гласа, као и да тестирате нове сценарије.&нбсп;
ТТС
Како функционише хибридна синтеза?
Прва фаза је рад са спикерима.Да би се обухватила разноликост руског језика, било је потребно снимити 10 сати говора у професионалном студију. То су фразе из књига, вести и подаци који се често појављују: бројеви, имена, адресе и градови. Ово обезбеђује довољно података за обуку, након чега можете да почнете да креирате моделе хибридне синтезе за сваког звучника.&нбсп;
За сваки пројекат роботског позива, спикер записује шаблоне фраза, на пример: „Здраво,Сергеј Петрович! Сутра ћемо испоручити вашу поруџбину на вашу адресуТверска улица, 3са14 до 18сати.Хоће ли вам бити згодно да то прихватите?“ Модел хибридне синтезе може да обради задатке као што су када је потребно заменити Сергеја Петровича са Аном Васиљевном, а адресу и време - до улице Болсхаиа Зеленина, 24 од 10 до 14 часова. Резултат је нова реплика са синтетизованим варијаблама: „Здраво,Анна Василиевна! Сутра ћемо испоручити вашу поруџбину на вашу адресуУлица Болшаја Зеленина, 24са10 до 14сати. Хоће ли вам бити згодно да то прихватите?“ За сваки позив бази корисника креира се и извршава посебан задатак.&нбсп;
Воицеовер
Висок квалитет звука се постиже захваљујући чињеници да неуронска мрежа користи интонације и емоције говорника из примера.&нбсп;
Како подесити хибридну синтезу&нбсп;
Нудимо неколико готових моделахибридна синтеза са женским и мушким гласовима. Позиви шаблона раде на ЈАИЦП и ЈАИЦФ платформама. Постављање скрипте од нуле траје неколико сати. Једна синтетизована реплика кошта 12 копејки, говор преко шаблона за пројекат кошта 3.000 рубаља по сату рада спикера.&нбсп;
Скуп готових гласова ће се проширити.Постоји и опција да се користи Јуст АИ хибридна синтеза уз креирање модела за појединачно одабраног спикера или који је званични глас компаније.
хибридна синтеза
Технологија хибридне синтезе омогућава вам да персонализујете ИВР и роботске позиве за потребе НПС анкета, упитника, подсетника, продаје на више и подршке за програме лојалности.
Опширније:
Црна рупа у галаксији доказала је да је Ајнштајн у праву. Главна ствар
Свемир уништава кости и мења њихову структуру: научници не знају како ће људи летети на Марс
Астрономи су пронашли планете које се разликују од Земље, али погодне за живот