Mitä tapoja antaa ääneen botti
Botin äänittämiseen on kaksi päätapaa: puhesynteesin avulla tai
Yksi tunnetuimmista puhesynteesimenetelmistä on parillinenei-ohjelmoijien keskuudessa - TTS. Tietokone vain lukee ja puhuu tekstin. Silmiinpistävä esimerkki on Googlen puhepalveluiden synteesi, joka voidaan kuulla Google Translate -kääntäjässä. Palvelun venäjänkielinen puhe on erittäin helppo erottaa luonnollisesta puheesta, mikä on tällaisen synteesin pääongelma. Käytä SSML-puheen synteesimerkintää asettaaksesi tarvittavan painotuksen. Mutta jopa sen kanssa on vaikea saavuttaa ammattimaisen kuuluttajan ääntä. Siksi aloimme kehittää korkealaatuista vaihtoehtoa.
Miksi tarvitset puhesynteesiä muuttujien kanssa
Yritykset käyttävät aktiivisesti puheen ominaisuuksiarobotteja ja pyrkii tekemään puheestaan miellyttävämpää ja henkilökohtaisempaa asiakkaille. Personointi lisää sitoutumista ja uskollisuutta: 70 % edistyneitä personointia käyttävistä yrityksistä saavutti 200 %:n tai enemmän sijoitetun pääoman tuottoa.
Jotta botin ääni olisi realistinen, yrityksetäänittää kuuluttajan, näyttelijän tai yhteyskeskuksen operaattorin äänen. Huono puoli on, että kaikki kopiot ovat staattisia. Tämä sopii esimerkiksi tilauksen peruuttamisohjeisiin tai ajankohtaisista tarjouksista tiedottamiseen. Mutta yritysviestintä sisältää paljon muuttuvaa dataa – muuttujia.
Jotta botin ääni olisi realistinen, yritykset tallentavat kertojan, näyttelijän tai yhteyskeskuksen operaattorin äänen. Huono puoli on, että kaikki kopiot ovat staattisia.
Voit esimerkiksi vahvistaa ajan klinikalla seuraavasti:Potilaan nimi, lääkärin nimi, vastaanottopäivä ja -aika. Toimitustapauksessa: asiakkaan koko nimi, tilausnumero ja sen sisältö, määrä ja toimitusaika. Jokaisen merkinnän tulee sisältää asiakkaan tai hänen pyyntönsä yksittäiset parametrit. Ja sitten käytetään tiedostojen liimaamista, äänisekoituksia tai yksinkertaisesti robottiäänenäyttämistä.
Liimauksen ydin on, että se luo"sovelluksia" kuuluttajan lukuisista tallenteista. Toimituksen yhteydessä sinun on kirjoitettava muistiin noin 1,5 tuhatta usein esiintyvää katua, kaupunkien nimeä, talon ja asunnon numeroa. Tämä on erittäin työvoimavaltainen tehtävä, joka vaatii ilmoittajalta paljon vaivaa ja aikaa. Äänityksen jälkeen äänitiedostot on yhdistettävä oikeassa järjestyksessä. Ammattimainen äänisuunnittelija voi tehdä sujuvat siirtymät leikkausten ja taukojen välillä, mutta risteykset ovat silti kuultavissa, ja suuret lähdetietomäärät tekevät työstä ylivoimaista. Yritimme tätä vaihtoehtoa, mutta huomasimme, että se ei sovellu monimutkaisten ongelmien ratkaisemiseen.
Tiedämme, että jotkut yritykset yrittävät löytää kaiuttimen, jonka ääni muistuttaa tavallista SpeechKit-ääntä Yandexista tai Google Speechistä. Mutta tässä tapauksessa lisäkkeet ovat myös kuultavissa.
Yritimme integroida sen puheäänitteisiinTTS. Toisin sanoen emme nauhoittaneet kaikkia katujen ja kaupunkien nimiä etukäteen, vaan generoimme halutun lauseen TTS:llä kuuluttajan äänen perusteella ja lisäsimme sen valmiiksi tallennettuun kuuluttajan kopioon. Tuloksena oli sekoitus ihmisen ja robotin emotionaalista elävää puhetta.
Mitä tahansa yritämme eri soittimista,Meillä ei ollut hyvää tulosta. Tuloksena päädyimme kehittämään omaa algoritmiamme, jota kutsuimme hybridisynteesiksi. Tämän tekniikan avulla voit nopeasti vaihtaa puhebotin selostustallenteiden lauseita; sinun tarvitsee vain siirtää korvaus algoritmille. Samalla syntetisoitu puhe kopioi puhujan intonaation ja tunteet, kuulostaa luonnolliselta eikä erotu kontekstista. Tällä tavalla voit äänestää mitä tahansa muuttujia, jotka eivät olleet alkuperäisessä selostustallenteessa, sekä testata uusia skenaarioita.
TTS
Miten hybridisynteesi toimii?
Ensimmäinen vaihe on työskentely kuuluttajien kanssa.Venäjän kielen monimuotoisuuden kattamiseksi oli tarpeen äänittää 10 tuntia puhetta ammattistudiossa. Nämä ovat lauseita kirjoista, uutisista ja usein esiintyvistä tiedoista: numerot, nimet, osoitteet ja kaupungit. Tämä antaa riittävästi harjoitustietoja, minkä jälkeen voit alkaa luoda hybridisynteesimalleja jokaiselle kaiuttimelle.
Jokaiselle robottipuheluprojektille ilmoittaja kirjoittaa muistiin lausemalleja, esimerkiksi: "Hei,Sergei Petrovitš! Huomenna toimitamme tilauksesi osoitteeseesiTverskaya-katu, 3Kanssa14-18tuntia.Onko sinulle sopivaa hyväksyä se?" Hybridisynteesimalli voi käsitellä tehtäviä, kuten milloin on tarpeen korvata Sergei Petrovich Anna Vasilyevnalla, ja osoite ja aika - Bolshaya Zelenina Street, 24 klo 10-14. Tuloksena on uusi replika syntetisoiduilla muuttujilla: "Hei,Anna Vasilievna! Huomenna toimitamme tilauksesi osoitteeseesiBolshaya Zelenina katu 24Kanssa10-14tuntia. Onko sinulle sopivaa hyväksyä se?" Jokaiselle asiakaskunnan puhelulle luodaan ja suoritetaan erillinen tehtävä.
Selostus
Korkea äänenlaatu saavutetaan, koska hermoverkko käyttää esimerkin mukaisia puhujan intonaatioita ja tunteita.
Hybridisynteesin määrittäminen
Tarjoamme useita valmiita mallejahybridisynteesi nais- ja miesäänillä. Mallikutsut toimivat JAICP- ja JAICF-alustoilla; kutsut muissa palveluissa luoduista boteista ovat mahdollisia API:n kautta. Skriptin määrittäminen tyhjästä kestää useita tunteja. Yksi syntetisoitu replika maksaa 12 kopekkaa, projektin mallipohjan selostus maksaa 3 000 ruplaa per tunti kuuluttajan työstä.
Valmiiden äänten joukko laajenee.On myös mahdollisuus käyttää Just AI -hybridisynteesiä ja luoda malli yksilöllisesti valitulle kuuluttajalle tai kuka on yrityksen virallinen ääni.
hybridisynteesi
Hybridisynteesitekniikan avulla voit mukauttaa IVR- ja robottipuheluita NPS-tutkimuksia, kyselyitä, muistutuksia, lisämyyntiä ja kanta-asiakasohjelmien tukea varten.
Lue lisää:
Musta aukko galaksissa osoitti Einsteinin olevan oikeassa. Pääasia
Avaruus tuhoaa luita ja muuttaa niiden rakennetta: tiedemiehet eivät tiedä, kuinka ihmiset lentävät Marsiin
Tähtitieteilijät ovat löytäneet planeettoja, jotka eroavat Maasta, mutta sopivat elämään