Kas ir ElevenLabs un kā mākslīgais intelekts maina balsu tehnoloģijas?

Pēdējos mēnešos sociālajos tīklos, tehnoloģiju forumos un YouTube komentāros arvien biežāk parādās viens un tas pats nosaukums – ElevenLabs.

Cilvēki dalās ar audio paraugiem, kur mākslīgā intelekta balss skan satriecoši dabīgi, vai ar dziesmām, kas ģenerētas no nulles dažu sekunžu laikā. Bet kas īsti ir šis rīks, kāpēc tas kļuvis tik populārs un ko tas spēj – to zina daudz mazāk cilvēku nekā varētu šķist.

No teksta uz dzīvu balsi – tas, kas agrāk šķita neiespējami

ElevenLabs ir mākslīgā intelekta programmatūras uzņēmums, kas specializējas hiperreālistisku sintētisko balsu radīšanā un audio producēšanā. Teksts, ko ievadi platformā, netiek vienkārši “nolasīts” – tas tiek interpretēts. Sistēma saprot intonāciju, emocionālo nokrāsu, dabiskās pauzes. Rezultāts skan tā, it kā aiz mikrofona sēdētu īsts cilvēks.

Tieši šī kvalitāte ir iemesls, kas izskaidro straujo popularitātes pieaugumu. Podkāstu veidotāji atklāja, ka vairs nav vajadzīga studija. YouTube autori saprata, ka balss ierakstam vairs nav jātērē stundas.

Ko platforma prot?

Viena no visvairāk apspriestajām funkcijām ir balss klonēšana. Tā ļauj no vairākiem audio paraugiem izveidot precīzu digitālo balss repliku – gan savai balsij, gan arī pilnīgi izveidotām balsīm dažādiem projektiem. 

Īpaši iespaidīga ir MI dublēšanas tehnoloģija, kas automātiski tulko video vai audio desmitiem valodu, vienlaikus saglabājot oriģinālā runātāja balss tembru un emocionālo piegājumu. Tas nozīmē, ka viens un tas pats saturs var izklausīties dabiski dažādās valodās, nezaudējot emocionālo niansi. 

Papildus tam platforma piedāvā sarunu MI rīkus, kas ļauj uzņēmumiem veidot atsaucīgus balss agentus klientu apkalpošanai vai interaktīvus varoņus videospēlēm ar ārkārtīgi zemu reakcijas latentumu.

Jaunākais lēciens – mūzika, kas maina žanru

Balss tehnoloģijas nav vienīgais virziens, kur ElevenLabs paplašina savu darbību. Nesen ElevenLabs pārsteidza arī mūzikas jomā, prezentējot sava ģenerēšanas modeļa otro versiju – Music v2. Modelis spēj mainīt mūzikas žanru tieši dziesmas laikā – no lēnas melodijas uz ātru repu, nezaudējot ne ritmu, ne saskaņotību. Var pievienot arī nemuzikālus skaņu efektus tieši dziesmas ietvaros.

Mākslinieki tagad var veidot dziesmu pa sekcijām un pēc tam tās savienot vienotā kompozīcijā. Ja kāda daļa nepatīk, to var pārtaisīt ar teksta uzvedni, nepieskaroties pārējam.

Mūzikas industrija aktīvi reaģē uz MI attīstību. Interesanti, ka arī Spotify pēdējā laikā pievienojas šai tendencei – platforma aktīvi strādā pie tā, lai kļūtu par mājivietu MI radītam saturam, kas liecina par to, ka lielās mūzikas platformas MI mūziku vairs neuzskata par draudu, bet gan par iespēju. 

Konkurence un autortiesību jautājumi 

Šajā jomā sacensība kļūst arvien intensīvāka – Google, Stability AI un Suno arī laiduši klajā jaunus modeļus ar spēju radīt garākus un sarežģītākus skaņdarbus. Interneta forumos un tehnoloģiju portālos diskusijas par MI mūziku kļuvušas par ikdienu, un jautājums vairs nav “vai MI spēj radīt mūziku” – bet gan “cik drīz to vairs nevarēs atšķirt no cilvēka radītās.”

Svarīgs aspekts – Music v2 ir veidots uz licencētiem datiem un atļauts komerciālai izmantošanai. Tas nav mazsvarīgi, ņemot vērā, ka konkurenti kā Suno un Udio šobrīd saskaras ar tiesvedībām par autortiesību pārkāpumiem mūzikas industrijas pusē. 

Avots: TechCrunch

Vai tev patika šis raksts? Novērtē un dalies ar to!

Atbildēt

Jaunākie apskati
Tev varētu interesēt