← Svi članci

Glasovna gluma Gemini TTS: 30 glasova i sve postavke

Svijetao studio za snimanje pored prozora: dva mikrofona, slušalice i zvučni valovi u boji, mekane lebdeće kartice s dijaloškim linijama, puno svjetla

U odjeljku "Audio" pojavio se novi alat - glasovna gluma dijaloga Gemini TTS. Pretvara gotovu skriptu u zvuk: vi odredite govornike, njihove glasove i karakter, a usluga izgovara stihove jedan po jedan i vraća gotov MP3.

Audio dio: Gemini TTS glasovni alat s dva konfigurirana govornika, linijama dijaloga, klizačem temperature i cijenom prikazanom prije početka

Kakav je ovo instrument

Ovo nije čitanje jednog teksta u jedan glas, već cijelo dijalog s više govornika. Svaki lik ima svoj glas, naglasak, stil prezentacije i tempo - a replike zvuče onako kako su zamišljene: razgovor između voditelja, skeč, intervju, replike likova za video.

Dostupna dva modela:

  • Gemini 3.8 Flash TTS — izražajna glasovna gluma: bogatiji osjećaji, prirodniji ritam, finija kontrola isporuke. Prikladno za podcaste, audio knjige, glasovne snimke.
  • Gemini 3.8 Flash-Lite TTS — ista mehanika je jeftinija i brža: za velike količine, skice i čitanje tekstova naglas.

Koje su postavke dostupne?

Sučelje prikazuje sve parametre koje nudi model glasovne glume:

  • Govornici. Od jednog do nekoliko znakova; svaki ima svoj potpis “Speaker 1”, “Speaker 2” i tako dalje, po kojima su replike povezane s glasom.
  • 30 glasova - od mekog narativa do energičnog i “vijestnog”.
  • 8 naglasaka - neutralna, američka (opća, "dolinska", južna), britanska (RP i Brixton), transatlantska, australska.
  • 6 stilova posluživanja — osmijeh u glasu, spiker, šapat, empatija, promocija i “suhi” ujednačeni ton.
  • 4 stope govora - prirodno, glatko i trzavo.
  • Glasovni karakter - slobodan opis, poput "toplog pripovjedača" ili "strogog vratara".
  • Temperatura - od 0 do 2: niže - stabilnije i predvidljivije, više - živahnije i raznolikije.
  • Scena i opći ton - opis okruženja ("tiha soba s pucketavim kaminom") i stila pripovijedanja ("zvučna knjiga, nježna i primamljiva").
  • Replike — svaki redak dijaloga do 10 000 znakova; redoslijed replika je sačuvan.

Kako izgovoriti dijalog: korak po korak

  1. Otvoriti Odjeljak "Audio". i odaberite model Gemini 3.8 Flash TTS ili Flash-LiteTTS - nalaze se na dnu liste modela.
  2. Dodajte govornike i prilagodite glas, naglasak, stil i tempo svake osobe.
  3. Napišite retke dijaloga i identificirajte govornika za svaki.
  4. Ako želite, ispunite opis scene, ukupni ton i temperaturu.
  5. Pogledajte cijenu - vidljiva je PRIJE lansiranja i ponovno se izračunava dok unosite tekst.
  6. Pritisnite “Glas” i kada budete spremni poslušajte rezultat i preuzmite MP3.

Koliko košta

Cijena se izračunava na temelju stvarnog volumena teksta: što su dulje replike, to je veći trošak, a to je vidljivo prije lansiranja - nema iznenađenja nakon generiranja. Plaćanje se vrši korištenjem tokena stranice, kao i za druge plaćene generacije; ako ne uspije, tokeni se automatski vraćaju. Vodič za cijene možete pogledati izravno u obrascu: iznos se ažurira dok upisujete skriptu.

Često postavljana pitanja

Mogu li glasovno preslikati dijalog između dva ili više likova? Da, svaki govornik ima svoj glas i postavke, linije se izmjenjuju.

U kojem je formatu rezultat? MP3 - možete ga poslušati na stranici i preuzeti jednim gumbom.

Koje jezike govori model? Model je višejezičan: izgovara tekstove na desetke jezika, uključujući ruski i engleski.

Što odabrati: Flash ili Flash-Lite? Za ekspresivne projekte - Flash, za velike količine i nacrte - Flash-Lite: mehanika je ista, ali jeftinija i brža.

Moram li platiti da probam? Otpis se događa kada započne glasovna gluma, a ako dođe do greške, tokeni se automatski vraćaju.