AI pretvaranje teksta u govor besplatno: izglasajte svoj tekst pomoću neuronske mreže u vašem pregledniku
Sada možete besplatno izgovoriti svoj tekst pomoću neuronske mreže, bez ičega za instaliranje: the Tekst u govor (besplatno) model je stigao u Video odjeljak. Pokreće se izravno u vašem pregledniku — upišite tekst, odaberite jezik i glas, a nekoliko sekundi kasnije slušate i preuzimate gotovu audio datoteku. Ni tekst ni glasovna snimka se nigdje ne učitavaju: sve se izračunava na vašem vlastitom uređaju.

Zašto je besplatan
Uobičajene govorne usluge sintetiziraju zvuk na vlastitim poslužiteljima i za to naplaćuju novac ili tokene. Ovdje se model učitava u preglednik i koristi grafičku karticu vašeg računala (WebGPU, s procesorom kao rezervom). Poslužitelj služi samo kod alata i težine modela — nema što izračunati, tako da se tokeni ne naplaćuju, a broj generacija je neograničen.
Privatnost također dolazi besplatno: tekst koji izgovorite i vaša glasovna snimka ostaju na vašem uređaju. To je važno kada izgovarate poruke, dokumente ili osobne bilješke.
Kako glasiti tekst pomoću neuronske mreže: korak po korak
- Otvorite Video odjeljak i odabrati Tekst u govor (besplatno) na popisu modela — nalazi se na samom dnu, pored ostalih besplatnih alata.
- Zalijepite svoj tekst u polje "Pretvaranje teksta u glas" — do 2000 znakova odjednom.
- Odaberite jezik. Ako niste sigurni, ostavite "Otkrij automatski".
- Odaberite glas: ženski ili muški, viši ili niži, šapat — ili jedan od vaših spremljenih glasova.
- Pritisnite "Generiraj govor" i pričekajte da završi. Možete reproducirati rezultat na stranici i preuzeti ga kao WAV datoteku.
600+ jezika
Model je višejezičan: poznaje više od 600 jezika. Za mješoviti tekst možete ostaviti uključeno automatsko otkrivanje jezika ili odabrati jezik koji vam je potreban — popis uključuje engleski, njemački, francuski, španjolski, kineski, japanski, arapski i desetke drugih, što je zgodno kada glasovno prenosite videozapise za nekoliko zemalja.
Kako klonirati glas
Možete klonirati glas na dva načina — oba su besplatna i oba se izračunavaju na vašem uređaju:
- Učitajte audio datoteku. MP3, WAV, M4A, OGG ili WebM do 30 sekundi dobro funkcionira.
- Snimajte sa svog mikrofona. Dovoljno je 10-20 sekundi čistog govora bez glazbe ili buke.
Nakon analize alat pretvara snimku u glasovni profil i pohranjuje ga u vaš preglednik. Od tada samo odaberete taj glas s popisa i izgovorite bilo koji tekst svojim glasom bez ponovnog učitavanja snimke. Profili se čuvaju lokalno i prežive ponovno učitavanje stranice.
Što treba znati prije prve vožnje
- preglednik. Najnoviji Chrome ili Edge na radnoj površini najbolje funkcionira. Bez WebGPU model se vraća na procesor i osjetno je sporiji — alat vas na to iskreno upozorava.
- Prvo trčanje. Preglednik jednom preuzima težine modela (oko 3 GB) i sprema ih u predmemoriju. Kasnije vožnje počinju odmah.
- Memorija. Potrebno je oko 3 GB slobodne memorije. Na slabom uređaju alat prikazuje jasno upozorenje umjesto da se ruši.
- Proizlaziti. Gotova datoteka je 24 kHz WAV, spremna za ispuštanje na vašu vremensku traku za uređivanje.
Za koga je
Neuralni pretvaranje teksta u govor pokriva mnoštvo svakodnevnih poslova: izgovaranje isječka za društvene medije, izrada audio verzije članka, naracija prezentacije, provjera kako zvuči skripta ili jednostavno slušanje dokumenta umjesto čitanja. Ako trebate glas određene osobe, klonirajte ga iz kratke snimke.
Isti odjeljak ima i druge besplatne alate koji se pokreću izravno u pregledniku: karta dubine, uklanjanje pozadine videa i video i slika upscaler.
Često postavljana pitanja
Je li stvarno besplatno? Da. Za ovaj se model ne naplaćuju tokeni i nema plaćeni API — vaše računalo obavlja posao.
Je li moj tekst učitan? Ne. Ni tekst ni zvuk ne napuštaju vaš uređaj; samo kod alata i težine modela dolaze s poslužitelja.
Koliko ima do tamo? Kratka fraza obično traje manje od minute nakon što se model jednom preuzme; duži tekst traje duže, a traka napretka pokazuje gdje se nalazi.