AI Text to Speech Free: Hlasujte svůj text pomocí neuronové sítě ve vašem prohlížeči
Nyní můžete svůj text vyslovit pomocí neuronové sítě zdarma, bez nutnosti instalace: the Text na řeč (zdarma) model dorazil do Video sekce. Spustí se přímo ve vašem prohlížeči – napište text, vyberte jazyk a hlas a o několik sekund později si můžete poslechnout a stáhnout hotový zvukový soubor. Text ani hlasový záznam se nikam nenahrává: vše se počítá na vašem vlastním zařízení.

Proč je to zdarma
Běžné hlasové služby syntetizují zvuk na svých vlastních serverech a účtují si za to peníze nebo tokeny. Zde se model načte do prohlížeče a používá grafickou kartu vašeho počítače (WebGPU, s procesorem jako záložním). Server obsluhuje pouze kód nástroje a váhy modelu — nemá co počítat, takže nejsou účtovány žádné tokeny a počet generací je neomezený.
Soukromí je také zdarma: text, který vyslovíte, a váš hlasový záznam zůstanou ve vašem zařízení. Na tom záleží, když posíláte zprávy, dokumenty nebo osobní poznámky.
Jak hlasovat text pomocí neuronové sítě: krok za krokem
- Otevřete Sekce videa a vybrat Text na řeč (zdarma) v seznamu modelů — je úplně dole, vedle ostatních bezplatných nástrojů.
- Vložte svůj text do pole „Text to voice“ – až 2000 znaků najednou.
- Vyberte jazyk. Pokud si nejste jisti, ponechte "Zjistit automaticky".
- Vyberte si hlas: ženský nebo mužský, vyšší nebo nižší, šepot – nebo jeden z vašich uložených hlasů.
- Stiskněte "Generovat řeč" a počkejte, až skončí. Výsledek si můžete přehrát na stránce a stáhnout jako soubor WAV.
600+ jazyků
Model je vícejazyčný: zná více než 600 jazyků. U smíšeného textu můžete nechat zapnutou automatickou detekci jazyka nebo si vybrat jazyk, který potřebujete – seznam obsahuje angličtinu, němčinu, francouzštinu, španělštinu, čínštinu, japonštinu, arabštinu a desítky dalších, které se hodí, když hlásáte videa pro několik zemí.
Jak naklonovat hlas
Hlas můžete klonovat dvěma způsoby – oba jsou zdarma a oba se počítají na vašem zařízení:
- Nahrajte zvukový soubor. MP3, WAV, M4A, OGG nebo WebM až 30 sekund funguje dobře.
- Nahrávejte z mikrofonu. Stačí 10–20 sekund čisté řeči bez hudby a hluku.
Po analýze nástroj převede záznam na hlasový profil a uloží jej do vašeho prohlížeče. Od té chvíle stačí vybrat tento hlas ze seznamu a vyslovit jakýkoli text svým vlastním hlasem, aniž byste nahrávku znovu nahráli. Profily jsou uchovávány lokálně a přežijí opětovné načtení stránky.
Co byste měli vědět před prvním spuštěním
- Prohlížeč. Nejlépe funguje poslední Chrome nebo Edge na ploše. Bez WebGPU model spadne zpět na procesor a je znatelně pomalejší – nástroj vás na to upřímně upozorní.
- První běh. Prohlížeč stáhne váhy modelu jednou (asi 3 GB) a uloží je do mezipaměti. Pozdější běhy začínají okamžitě.
- Paměť. Je potřeba asi 3 GB volné paměti. Na slabém zařízení nástroj namísto zhroucení zobrazí jasné varování.
- Výsledek. Hotový soubor je 24 kHz WAV, připravený k umístění na vaši časovou osu úprav.
Pro koho to je
Neurální převod textu na řeč pokrývá mnoho každodenních úkolů: namluvení klipu pro sociální média, vytvoření zvukové verze článku, namluvení prezentace, kontrola, jak zní skript, nebo prostě poslech dokumentu místo jeho čtení. Pokud potřebujete hlas konkrétní osoby, naklonujte jej z krátké nahrávky.
Ve stejné sekci jsou další bezplatné nástroje, které běží přímo v prohlížeči: hloubkovou mapu, odstraňovač pozadí videa a video a obrázek upscaler.
Často kladené otázky
Je to opravdu zdarma? Ano. Za tento model se neúčtují žádné tokeny a nemá placené rozhraní API – práci udělá váš počítač.
Je můj text nahraný? Ne. Text ani zvuk neopustí vaše zařízení; pouze kód nástroje a hmotnosti modelu pocházejí ze serveru.
Jak dlouho to trvá? Krátká fráze obvykle trvá méně než minutu poté, co byl model jednou stažen; delší text trvá déle a ukazatel průběhu ukazuje, kde se nachází.