AI Text to Speech Free: Suarakan Teks Anda dengan Rangkaian Neural dalam Penyemak Imbas Anda
Anda kini boleh menyuarakan teks anda dengan rangkaian saraf secara percuma, tanpa perlu dipasang: the Teks ke Ucapan (percuma) model telah tiba di Video bahagian. Ia berjalan terus dalam penyemak imbas anda — taip teks, pilih bahasa dan suara, dan beberapa saat kemudian anda mendengar dan memuat turun fail audio yang telah siap. Baik teks mahupun rakaman suara tidak dimuat naik di mana-mana: semuanya dikira pada peranti anda sendiri.

Mengapa ia percuma
Perkhidmatan pertuturan biasa mensintesis audio pada pelayan mereka sendiri dan mengenakan bayaran atau token untuknya. Di sini model dimuatkan ke dalam penyemak imbas dan menggunakan kad grafik komputer anda (WebGPU, dengan pemproses sebagai sandaran). Pelayan hanya menyediakan kod alat dan berat model — ia tidak mempunyai apa-apa untuk dikira, jadi tiada token dicaj dan bilangan generasi adalah tidak terhad.
Privasi juga disediakan secara percuma: teks yang anda suarakan dan rakaman suara anda kekal pada peranti anda. Itu penting apabila anda menyuarakan mesej, dokumen atau nota peribadi.
Cara menyuarakan teks dengan rangkaian saraf: langkah demi langkah
- Buka Bahagian video dan pilih Teks ke Ucapan (percuma) dalam senarai model — ia terletak di bahagian paling bawah, bersebelahan dengan alatan percuma yang lain.
- Tampalkan teks anda ke dalam medan "Teks kepada suara" — sehingga 2000 aksara pada satu masa.
- Pilih bahasa. Jika anda tidak pasti, tinggalkan "Kesan secara automatik".
- Pilih suara: perempuan atau lelaki, lebih tinggi atau lebih rendah, bisikan — atau salah satu suara anda yang disimpan.
- Tekan "Jana pertuturan" dan tunggu sehingga ia selesai. Anda boleh memainkan hasilnya pada halaman dan memuat turunnya sebagai fail WAV.
600+ bahasa
Model ini berbilang bahasa: ia mengetahui lebih daripada 600 bahasa. Untuk teks bercampur anda boleh membiarkan pengesanan bahasa automatik dihidupkan, atau memilih bahasa yang anda perlukan — senarai itu termasuk bahasa Inggeris, Jerman, Perancis, Sepanyol, Cina, Jepun, Arab dan berdozen lagi, berguna apabila anda menyuarakan video untuk beberapa negara.
Bagaimana untuk mengklonkan suara
Anda boleh mengklonkan suara dalam dua cara — kedua-duanya adalah percuma dan kedua-duanya dikira pada peranti anda:
- Muat naik fail audio. MP3, WAV, M4A, OGG atau WebM sehingga 30 saat berfungsi dengan baik.
- Rakam dari mikrofon anda. 10–20 saat pertuturan bersih tanpa muzik atau bunyi sudah memadai.
Selepas analisis alat itu menukar rakaman menjadi profil suara dan menyimpannya dalam penyemak imbas anda. Sejak itu anda hanya memilih suara itu daripada senarai dan menyuarakan sebarang teks dengan suara anda sendiri tanpa memuat naik rakaman itu lagi. Profil disimpan secara tempatan dan bertahan dalam muat semula halaman.
Apa yang perlu diketahui sebelum larian pertama
- pelayar. Chrome atau Edge terbaru pada desktop berfungsi dengan baik. Tanpa WebGPU model jatuh kembali ke pemproses dan nyata lebih perlahan — alat ini memberi amaran kepada anda dengan jujur.
- Larian pertama. Penyemak imbas memuat turun berat model sekali (kira-kira 3 GB) dan menyimpannya dalam cache. Larian kemudian dimulakan dengan segera.
- Ingatan. Kira-kira 3 GB memori percuma diperlukan. Pada peranti yang lemah, alat menunjukkan amaran yang jelas dan bukannya ranap.
- Hasilnya. Fail siap ialah 24 kHz WAV, sedia untuk dimasukkan ke dalam garis masa penyuntingan anda.
Untuk siapa ia
Teks neural kepada pertuturan merangkumi banyak pekerjaan harian: menyuarakan klip untuk media sosial, membuat versi audio artikel, menceritakan pembentangan, menyemak bunyi skrip atau hanya mendengar dokumen dan bukannya membacanya. Jika anda memerlukan suara orang tertentu, klonkannya daripada rakaman pendek.
Bahagian yang sama mempunyai alat percuma lain yang berjalan terus dalam penyemak imbas: peta kedalaman, penghilang latar belakang video dan video dan imej yang lebih tinggi.
Soalan lazim
Adakah ia benar-benar percuma? ya. Tiada token dikenakan untuk model ini dan ia tidak mempunyai API berbayar — komputer anda berfungsi.
Adakah teks saya dimuat naik? Tidak. Baik teks mahupun audio tidak meninggalkan peranti anda; hanya kod alat dan berat model datang daripada pelayan.
Berapa lama masa yang diambil? Frasa pendek biasanya mengambil masa kurang seminit selepas model dimuat turun sekali; teks yang lebih panjang mengambil masa lebih lama dan bar kemajuan menunjukkan di mana ia berada.