← Kaikki artikkelit

Dialogien ääninäyttely Gemini TTS:llä: 30 ääntä ja kaikki asetukset

Valoisa äänitysstudio ikkunan vieressä: kaksi mikrofonia, kuulokkeet ja värilliset ääniaallot, pehmeät kelluvat kortit dialogilinjoilla, paljon valoa

osiossa "Audio" uusi työkalu on ilmestynyt - dialogien ääninäyttely Gemini TTS. Se muuttaa valmiin käsikirjoituksen ääneksi: määrität puhujat, heidän äänensä ja hahmonsa, ja palvelu äänittää rivit yksitellen ja palauttaa valmiin MP3.

Ääniosio: Gemini TTS selostustyökalu kahdella kaiuttimella, dialogilinjat, lämpötilan liukusäädin ja hinta, joka näkyy ennen aloitusta

Millainen instrumentti tämä on

Tämä ei ole yhden tekstin lukemista yhdellä äänellä, vaan kokonaisena monen puhujan dialogia. Jokainen hahmo saa oman äänensä, korostuksensa, esitystyylinsä ja temponsa – ja linjat kuulostavat siltä kuin ne on tarkoitettukin: keskustelu juontajien välillä, sketsi, haastattelu, hahmojen rivit videoon.

Saatavilla kaksi mallia:

  • Gemini 3.8 Flash TTS — ilmeikäs ääninäyttely: rikkaammat tunteet, luonnollisempi rytmi, tarkempi toimituksen hallinta. Soveltuu podcasteille, äänikirjoille, selostuksille.
  • Gemini 3.8 Flash-Lite TTS — Sama mekaniikka on halvempaa ja nopeampaa: suurille määrille, luonnoksille ja tekstien ääneen lukemiselle.

Mitä asetuksia on saatavilla?

Käyttöliittymä näyttää kaikki ääniohjausmallin tarjoamat parametrit:

  • Puhujat. yhdestä useampaan hahmoon; jokaisella on oma allekirjoituksensa “Speaker 1”, “Speaker 2” ja niin edelleen, jolla kopiot yhdistetään ääneen.
  • 30 ääntä - pehmeästä narratiivista energiseen ja "uutiseen".
  • 8 aksenttia - neutraali, amerikkalainen (yleinen, "laakso", eteläinen), brittiläinen (RP ja Brixton), transatlanttinen, australialainen.
  • 6 tarjoilutyyliä - hymy äänessä, kuuluttaja, kuiskaus, empatia, promo ja "kuiva" tasainen sävy.
  • 4 puhenopeutta - luonnollinen, kuviollinen, sileä "drift" ja nykivä.
  • Äänihahmo - ilmainen kuvaus, kuten "lämmin tarinankertoja" tai "tiukka portinvartija".
  • Lämpötila - 0 - 2: matalampi - vakaampi ja ennakoitavampi, korkeampi - elävämpi ja monipuolisempi.
  • Kohtaus ja yleinen sävy - kuvaus ympäristöstä ("hiljainen huone, jossa rätisevä takka") ja kerrontyyli ("äänikirja, pehmeä ja kutsuva").
  • Kopioita — kukin dialogirivi enintään 10 000 merkkiä; jäljennösten järjestys säilyy.

Dialogin puhuminen: askel askeleelta

  1. Avata "Ääni"-osio ja valitse malli Gemini 3.8 Flash TTS tai Flash-LiteTTS - ne ovat malliluettelon lopussa.
  2. Lisää puhujia ja mukauta kunkin henkilön ääntä, aksenttia, tyyliä ja tempoa.
  3. Kirjoita dialogin rivit ja tunnista kunkin puhuja.
  4. Täytä halutessasi kohtauksen kuvaus, yleinen sävy ja lämpötila.
  5. Katso hintaa - se näkyy ENNEN julkaisua ja se lasketaan uudelleen kirjoittaessasi tekstiä.
  6. Napsauta "Voice" ja kun olet valmis, kuuntele tulos ja lataa MP3.

Kuinka paljon se maksaa

Hinta lasketaan todellisen tekstimäärän perusteella: mitä pidemmät kopiot, sitä korkeammat kustannukset, ja se näkyy ennen julkaisua - sukupolven jälkeen ei tule yllätyksiä. Maksu suoritetaan käyttämällä sivuston tunnuksia, kuten muidenkin maksettujen sukupolvien kohdalla; jos epäonnistuminen, tokenit palautetaan automaattisesti. Hintaopas on katsottavissa suoraan lomakkeesta: summa päivittyy, kun kirjoitat käsikirjoitusta.

Usein kysytyt kysymykset

Voinko puhua kahden tai useamman hahmon välistä dialogia? Kyllä, jokaisella kaiuttimella on oma ääni ja asetukset, linjat vuorottelevat.

Missä muodossa tulos on? MP3 - voit kuunnella sen sivulla ja ladata sen yhdellä painikkeella.

Mitä kieliä malli puhuu? Malli on monikielinen: se lukee tekstejä kymmenillä kielillä, mukaan lukien venäjäksi ja englanniksi.

Mitä valita: Flash vai Flash-Lite? Ilmeisissä projekteissa - Flash, suurille määrille ja luonnoksille - Flash-Lite: mekaniikka on sama, mutta halvempi ja nopeampi.

Pitääkö minun maksaa kokeillakseni? Poisto tapahtuu äänitoiminnan alkaessa, ja jos tapahtuu virhe, tunnukset palautetaan automaattisesti.