Dublagem Gemini TTS: 30 vozes e todas as configurações
Na seção "Áudio" uma nova ferramenta apareceu - dublagem de diálogos Gemini TTS. Ele transforma o roteiro finalizado em som: você especifica os falantes, suas vozes e caráter, e o serviço expressa as falas uma por uma e retorna o MP3 finalizado.

Que tipo de instrumento é esse
Isto não é ler um texto em uma só voz, mas uma leitura completa diálogo com vários falantes. Cada personagem ganha sua própria voz, sotaque, estilo de apresentação e ritmo - e as falas soam da maneira que foram planejadas: uma conversa entre os apresentadores, uma esquete, uma entrevista, falas dos personagens do vídeo.
Dois modelos disponíveis:
- Gemini 3.8 Flash TTS — dublagem expressiva: emoções mais ricas, ritmo mais natural, controle mais preciso da entrega. Adequado para podcasts, audiolivros e narrações.
- Gemini 3.8 Flash-Lite TTS — a mesma mecânica é mais barata e rápida: para grandes volumes, rascunhos e leitura de textos em voz alta.
Quais configurações estão disponíveis?
A interface exibe todos os parâmetros fornecidos pelo modelo de dublagem:
- Falantes. De um a vários personagens; cada um tem sua própria assinatura “Speaker 1”, “Speaker 2” e assim por diante, pela qual as réplicas são associadas à voz.
- 30 votos - da narrativa suave à enérgica e “notícia”.
- 8 acentos - neutro, americano (geral, "vale", sul), britânico (RP e Brixton), transatlântico, australiano.
- 6 estilos de servir — sorriso na voz, locutor, sussurro, empatia, promoção e tom “seco” e uniforme.
- 4 taxas de fala - natural, padrão, “deriva” suave e irregular.
- Personagem de voz - descrição livre, como “contador de histórias caloroso” ou “guardião severo”.
- Temperatura - de 0 a 2: menor - mais estável e previsível, maior - mais vivo e variado.
- Cena e tom geral - uma descrição do cenário (“uma sala silenciosa com uma lareira crepitante”) e do estilo de narração (“um audiolivro, suave e convidativo”).
- Réplicas — cada linha de diálogo até 10.000 caracteres; a ordem das réplicas é preservada.
Como dar voz ao diálogo: passo a passo
- Abrir Seção "Áudio" e selecione um modelo Gemini 3.8 Flash TTS ou Flash-LiteTTS - estão no final da lista de modelos.
- Adicione falantes e personalize a voz, o sotaque, o estilo e o ritmo de cada pessoa.
- Escreva as linhas do diálogo e identifique o orador de cada uma.
- Se desejar, preencha a descrição da cena, tom geral e temperatura.
- Observe o preço - ele fica visível ANTES do lançamento e é recalculado conforme você insere o texto.
- Clique em “Voz” e quando estiver pronto, ouça o resultado e baixe MP3.
Quanto custa isso
O preço é calculado com base no volume real de texto: quanto mais longas as réplicas, maior o custo, e é visível antes do lançamento – não há surpresas após a geração. O pagamento é feito com tokens do site, assim como nas demais gerações pagas; se não tiver êxito, os tokens serão retornados automaticamente. A guia de preços pode ser visualizada diretamente no formulário: o valor é atualizado enquanto você digita o script.
Perguntas frequentes
Posso narrar diálogos entre dois ou mais personagens? Sim, cada locutor tem sua própria voz e configurações, as falas se revezam.
Em que formato está o resultado? MP3 - você pode ouvir na página e baixá-lo com um botão.
Quais idiomas o modelo fala? O modelo é multilíngue: expressa textos em dezenas de idiomas, incluindo russo e inglês.
O que escolher: Flash ou Flash-Lite? Para projetos expressivos - Flash, para grandes volumes e rascunhos - Flash-Lite: a mecânica é a mesma, porém mais barata e rápida.
Tenho que pagar para tentar? A baixa ocorre quando a dublagem é iniciada e, caso haja algum erro, os tokens são devolvidos automaticamente.