← Todos os artigos

Dublagem Gemini TTS: 30 vozes e todas as configurações

Um estúdio de gravação iluminado perto da janela: dois microfones, fones de ouvido e ondas sonoras coloridas, cartões flutuantes macios com linhas de diálogo, muita luz

Na seção "Áudio" uma nova ferramenta apareceu - dublagem de diálogos Gemini TTS. Ele transforma o roteiro finalizado em som: você especifica os falantes, suas vozes e caráter, e o serviço expressa as falas uma por uma e retorna o MP3 finalizado.

Seção de áudio: a ferramenta de narração Gemini TTS com dois falantes configurados, linhas de diálogo, controle deslizante de temperatura e preço mostrado antes de começar

Que tipo de instrumento é esse

Isto não é ler um texto em uma só voz, mas uma leitura completa diálogo com vários falantes. Cada personagem ganha sua própria voz, sotaque, estilo de apresentação e ritmo - e as falas soam da maneira que foram planejadas: uma conversa entre os apresentadores, uma esquete, uma entrevista, falas dos personagens do vídeo.

Dois modelos disponíveis:

  • Gemini 3.8 Flash TTS — dublagem expressiva: emoções mais ricas, ritmo mais natural, controle mais preciso da entrega. Adequado para podcasts, audiolivros e narrações.
  • Gemini 3.8 Flash-Lite TTS — a mesma mecânica é mais barata e rápida: para grandes volumes, rascunhos e leitura de textos em voz alta.

Quais configurações estão disponíveis?

A interface exibe todos os parâmetros fornecidos pelo modelo de dublagem:

  • Falantes. De um a vários personagens; cada um tem sua própria assinatura “Speaker 1”, “Speaker 2” e assim por diante, pela qual as réplicas são associadas à voz.
  • 30 votos - da narrativa suave à enérgica e “notícia”.
  • 8 acentos - neutro, americano (geral, "vale", sul), britânico (RP e Brixton), transatlântico, australiano.
  • 6 estilos de servir — sorriso na voz, locutor, sussurro, empatia, promoção e tom “seco” e uniforme.
  • 4 taxas de fala - natural, padrão, “deriva” suave e irregular.
  • Personagem de voz - descrição livre, como “contador de histórias caloroso” ou “guardião severo”.
  • Temperatura - de 0 a 2: menor - mais estável e previsível, maior - mais vivo e variado.
  • Cena e tom geral - uma descrição do cenário (“uma sala silenciosa com uma lareira crepitante”) e do estilo de narração (“um audiolivro, suave e convidativo”).
  • Réplicas — cada linha de diálogo até 10.000 caracteres; a ordem das réplicas é preservada.

Como dar voz ao diálogo: passo a passo

  1. Abrir Seção "Áudio" e selecione um modelo Gemini 3.8 Flash TTS ou Flash-LiteTTS - estão no final da lista de modelos.
  2. Adicione falantes e personalize a voz, o sotaque, o estilo e o ritmo de cada pessoa.
  3. Escreva as linhas do diálogo e identifique o orador de cada uma.
  4. Se desejar, preencha a descrição da cena, tom geral e temperatura.
  5. Observe o preço - ele fica visível ANTES do lançamento e é recalculado conforme você insere o texto.
  6. Clique em “Voz” e quando estiver pronto, ouça o resultado e baixe MP3.

Quanto custa isso

O preço é calculado com base no volume real de texto: quanto mais longas as réplicas, maior o custo, e é visível antes do lançamento – não há surpresas após a geração. O pagamento é feito com tokens do site, assim como nas demais gerações pagas; se não tiver êxito, os tokens serão retornados automaticamente. A guia de preços pode ser visualizada diretamente no formulário: o valor é atualizado enquanto você digita o script.

Perguntas frequentes

Posso narrar diálogos entre dois ou mais personagens? Sim, cada locutor tem sua própria voz e configurações, as falas se revezam.

Em que formato está o resultado? MP3 - você pode ouvir na página e baixá-lo com um botão.

Quais idiomas o modelo fala? O modelo é multilíngue: expressa textos em dezenas de idiomas, incluindo russo e inglês.

O que escolher: Flash ou Flash-Lite? Para projetos expressivos - Flash, para grandes volumes e rascunhos - Flash-Lite: a mecânica é a mesma, porém mais barata e rápida.

Tenho que pagar para tentar? A baixa ocorre quando a dublagem é iniciada e, caso haja algum erro, os tokens são devolvidos automaticamente.