← Все статьи

Озвучка диалогов Gemini TTS: 30 голосов и все настройки

Светлая студия звукозаписи у окна: два микрофона, наушники и цветные звуковые волны, мягкие парящие карточки с репликами диалога, много света

В разделе «Аудио» появился новый инструмент — озвучка диалогов Gemini TTS. Он превращает готовый сценарий в звук: вы задаёте говорящих, их голоса и характер, а сервис озвучивает реплики по очереди и возвращает готовый MP3.

Audio section: the Gemini TTS voiceover tool with two speakers configured, dialogue lines, the temperature slider and the price shown before starting

Что это за инструмент

Это не чтение одного текста одним голосом, а полноценный диалог нескольких говорящих. Каждый персонаж получает свой голос, акцент, стиль подачи и темп — и реплики звучат так, как их задумали: разговор ведущих, сценка, интервью, реплики героев для видео.

Доступны две модели:

  • Gemini 3.8 Flash TTS — выразительная озвучка: богаче эмоции, естественнее ритм, тоньше контроль подачи. Подходит для подкастов, аудиокниг, озвучки роликов.
  • Gemini 3.8 Flash-Lite TTS — та же механика дешевле и быстрее: для больших объёмов, черновиков и чтения текстов вслух.

Какие настройки доступны

Интерфейс выводит все параметры, которые даёт модель озвучки:

  • Говорящие. От одного до нескольких персонажей; у каждого — своя подпись «Speaker 1», «Speaker 2» и так далее, по которой реплики связываются с голосом.
  • 30 голосов — от мягких повествовательных до энергичных и «новостных».
  • 8 акцентов — нейтральный, американский (общий, «долина», южный), британский (RP и Брикстон), трансатлантический, австралийский.
  • 6 стилей подачи — улыбка в голосе, диктор, шёпот, эмпатия, промо и «сухой» ровный тон.
  • 4 темпа речи — естественный, скороговорка, плавный «дрейф» и отрывистый.
  • Характер голоса — свободное описание, например «тёплый рассказчик» или «суровый привратник».
  • Температура — от 0 до 2: ниже — стабильнее и предсказуемее, выше — живее и разнообразнее.
  • Сцена и общий тон — описание обстановки («тихая комната с потрескивающим камином») и манеры повествования («аудиокнига, мягко и приглашающе»).
  • Реплики — каждая строка диалога до 10 000 символов; порядок реплик сохраняется.

Как озвучить диалог: пошагово

  1. Откройте раздел «Аудио» и выберите модель Gemini 3.8 Flash TTS или Flash-Lite TTS — они стоят внизу списка моделей.
  2. Добавьте говорящих и настройте каждому голос, акцент, стиль и темп.
  3. Напишите реплики диалога и укажите для каждой говорящего.
  4. При желании заполните описание сцены, общий тон и температуру.
  5. Посмотрите цену — она видна ДО запуска и пересчитывается по мере ввода текста.
  6. Нажмите «Озвучить» и после готовности прослушайте результат и скачайте MP3.

Сколько это стоит

Цена считается по фактическому объёму текста: чем длиннее реплики, тем выше стоимость, и она видна до запуска — сюрпризов после генерации нет. Оплата идёт токенами сайта, как и за другие платные генерации; при неудаче токены возвращаются автоматически. Ориентир по цене можно посмотреть прямо в форме: сумма обновляется, пока вы печатаете сценарий.

Частые вопросы

Можно озвучить диалог двух и более персонажей? Да, у каждого говорящего свой голос и настройки, реплики идут по очереди.

В каком формате результат? MP3 — его можно слушать на странице и скачать одной кнопкой.

На каких языках говорит модель? Модель многоязычная: озвучивает тексты на десятках языков, включая русский и английский.

Что выбрать: Flash или Flash-Lite? Для выразительных проектов — Flash, для больших объёмов и черновиков — Flash-Lite: механика та же, но дешевле и быстрее.

Нужно ли платить за попытку? Списание происходит при запуске озвучки, а при ошибке токены возвращаются автоматически.