Озвучка диалогов Gemini TTS: 30 голосов и все настройки
В разделе «Аудио» появился новый инструмент — озвучка диалогов Gemini TTS. Он превращает готовый сценарий в звук: вы задаёте говорящих, их голоса и характер, а сервис озвучивает реплики по очереди и возвращает готовый MP3.

Что это за инструмент
Это не чтение одного текста одним голосом, а полноценный диалог нескольких говорящих. Каждый персонаж получает свой голос, акцент, стиль подачи и темп — и реплики звучат так, как их задумали: разговор ведущих, сценка, интервью, реплики героев для видео.
Доступны две модели:
- Gemini 3.8 Flash TTS — выразительная озвучка: богаче эмоции, естественнее ритм, тоньше контроль подачи. Подходит для подкастов, аудиокниг, озвучки роликов.
- Gemini 3.8 Flash-Lite TTS — та же механика дешевле и быстрее: для больших объёмов, черновиков и чтения текстов вслух.
Какие настройки доступны
Интерфейс выводит все параметры, которые даёт модель озвучки:
- Говорящие. От одного до нескольких персонажей; у каждого — своя подпись «Speaker 1», «Speaker 2» и так далее, по которой реплики связываются с голосом.
- 30 голосов — от мягких повествовательных до энергичных и «новостных».
- 8 акцентов — нейтральный, американский (общий, «долина», южный), британский (RP и Брикстон), трансатлантический, австралийский.
- 6 стилей подачи — улыбка в голосе, диктор, шёпот, эмпатия, промо и «сухой» ровный тон.
- 4 темпа речи — естественный, скороговорка, плавный «дрейф» и отрывистый.
- Характер голоса — свободное описание, например «тёплый рассказчик» или «суровый привратник».
- Температура — от 0 до 2: ниже — стабильнее и предсказуемее, выше — живее и разнообразнее.
- Сцена и общий тон — описание обстановки («тихая комната с потрескивающим камином») и манеры повествования («аудиокнига, мягко и приглашающе»).
- Реплики — каждая строка диалога до 10 000 символов; порядок реплик сохраняется.
Как озвучить диалог: пошагово
- Откройте раздел «Аудио» и выберите модель Gemini 3.8 Flash TTS или Flash-Lite TTS — они стоят внизу списка моделей.
- Добавьте говорящих и настройте каждому голос, акцент, стиль и темп.
- Напишите реплики диалога и укажите для каждой говорящего.
- При желании заполните описание сцены, общий тон и температуру.
- Посмотрите цену — она видна ДО запуска и пересчитывается по мере ввода текста.
- Нажмите «Озвучить» и после готовности прослушайте результат и скачайте MP3.
Сколько это стоит
Цена считается по фактическому объёму текста: чем длиннее реплики, тем выше стоимость, и она видна до запуска — сюрпризов после генерации нет. Оплата идёт токенами сайта, как и за другие платные генерации; при неудаче токены возвращаются автоматически. Ориентир по цене можно посмотреть прямо в форме: сумма обновляется, пока вы печатаете сценарий.
Частые вопросы
Можно озвучить диалог двух и более персонажей? Да, у каждого говорящего свой голос и настройки, реплики идут по очереди.
В каком формате результат? MP3 — его можно слушать на странице и скачать одной кнопкой.
На каких языках говорит модель? Модель многоязычная: озвучивает тексты на десятках языков, включая русский и английский.
Что выбрать: Flash или Flash-Lite? Для выразительных проектов — Flash, для больших объёмов и черновиков — Flash-Lite: механика та же, но дешевле и быстрее.
Нужно ли платить за попытку? Списание происходит при запуске озвучки, а при ошибке токены возвращаются автоматически.