声優 Gemini TTS: 30 の声とすべての設定
セクション内 "オーディオ" 新しいツールが登場しました - セリフの声優 Gemini TTS。完成したスクリプトをサウンドに変換します。話者、その声、キャラクターを指定すると、サービスがセリフを 1 つずつ音声化して、完成した MP3 を返します。

これはどんな楽器ですか
これは 1 つのテキストを 1 つの音声で読むのではなく、完全に読み上げます。 複数話者の対話。各キャラクターには独自の声、アクセント、プレゼンテーション スタイル、テンポがあり、セリフは意図したとおりに聞こえます。プレゼンター間の会話、寸劇、インタビュー、ビデオのキャラクターのセリフなどです。
2 つのモデルが利用可能:
- Gemini 3.8 Flash TTS — 表現力豊かな声の演技: より豊かな感情、より自然なリズム、より繊細な表現の制御。ポッドキャスト、オーディオブック、ナレーションに適しています。
- Gemini 3.8 Flash-Lite TTS — 大量の文書、下書き、テキストの読み上げなど、同じ仕組みがより安く、より速くなります。
どのような設定が利用可能ですか?
インターフェイスには、声優モデルによって提供されるすべてのパラメータが表示されます。
- 話者。 1 文字から数文字まで。それぞれには独自の署名「Speaker 1」、「Speaker 2」などがあり、それによってレプリカが音声に関連付けられます。
- 30票 - ソフトな物語からエネルギッシュな「ニュース」まで。
- 8つのアクセント - 中立、アメリカ (一般、「谷」、南部)、イギリス (RP およびブリクストン)、大西洋横断、オーストラリア。
- 6つの提供スタイル — 笑顔の声、アナウンサー、ささやき声、共感、宣伝、そして「乾いた」均一な口調。
- 4 つの発話速度 - ナチュラル、パタパタ、スムーズな「ドリフト」、ジャーキー。
- ボイスキャラクター - 「温かい語り手」または「厳格な門番」など、自由な説明。
- 温度 - 0 から 2: 低いほど安定していて予測可能、高いほど活気があり多様性に富みます。
- シーンと全体的なトーン - 環境の説明 (「パチパチ音を立てる暖炉のある静かな部屋」) とナレーションのスタイル (「オーディオブック、柔らかくて魅力的」)。
- レプリカ — 会話の各行は最大 10,000 文字。レプリカの順序は保持されます。
対話を音声化する方法: ステップバイステップ
- 開ける 「オーディオ」セクション そしてモデルを選択してください Gemini 3.8 Flash TTS または Flash-LiteTTS - モデルのリストの一番下にあります。
- 話者を追加して、各人の声、アクセント、スタイル、テンポをカスタマイズします。
- 会話のセリフを書き、それぞれの発言者を特定します。
- 必要に応じて、シーンの説明、全体のトーン、温度を入力します。
- 価格を見てください。価格は発売前に表示され、テキストを入力すると再計算されます。
- 「音声」をクリックし、準備ができたら結果を聞いて、MP3 をダウンロードします。
いくらかかりますか
価格は実際のテキストの量に基づいて計算されます。レプリカが長ければ長いほど、コストは高くなります。価格は発売前に確認できます。生成後に驚くようなことはありません。他の有料世代と同様に、支払いはサイト トークンを使用して行われます。失敗した場合、トークンは自動的に返されます。価格ガイドはフォームで直接表示できます。スクリプトを入力している間に金額が更新されます。
よくある質問
2 人以上のキャラクター間の会話に音声を吹き込むことはできますか? はい、各話者には独自の音声と設定があり、セリフは順番に切り替わります。
結果はどのような形式で出力されますか? MP3 - ページ上で聴いて、ボタン 1 つでダウンロードできます。
モデルは何語を話しますか? このモデルは多言語対応で、ロシア語や英語を含む数十の言語でテキストを音声化します。
どれを選択しますか: Flash または Flash-Lite? 表現力豊かなプロジェクトの場合 - Flash、大容量およびドラフト用 - Flash-Lite: 仕組みは同じですが、より安く、より高速です。
試すにはお金を払う必要がありますか? 音声の演技が開始されると消失が発生し、エラーが発生した場合はトークンが自動的に返されます。