インタラクティブなアバター: アバターとリアルタイムでライブ対話を行う方法
インタラクティブ アバターは、セクションのストリーミング セッションです。 「ビデオアバター」: アバターはテキストまたはアップロードされた音声からライブで話し、その結果はストリーミング リンク経由ですぐに利用できます。アバターを使用した通常のビデオとの根本的な違いは、完成したビデオのレンダリングに数分かかりますが、ライブ セッションでは数秒で話し始め、ブロードキャスト中にテキストを直接送信できることです。以下は、このツールが何であるか、どのようなモードがあるか、セッションの開始方法、および費用はいくらであるかを示します。
それは何ですか?誰が役立つと思いますか?
通常のビデオ アバターは録画です。テキストを設定し、レンダリングを待って、完成したファイルを取得します。インタラクティブなアバターは、ライブブロードキャストのように、異なる動作をします。セッションが開き、アバターがすぐに話し始めます。新しいフレーズを送信したり、停止したり、閉じたりするなど、セッションをリアルタイムで制御します。この形式は、ランディング ページでのゲストへの挨拶、質問へのライブ回答、短いデモンストレーション、最終的なビデオを録画する前の台本のリハーサル、会議やトレーニングでのバーチャル プレゼンターなど、瞬間が重要な場合に便利です。
ライブ フォーマットが従来の世代よりもどれほど高速であるかは、プラットフォームの測定結果からわかります。2026 年 9 月 7 日のテレメトリによると、5 秒の 1080p クリップは平均約 115 秒でレンダリングされ、95% のケースで 165 秒以内に収まります。完成したビデオ アバターはバックグラウンドで数分間実行されます。プラットフォームの生成ログによると、30 日間 (2026 年 9 月 3 日から 10 月 2 日まで) で 3,304 個のビデオ タスクが開始され、そのうち 2,377 個が正常に完了しました。ライブ セッションはこの待機とは関係なく、すぐに開始されます。
3 つの言論源
このツールには 3 つのモードがあります。タスクに適したモードを選択してください。
- テキスト (スクリプト)。 完成したテキストを入力します。アバターはそれをそのまま読み上げます。挨拶、アナウンス、準備した発言などに適しています。
- ストリーミングテキスト。 開始フレーズを設定し、セッション中に新しい行を送信すると、アバターはライブ対話のように話し続けます。外出先で答えが生まれるときに便利です。
- オーディオ。 既製のオーディオ ファイルをアップロードすると、アバターが正確なアーティキュレーション (リップ シンク) でそれを繰り返します。自分の声またはクローンを使用して音声演技がすでに録音されている場合に便利です。
「テキスト」および「テキスト ストリーム」モードのテキスト - 最大 5000 文字。音声は検索とプレビューを使用してカタログから選択されます。開始する前に、音声の横にある試聴ボタンをクリックして音声を聞いてください。

開始方法: ステップバイステップ
- タブを開く 「インタラクティブアバター」 「ビデオアバター」セクションで。
- サインイン: ゲストはセクションを表示できますが、セッションを開始するにはサインインする必要があります。
- 音声ソースをテキスト、テキスト ストリーム、またはオーディオから選択します。
- 既製の画像のギャラリーからアバターを選択します。
- テキストを含むモードの場合は、音声を選択してセリフを入力します。最初に音声を聞くことができます。
- 音声モードの場合は、音声ファイルを添付します。
- トークンの価格を見てください。価格は発売前に表示され、セッションの長さに応じて計算されます。
- 「セッションを開始」をクリックします。アバターが話し始め、セッションが履歴に表示されます。
セッションを管理する方法
ライブ セッションはファイルではなくストリームであるため、履歴内に「オンエア」、「完了」、「エラー」などの独自のステータスが存在します。完成したセッションはストリーミング リンクで開き、内蔵プレーヤーを介してカード内で直接表示できます。 「テキスト フロー」モードでは、セッションがアクティブな間、新しいフレーズを送信するためのフィールドが表示されます。これにより、会話は再開されることなく継続されます。どのセッションもボタンで停止し、履歴から削除できます。
いくらかかりますか
支払いはセッション秒数に基づいて行われ、最小ブロックは 1 分です。トークンの価格は発売前に表示され、償却される同じデータを使用して計算されるため、表示される金額は有効な入力の実際の金額と等しくなります。セッションが失敗した場合は、取り消されたものが返されます。サブスクリプションはありません。新規ユーザーには最初のテストの開始トークンが与えられ、その後、残高に必要な量が補充されます。
何を組み合わせるか
- 「アバターと世代」 — アバターを使用して通常のビデオを録画します。
- 「テキストナレーション」 — ライブ セッションで提示できる音声を準備します。
- 「ボイスクローン」 - あなた自身の声で声を上げてください。
- 「スタジオ風景」 — いくつかのシーンからビデオを組み立てます。
よくある質問
インタラクティブ アバターは通常のアバター ビデオとどう違うのですか?
通常のビデオは録画です。テキストが事前に設定され、その後レンダリングが行われ、完成したファイルが得られます。ライブ セッションはストリームです。アバターはすぐに話し始め、ブロードキャスト中にテキストを送信できます。 1 つ目は完成したビデオ用で、2 つ目はその瞬間の対話と回答用です。
タブを開いたままにする必要がありますか?
セッションはサービス側で存続し、結果はストリーミング リンクを介して利用できます。履歴からセッションに戻ることができます。開いたタブから「テキストストリーム」モードでフレーズを送信すると便利です。
どのような音声と言語が利用可能ですか?
音声は、言語フィルターを使用してカタログから取得されます。音声は、発売前に検索して聞くことができます。音声言語はモードとは別に選択され、希望の言語でテキストを読むことができます。
セッションの費用はいくらですか?
最小ブロックは 1 分で秒単位。トークンの価格は発売前に確認でき、償却価格と等しくなります。サブスクリプションはなく、新規ユーザーには開始トークンが与えられます。