← すべての記事

テキストからのビデオ: 意図したとおりにシーンを説明する方法

タイプライターから光のリボンが立ち上がり、フレーム内に広がります。

主要なこと(BLUF)について簡単に説明します。

ほとんどすべての人にとって、テキストからの最初のビデオは、説明に主要なものが含まれていないため、3秒間の混乱であることがわかります。私たちはシーンを 5 つのレイヤー (誰が何をするか、どのように撮影するか、光、スタイル) に分割します。 「悪い→良い」の例と、最も頻繁に故障する箇所の分析付き。

テキストの最初のビデオは、ほとんどの人にとって失敗します。ある人が「猫のいる美しいビデオ」を書いたところ、3 秒ほど混乱が生じ、ニューラル ネットワークは過大評価されていると結論付けられました。

モデルの話ではないんです。実際のところ、シーンの説明は検索クエリではなく、オペレーターにとっては小さな技術的な作業です。それが何で構成されているかを説明します。

光のリボンがタイプライターから立ち上がり、浮遊フレームに展開します。

通常の記述の 5 層

モデルはあなたが言わなかったすべてを推測します。彼らの言葉が少ないほど、彼女は推測することが多くなり、結果は彼女の頭の中にあったものから遠ざかってしまいます。したがって、私たちは階層的に話します。

  • フレームの中には誰が、あるいは何が入っているのか。 「猫」ではなく、「赤い猫が窓辺に座っている」。
  • 何が起こっていますか。 アクションは 3 つではなく 1 つです。 「頭を窓の方に向けます。」
  • カメラはどこにあり、どのように動くのか。 「ミディアムショット、カメラはゆっくりとズームインします。」この層はほとんどの場合スキップされますが、問題の半分は解決されます。
  • 光と時間帯。 「窓から差し込む暖かい夕日の光、柔らかな影。」
  • 雰囲気とかスタイルとか。 「ドキュメンタリーの中にいるような、穏やかで家庭的な雰囲気。」

「赤い猫が窓辺に座り、ゆっくりと窓の方を向いています。ミディアムショット、カメラがゆっくりとズームインしています。暖かい夕日の光、柔らかな影、穏やかで家庭的な雰囲気。」これは技術仕様であり、希望ではありません。

2 つのフレームを並べて表示: 左側はぼやけて混沌としたもの、右側は明確で整然としたもの

悪い→良い

実際の練習からのいくつかのペア:

  • 「街」→「雨の夜道、水たまりに映るネオン、目の高さでゆっくりと進むカメラ」。
  • 「美しいコーヒー」→「クローズアップ:ミルクが細い流れでブラックコーヒーに注がれ、模様が円形に広がり、柔らかな横からの光。」
  • 「少女は歩いている」→「後ろからのミディアムショット。ロングコートを着た男が誰もいない堤防に沿って歩いている。風がコートの裾を波立たせている。灰色の朝。」

パターンに気づきましたか?すべての「良い」オプションにはアクションが 1 つだけあります。これが主要なルールです。4 秒は 1 つの動作であり、プロットではありません。

一番頻繁に壊れるのはどこですか?

私がいつも目にする3つの間違い。

ものが多すぎます。 「男は家を出て車に乗り、街を走り回って海にやって来る」 - これはビデオではなく、4 つのビデオのストーリーボードです。モデルはすべてを適合させようとし、何もしません。

写真の代わりに抽象化。 「雰囲気がある」、「スタイリッシュ」、「すごい効果」、モデルはそれがどのように見えるかを知りません。しかし、彼は「逆光が少ない、フレーム内の煙、長い影」を知っています。

フレーム内のテキスト。 このモデルは依然として碑文の描画が下手で、文字が曲がっていたり、架空の文字になっている場合もあります。テキストが必要な場合は、後で任意のエディターで追加します。

フォーマットについて

ビデオをどこに送信するかを事前に決めてください。垂直 9:16 - テープとショートパンツ用、水平 16:9 - 現場とプレゼンテーション用。後でエッジを失わずにフォーマットをやり直すことはできません。必要に応じてすぐに生成する方が簡単です。

セクションに独自の説明を書いてみることができます ビデオ生成、このタスクの短い着陸 - テキストからのビデオ。最初から作成するのではなく、既製のテンプレートに従って作成したい場合は、見てください。 トレンド、シーンはすでに説明されているので、独自のシーンを追加するだけです。

ちなみに、適切な写真がある場合は、そのシーンを言葉で説明するよりも、それに命を吹き込むほうが早いことがよくあります。 ビデオを生成する無料の方法の分析 そして ビデオ用モデルのレビュー どこから始めるべきかを選択するのに役立ちます。

カメラに関する 1 つのアクションと 1 つのフレーズから始めます。そこからは独自に進んでいきます。

よくある質問(FAQ)

質問: ニューラル ネットワークから最良の結果を得るにはどうすればよいですか?
回答: 英語の詳細なプロンプト (説明) を使用し、シーンのスタイルと詳細を設定します。

質問: これらの素材は商業目的で使用できますか?
回答: はい、生成されたコンテンツは完全にあなたのものです。