← すべての記事

Sora、Midjourney、Kling のプロンプトの書き方: 初心者向けガイド

Sora、Midjourney、Kling のプロンプトの書き方: 初心者向けガイド - NeuralSpace

主要なこと(BLUF)について簡単に説明します。

優れたプロンプトには、主題、アクション、スタイル、カメラ、ライトという公式があり、それから逸脱すべきではありません。このガイドでは、写真 (Midjourney、Flux)、ビデオ (Sora、VEO)、画像からビデオへの変換 (Kling) というタスク別に分類されており、私自身が経験した典型的な問題も含まれています。

あなたは状況をご存知ですか? Midjourney で誰かの素晴らしい結果を見て、あなたは同様のプロンプトをコピーしましたが、結果はナンセンスでした。私はこれを経験してきました。問題はモデルにあるのではなく、リクエストの作成方法にあることが判明しました。結果の 80% はプロンプトです。以下は、Sora、Midjourney、Kling、そして一般にあらゆる生成モデルに実際に機能するルールです。社内で使用しています ニューラルスペース.

基本的な公式 - 覚えて諦めないでください

主題 + アクション + 環境 + スタイル + 光 + 構図。

各リンクによりコントロール性が向上します。主題がなければ、モデルは独自の何かを思いつきます。スタイルがなければ、「平均的な写真」になってしまいます。ライトを示さないと雰囲気がなくなってしまいます。毎回 6 つすべてを登録する必要はありませんが、多いほどヒットの精度が高くなります。

プロンプトの書き方: テキストが画像やビデオに変わります

写真の入力を求めるプロンプト (Midjourney、Flux)

  • カンマで区切られた短いブロック: 「赤いコートを着た少女、秋の公園、柔らかな逆光、35 mm フィルム」
  • スタイルと参照を示します。 「水彩」、「アイソメトリック」、「ウェス・アンダーソンの精神で」 - モデルはこれを理解しています
  • ネガティブ - 別々に!メインプロンプトに「テキストなし」と書かないでください。これには否定的なプロンプトがあります。
  • ニューラルスペース ロシア語で書くことができます - プラットフォーム自体が翻訳して最適化します

ビデオのプロンプト (Sora、VEO)

  • まずフレーム、次に動き。「夕方の街路、カメラはゆっくりと後ろに進み、傘をさした人々が通り過ぎる」
  • 持続時間を「3秒」、「短い動き」で指定します。これがないと、モデルが勝手に判断して推測できない可能性があります。
  • 難しいビデオですか?シーンへの突入 - Sora 2 プロのストーリーボード 「ビデオ」セクション これがそのために作られたものです

画像からビデオへ (Kling)

ここでの主な間違いは、もう一度写真を説明することです。写真はすでにそこにあります! 「髪が左からの風になびく」、「キャラクターが一歩を踏み出し、カメラが静止している」など、動きだけを説明します。簡潔かつ具体的。

典型的な間違い(すべて私がやった)

  • 200 語の入力を求めるプロンプト - モデルが混乱し、混乱が生じます
  • 矛盾:「冬の夜、太陽の光」 - 真剣に、人々はそう書きます
  • 1 回のリクエストで 5 件の参照。 1 つまたは 2 つ - 最大
  • 段階的に調整するのではなく、1 つのプロンプトですべてを修正しようとしている

テンプレートと成功したプロンプトは次の場所で確認できます。 「トレンド」セクション — そこでは、他の NeuralSpace ユーザーが生成したものを見ることができます。

よくある質問(FAQ)

質問: ニューラル ネットワークから最良の結果を得るにはどうすればよいですか?
回答: 英語の詳細なプロンプト (説明) を使用し、シーンのスタイルと詳細を設定します。

質問: これらの素材は商業目的で使用できますか?
回答: はい、生成されたコンテンツは完全にあなたのものです。