Sora、Midjourney、Kling のプロンプトの書き方: 初心者向けガイド
主要なこと(BLUF)について簡単に説明します。
優れたプロンプトには、主題、アクション、スタイル、カメラ、ライトという公式があり、それから逸脱すべきではありません。このガイドでは、写真 (Midjourney、Flux)、ビデオ (Sora、VEO)、画像からビデオへの変換 (Kling) というタスク別に分類されており、私自身が経験した典型的な問題も含まれています。
あなたは状況をご存知ですか? Midjourney で誰かの素晴らしい結果を見て、あなたは同様のプロンプトをコピーしましたが、結果はナンセンスでした。私はこれを経験してきました。問題はモデルにあるのではなく、リクエストの作成方法にあることが判明しました。結果の 80% はプロンプトです。以下は、Sora、Midjourney、Kling、そして一般にあらゆる生成モデルに実際に機能するルールです。社内で使用しています ニューラルスペース.
基本的な公式 - 覚えて諦めないでください
主題 + アクション + 環境 + スタイル + 光 + 構図。
各リンクによりコントロール性が向上します。主題がなければ、モデルは独自の何かを思いつきます。スタイルがなければ、「平均的な写真」になってしまいます。ライトを示さないと雰囲気がなくなってしまいます。毎回 6 つすべてを登録する必要はありませんが、多いほどヒットの精度が高くなります。

写真の入力を求めるプロンプト (Midjourney、Flux)
- カンマで区切られた短いブロック: 「赤いコートを着た少女、秋の公園、柔らかな逆光、35 mm フィルム」
- スタイルと参照を示します。 「水彩」、「アイソメトリック」、「ウェス・アンダーソンの精神で」 - モデルはこれを理解しています
- ネガティブ - 別々に!メインプロンプトに「テキストなし」と書かないでください。これには否定的なプロンプトがあります。
- で ニューラルスペース ロシア語で書くことができます - プラットフォーム自体が翻訳して最適化します
ビデオのプロンプト (Sora、VEO)
- まずフレーム、次に動き。「夕方の街路、カメラはゆっくりと後ろに進み、傘をさした人々が通り過ぎる」
- 持続時間を「3秒」、「短い動き」で指定します。これがないと、モデルが勝手に判断して推測できない可能性があります。
- 難しいビデオですか?シーンへの突入 - Sora 2 プロのストーリーボード 「ビデオ」セクション これがそのために作られたものです
画像からビデオへ (Kling)
ここでの主な間違いは、もう一度写真を説明することです。写真はすでにそこにあります! 「髪が左からの風になびく」、「キャラクターが一歩を踏み出し、カメラが静止している」など、動きだけを説明します。簡潔かつ具体的。
典型的な間違い(すべて私がやった)
- 200 語の入力を求めるプロンプト - モデルが混乱し、混乱が生じます
- 矛盾:「冬の夜、太陽の光」 - 真剣に、人々はそう書きます
- 1 回のリクエストで 5 件の参照。 1 つまたは 2 つ - 最大
- 段階的に調整するのではなく、1 つのプロンプトですべてを修正しようとしている
テンプレートと成功したプロンプトは次の場所で確認できます。 「トレンド」セクション — そこでは、他の NeuralSpace ユーザーが生成したものを見ることができます。
よくある質問(FAQ)
質問: ニューラル ネットワークから最良の結果を得るにはどうすればよいですか?
回答: 英語の詳細なプロンプト (説明) を使用し、シーンのスタイルと詳細を設定します。
質問: これらの素材は商業目的で使用できますか?
回答: はい、生成されたコンテンツは完全にあなたのものです。