Blog
実際に機能する AI ビデオ プロンプトの書き方 (2026 年柱ガイド)
ほとんどの「AI プロンプト ガイド」は、おそらく 10 本のビデオを作成した人によって書かれています。具体的に言うように言われます。 「シネマティック 4K」を追加するように言われます。そして、3 回目の試行で被写体がクローネンバーグのスケッチに変身した瞬間に、あなたは立ち往生してしまいます。
著者 Gürsu Yaman · muvi.video創設者 ·
実際に機能する AI ビデオ プロンプトを作成する方法
ほとんどの「AI プロンプト ガイド」は、おそらく 10 本のビデオを作成した人によって書かれています。具体的に言うように言われます。 「シネマティック 4K」を追加するように言われます。そして、3 回目の試行で被写体がクローネンバーグのスケッチに変身した瞬間に、あなたは立ち往生してしまいます。
動作する AI ビデオ プロンプトは 4 つのことを同時に実行します。明確な主題に名前を付けます。その主題を実際の地理のあるシーンに置きます。カメラに何をすべきかを指示します。そして、それはモデルが定着できる雰囲気やスタイルを指定します。それらのいずれかをスキップすれば、期待できます。 4 つすべてをヒットすれば、あなたは演出を行うことができます。
このガイドはロングバージョンです。優れたプロンプトの構造、Veo 3.1、Seedance 2.0、および Kling 3.0 で機能するパターン、出力を台無しにする間違い、実際に複雑になる反復ループ、TikTok ショート ショート、製品のヒーロー ショット、ダイアログ シーン、B ロールに適用できるテンプレートを詳しく説明します。綿毛も、「創造性を解き放つ」も、偽の例もありません。何千もの AI クリップを出荷して学んだことです。
初めての方は、まず AI 動画の作り方 から始めてください。プラットフォームの推奨事項が必要な場合は、最高の AI ビデオ ジェネレーター の内訳をご覧ください。それ以外の場合は、本題に入りましょう。
CTA ボタン: > muvi.video を無料でお試しください
作業プロンプトの構造
優れた AI ビデオ プロンプトはすべて、同じ 6 つの要素から構築されています。時々 1 つをドロップすることもできますが、最も強力なプロンプトにはすべてが含まれており、おおよそ次の順序で配置されます。
1. 被写体、フレーム内に写っている人物または内容 2. シーン、彼らがいる場所、周囲にあるもの、地理 3. アクション/モーション、何が起こっているのか、誰がどのように動くのか 4. カメラ、角度、距離、動き、レンズ 5. 照明、方向、色、雰囲気 6. スタイル、視覚的参照または美的シグナル
これは弱いプロンプトです: 「シェフが料理をしています。」
6 つの要素から構築された同じアイデアを次に示します。
「薄暗い東京の居酒屋で、使い古されたネイビーのエプロンを着た中年のシェフがステンレス製のレンジに立っています。彼は煙の出る鋳鉄製の鍋で小さな魚をひっくり返します。魚は一度弧を描き、平らに着地します。胸の高さの中くらいのクローズアップ、カメラはゆっくりと鍋を押し込みます。上からの暖かいタングステンの光が後ろの窓の冷たい青い光と混ざり合います。映画のようなアナモルフィックレンズ、わずかなフィルムグレイン。」
最初のバージョンでは、モデルがすべてを推測します。 2 つ目では、カメラをどこに置くか、シェフがどのように照らされるか、アクションがビートごとにどのように見えるかを正確に伝えます。 Veo 3.1 のようなモデルは、冗長でナンセンスな内容には報酬を与えませんが、この種の階層化された具体性には報酬を与えます。
30~80 ワードの経験則
ほとんどのショットでは 30 ~ 80 語を目指します。 30未満では監督不足です。 100 を超えるとすぐに疲労が生じ始め、モデルは文の後半で書いた要素を削除します。シーンにさらに多くのことが必要な場合は、シーンを 2 つのクリップに分割し、それらをつなぎ合わせます。
すべてのモデルで機能するプロンプト パターン
一部のプロンプト構造は一般化されます。彼らは Veo 3.1 で作業し、Seedance 2.0 で作業し、Kling 3.0 で作業します。これらを覚えておけば、これから書く必要があるショットの 80% に対応できる足場が得られます。
パターン1:被写体、アクション、設定、カメラ、スタイル
万能のデフォルト。どこから始めればよいかわからない場合に使用してください。
「黒いラブラドール (被写体) が濡れた石畳の路地を疾走します (アクション + 設定)、地面レベルで横からの低いトラッキング ショット (カメラ)、水たまりのネオンの反射、ムーディーなサイバーパンクのカラー パレット (スタイル)。」
パターン 2: 確立、移動、公開
カメラにストーリーテリング機能を持たせたい場合に最適です。
「夜明け、眠っている雪に覆われた山間の村を広い空撮。カメラはゆっくりと降下し、大通りを通って前進し、最終的にパン屋が生地をこねている明かりのついた単一の窓を明らかにします。柔らかいピンク色の日の出の光、穏やかな降雪。」
パターン3:ホールド、トリガー、リアクション
セリフ・キャラクターモーメント公式。 Veo 3.1 では強力で、マルチビート シーンを適切に処理し、ビデオと一緒にアンビエント オーディオと対話オーディオをネイティブに生成します (Google の製品ドキュメントによると、プラットフォームで確認してください)。
「木製のキッチンテーブルで手紙を読む女性のクローズアップ。彼女は読み終え、息を吐き、目が潤む。後ろの窓から暖かい午後の光が差し込む。静止カメラ、35mm レンズ、浅い被写界深度。」
パターン 4: プロダクト ヒーロー
電子商取引の主力製品。テキストからビデオへのプロンプト、または製品写真を添付した画像からビデオへのプロンプトとしても同様に機能します。
「磨かれたコンクリートの台座に置かれたマットブラックのワイヤレスイヤホンケースのスタジオ撮影。ケースはゆっくりと 90 度回転し、カメラは反対方向に回転します。左上からのソフトキーライト、背後からの微妙なリムライト、深い影の減衰。クリーンでミニマル、プレミアムな美学。」
パターン 5: B ロール テクスチャ
より長い編集を埋めるカットアウェイや雰囲気ショットに。
「小さな白いセラミックカップにゆっくりと満たされるエスプレッソのマクロショット。蒸気が上向きにカール。左側の窓から暖かい朝の光。被写界深度が浅く、わずかなフィルムグレイン、音楽なし。」
パターン 6: 様式化 / アニメーション化
フォトリアルを望まない場合。
「手描きの 2D アニメーション、スタジオ ジブリ スタイル。黄色いレインコートを着た若い女の子が、雨の村の通りの水たまりに飛び込みます。スローモーションで水しぶきが飛び散ります。柔らかい水彩の背景、落ち着いたパステル パレット、優しい手描きのテクスチャ。」
パターン7:ダイアログビート(オーディオ対応モデル)
Veo 3.1 およびネイティブ オーディオを実行するモデルの場合。
「2人の友人がダイナーのブースで向かい合って座っている。左側の友人は静かに『大丈夫だよ』と言う。もう1人はうなずくが何も話さない。柔らかな温かみのある頭上のライト。中型のツーショット、静止カメラ。ダイナーの周囲の騒音、低いおしゃべり、遠くでカトラリーがカチャカチャという音。」
パターンを選択し、空白を埋めて生成します。そこから繰り返します。
モデル固有のプロンプトのニュアンス
パターンは一般化します。しかし、各モデルには独自の個性があり、素晴らしい作品へと導くきっかけも異なります。 3 つすべてについて毎日の頻繁な使用から学んだことは次のとおりです。
Veo 3.1、映画撮影言語に報酬を与える
Veo 3.1 は、プロが撮影した多くの映像をもとにトレーニングされており、それが実証されています。映画用語で「アナモルフィック レンズ」、「ラック フォーカス」、「ドリー イン」、「3/4 のキー ライト」、「浅い被写界深度」などと書くと、Veo は驚くほど文字通りに翻訳してくれます。また、ネイティブ オーディオを適切に実行できる唯一の主流モデルでもあるため、ショットにサウンド デザイン (ダイアログ、アンビエント、SFX) がある場合は、Veo が最適です。プロンプトに形容詞を詰め込みすぎたいという衝動に抵抗し、Veo は雰囲気の壁よりも構造化された特定の方向性を好みます。 Veo 3.1 の詳細については、Veo 3.1 完全ガイド を参照してください。
Seedance 2.0、より長い連続テイクに報酬を与える
Seedance 2.0 は、muvi.video カタログで最も広い範囲である 4 ~ 15 秒の整数クリップの継続時間をサポートします。シーンで Veo 3.1 の 8 秒の上限に収まらない持続的なモーション アークが必要な場合は、Seedance が最適です。また、Veo の 16:9 / 9:16 のみに対して 6 つのアスペクト比 (1:1、9:16、16:9、4:3、3:4、21:9) をサポートしているため、垂直プラス、正方形、またはウルトラワイド フォーマットの場合、より多くの構図上のヘッドルームが得られます。解像度の上限は 720p (Start/End Frame バリアントでは 1440p) なので、ピクセル レベルの忠実度よりも継続時間とアスペクト比の柔軟性が重要なシーン用に Seedance を予約してください。 Omni-Reference バリアントは、最大 9 つのイメージ、3 つのビデオ、および 3 つのオーディオ リファレンスを受け入れ、一連のクリップにわたるキャラクターの連続性に役立ちます。
Kling 3.0、簡潔さと明瞭さを重視
Kling は高速なので、反復に最適です。ただし、プロンプトが長くなったり専門的になったりすると、Veo や Seedance よりもパフォーマンスが悪くなります。映画撮影の語彙を減らし、プロンプトを 50 語以内に抑え、シンプルな視覚的な説明に重点を置きます。 Kling は、人間の被写体、表情豊かな顔、ソーシャル フォーマットのクイック クリップに特に威力を発揮します。プロンプトで照明を説明するために 3 つのカンマが必要な場合は、Kling ではなく Veo 用に作成していることになります。 Text-to-Video、Image-to-Video、Kling O3 の 3 つのバリエーションが利用可能です。
近道: Kling でショットのプロトタイプを作成すると、安くて早いからです。フレーミングとモーションが適切になったら、ここで調整したプロンプトを使用して、Veo 3.1 で最終バージョンを再生成します。 2 つのモデルのワークフローにより、時間を節約できます。
プロンプト作成のよくある間違い (およびその修正方法)
これらは、機能しないプロンプトで何度も見られるパターンです。それぞれに不良バージョンとリライトが付属しています。
間違い 1: 曖昧な主題
悪い: 「通りを歩いている人」
修正: 「ベージュのロングトレンチコートを着た30代の女性が、ポケットに手を突っ込みながら、パリの狭い通りを歩いています。」
モデルにはレンダリングする面が必要です。 「人」は何も与えず、データセットの平均が示唆するものを何でも選択しますが、平均が興味深いものであることはほとんどありません。
間違い 2: シーンの地理がありません
悪い例: 「公園を走っている犬」
修正: 「ゴールデンレトリバーがフレームの左側から右側に向かって、秋の葉が点在する太陽がまだらに当たる広い芝生を横切って、背の高い木々を背景に走っています。」
モデルが被写体が空間のどこにあるかを認識していない場合、被写体は浮いてしまいます。カメラに、物体が互いに相対的にどこにあるかを認識させます。
間違い 3: 動作の方向がありません
悪い: 「車は走り去ります。」
修正: 「赤い車はカメラから遠ざかり、遠くに向かって加速し、道路はわずかに右にカーブしています。」
「追い出す」というのは曖昧です。カメラに向かって?それから離れて?横向き?モデルにベクトルを伝えます。
間違い 4: 形容詞を特定せずに積み重ねる
悪い点: 「美しく、映画のような、見事な、プロ仕様の日没のビデオ。」
修正: 「丘の中腹にある松の木の後ろに沈む夕日、空が金色から深いマゼンタに移り変わる、タイムラプス、4K の広い静的ショット。」
形容詞の積み重ねは情報を追加しません。モデルには「美しい」と「素晴らしい」の区別がつきません。彼らはクローズアップからワイドショットを区別することができます。
間違い 5: スタイルの手がかりが矛盾している
悪い: 「1950 年代のノワール ドキュメンタリー スタイルのフォトリアリスティックなアニメ。」
修正: 1 つ選択してください。フォトリアルなノワール。またはノワール風のアニメ。相容れない美学を混合しないでください。モデルがそれらを平均化してしまい、見た目が汚くなってしまいます。
間違い 6: プロンプトのアスペクト比を無視する
悪い: 「縦長の TikTok スタイルのショットですが、16:9 で生成され、トリミングされています。」
修正: 公開するアスペクト比で生成します。モデルは、指定されたキャンバスのショットを構成します。 16:9 のショットを 9:16 にトリミングすると、常に被写体が失われます。
間違い 7: 音声方向がありません (音声対応モデルの場合)
悪い: 「コーヒーショップのシーン。」 (Veo 3.1 上)
修正: 「コーヒーショップのシーン。周囲のおしゃべり、バックグラウンドでエスプレッソマシンのシューシューという音、低音で流れるソフトなジャズ。」
Veo 3.1 は、ユーザーが指示するかどうかに関係なく、オーディオを生成します。ご指定がない場合は、一般的なアンビエントベッドをお届けします。 2 秒かけて部屋の音がどんな感じかを伝えます。
反復ループ (適切なプロンプトが実際にどのように構築されるか)
最初の試行で優れたプロンプトを作成できる人はいません。一貫して優れた成果物を生み出すクリエイターは、才能があるわけではなく、規律を持って反復します。これが機能するループです。
ステップ 1: ベースライン プロンプトを作成する
セクション 3 のパターンのいずれかを使用します。まだ最適化しないでください。 6つの材料を揃えるだけ。
ステップ 2: 高速モデルで 1 回生成する
Kling 2.0 または別の高速モデルを使用してください。最終的なクリップを作成しようとしているのではなく、モデルがシーンをまったく理解したかどうかをテストしているのです。
ステップ 3: 書き換えずに診断する
出力を見て、モデルの何が間違っていたのかを尋ねてください。それが主題だったのか?カメラが動く?照明は?具体的にしてください。 「私が望んでいたものではありません」というのは診断ではありません。
ステップ 4: 一度に 1 つの変数を変更する
これは、ほとんどの人がスキップする分野です。カメラが間違っていた場合は、カメララインのみを変更します。点灯が間違っていた場合は点灯ラインのみを変更してください。プロンプト全体を書き直すと、どの変更によって問題が解決されたのかが分からなくなり、次のショットでも同じ間違いを繰り返すことになります。
ステップ 5: 足場を安定した状態に保つ
ドキュメント内で機能するプロンプトを、タイプ、製品ショット、対話シーン、風景、登場人物の瞬間ごとに整理して保存します。後で同様のショットが必要になった場合は、最初からではなく、既知の良好な足場から開始することになります。数週間後には、面倒な作業のほとんどを行ってくれるプロンプト ライブラリが完成します。
ステップ 6: 勝者を宣伝する
プロンプトが高速モデルで確実に良好な結果を生成したら、同じプロンプトを使用して最終バージョンを Veo 3.1 Standard で再生成します。映画の撮影法は変わりません。生産品質が跳ね上がります。
このループは遅く聞こえます。そうではありません。プロジェクトを 3 ~ 4 回繰り返すと、推測するよりも早くなり、足場が毎週改善されるため、品質が向上します。
形式固有のプロンプト テンプレート
異なる成果物、異なるプロンプト足場。これらをコピーし、括弧を変更します。
TikTok / リール (9:16、5-15 秒)
「[興味深い衣装を着た被写体] は [認識可能な都市または自然の環境] で [単一の明確なアクション] を実行します。電話スタイルの垂直フレーム、エネルギッシュな雰囲気、明るい日光、[トレンドのカラー パレット]。クイック モーション、スローモーションはありません。」
注: 垂直モデルは、フォーマットに明示的に名前を付けると、より適切に構成されます。アクションはシンプルにしてください。垂直方向のクリップにはマルチビート シーンを入れる余地がありません。
YouTube ヒーロー ショット (16:9、5 ~ 10 秒)
「[環境] における [被写体] の映画的なワイド ショット。カメラはゆっくりと [押し込む / ドリー バック / 軌道]。ゴールデン アワー ライト、アナモフィック レンズ、浅い被写界深度、4K。微妙なアンビエント サウンド デザイン。」
注: 16:9 は Veo 3.1 が輝く場所です。この形式は、オープニング、ヒーロー ショット、B ロールに使用します。
製品ヒーロー (1:1 または 16:9、5 ~ 8 秒)
「[表面]上の[製品]のスタジオショット。製品がゆっくり[回転/持ち上げ/点灯]。[方向]からのソフトキーライト、背後からのリムライト、深い影の減衰。プレミアム、最小限の美しさ、人物なし、きれいな背景。」
注: ブランドに忠実なショットについては、画像からビデオへの参照をここで参照してください。シンプルで忙しい環境の背景をロックすると、製品の注意が散漫になります。
会話シーン(16:9または4:3、5~10秒)
「[設定]の[キャラクターA]と[キャラクターB]の[ツーショットまたはクローズアップ]。キャラクターAは「[セリフ]」と言います。キャラクターBは[リアクション]。[照明]。静止カメラ、35mmレンズ。アンビエント[ルームトーン]。」
注: Veo 3.1 のみ。他のモデルは対話をひどく偽っています。行は短くし、長い行は同期がずれてしまいます。
B-Roll / テクスチャカットアウェイ (任意の比率、3 ~ 5 秒)
「[テクスチャーのあるオブジェクトまたはディテール] のマクロ / クローズアップ ショット。微妙な [動き: 蒸気、波紋、ちらつき、揺れ]。[日中の光]。被写界深度が浅い。音楽なし、アンビエントのみ。」
注: 短いクリップはより鮮明に見えます。 B ロール ショットを 5 秒を超えて伸ばさないでください。AI がモーションを発明し始めます。
実際のプロンプト、実際の出力
以下は、Veo 3.1、Seedance 2.0、および Kling 3.0 を使用して muvi.video でテストした 5 つのプロンプトです。出力の説明は定性的なもので、生成はモデルのバージョン、プロンプトのニュアンス、日付によって異なるため、これらは保証された結果ではなく、プロンプトが生成する出力の種類を示すものとして扱ってください。
例 1、映画のような風景 (Veo 3.1)
「日の出時のガラス質の高山湖の広範な航空写真、水面に低く漂う霧、水面に映る雪を頂いた山々。カメラはゆっくりと後退し、上に傾いて山脈を明らかにします。柔らかく冷たい青い光が暖かいピンク色に移ります。映画のような 4K、アナモルフィック、音楽なし、周囲風。」
結果の種類: きれいな映画のような風景ショット。通常、プルバックとチルトアップは Veo で適切に実行されます。ミストの動きが自然に見えます。
例 2、製品のローテーション (Kling 2.0、画像からビデオへ)
「ゆっくりと 360 度回転。スタジオ照明、磨かれたコンクリート表面、左上からソフトキー ライト、後ろから微妙なリム。カメラの動きなし、製品センター フレーム。」 (添付: 時計の製品写真)
結果の種類: 信頼できる電子商取引ヒーローのローテーション。 Kling は、プロンプトが短い場合でも、短い回転をきれいに処理します。
例 3、キャラクターモーメント (Veo 3.1)
「赤い長いコートを着た若い女性が、雪が激しく降る夜、雪に覆われた街の広場を歩いています。彼女は立ち止まり、見上げて、微笑みます。柔らかく暖かい街灯の輝き、冷たい青色の背景。中程度のトラッキングショットを横から撮影し、彼女が向きを変えてカメラを構えます。35mm レンズ、被写界深度は浅い。」
結果の種類: マルチビートの文字モーメント。 Veo 3.1 の 8 秒のクリップ シーリングは、「歩く、止まる、見上げる、微笑む」シーケンスに各ビートを着地させる余地を持たせてフィットしており、ネイティブのアンビエント オーディオ (軽い降雪、遠くの街のトーン) が別のスコア パスなしでビデオと一緒に印刷されます。
例 4、食べ物のクローズアップ (Veo 3.1)
「白い大理石の上に置かれた新鮮なイチゴの上に、溶けたダーク チョコレートがゆっくりと注がれているマクロ写真。暖かい頭上の光、わずかに立ち上る蒸気。被写界深度が浅く、チョコレートに光沢のある反射。微妙な注ぐ音、音楽なし。」
結果の種類: クリスプ フード ショット。注ぐ動きとチョコレートの反射面は、Veo 3.1 の物理エンジンが威力を発揮します。
例 5、様式化されたアニメーション (Kling 3.0)
「手描きの 2D アニメーション、水彩風。夕暮れの深い森の空き地に小さなキツネが慎重に足を踏み入れます。ホタルがその周りを漂っています。落ち着いたパレット、柔らかな輪郭、優しい手描きのテクスチャ、周囲の風、遠くの昆虫。」
結果の種類: 一貫した線画を持つ定型化されたクリップ。 Kling 3.0 は様式化された動きの美学を処理し、水彩の手描きのテクスチャがフォトリアル寄りのモデルよりも確実にここに表示されます。
再現性に関する注意事項: AI ビデオ モデルは頻繁に変更されるため、同じプロンプトを同じモデルで 6 か月間隔で実行すると、著しく異なる出力が生成される可能性があります。プロンプトを正確なレシピとしてではなく、足場として扱います。
AI ビデオ プロンプトに関するよくある質問
AI ビデオ プロンプトは、Midjourney プロンプトと同じ方法で作成する必要がありますか?+
いいえ、Midjourney プロンプトはカンマ区切りのタグ リストとして機能します (「女性、赤いコート、映画、4K、--ar 16:9」)。ビデオ モデルは、アクション、動き、時間を説明する完全な文を使用する方がはるかに優れています。静止画にタグを付ける方法ではなく、撮影監督にショットを説明する方法でビデオ プロンプトを作成します。
プロンプトを生成するたびに異なる結果が生成されるのはなぜですか?+
AI ビデオ モデルはランダム シードを使用するため、すべての世代がプロンプトを制約として持つ新たなサイコロの出目となります。まったく同じプロンプトを 2 回実行しても、異なる出力が生成されます。ほとんどのプラットフォームでは、再現性が必要な場合にシードをロックできます。これは、シード ノイズに邪魔されずにプロンプトの変更をテストしたい場合に便利です。
AI ビデオ プロンプトの長さはどれくらいであるべきですか?+
ほとんどのモデルでは 30 ~ 80 ワードが最適です。 30 歳未満の場合、監督が不足しているため、モデルは一般的なデフォルトでギャップを埋めます。 100 を超えると、すぐに疲労が発生し、モデルが要素 (通常は最後に作成した要素) を無視し始めます。 Kling 3.0 の場合は、30 ~ 50 単語に近づけてください。 Veo 3.1 と Seedance 2.0 の場合は、80 に向かって押し上げることができます。
プロンプトにカメラ言語を含めるべきですか?+
はい、特に Veo 3.1 ではそうです。 「ドリーイン」、「ラックフォーカス」、「ローアングル」、「35mm レンズ」、「アナモルフィック」、これらはすべて、モデルがレンダリングできる実際のカメラの動作に変換されます。 Kling は映画撮影の語彙にはあまり反応しないため、Kling では「カメラが被写体に向かってゆっくりと移動する」などのより単純な説明に留めてください。
否定的なプロンプトは AI ビデオ モデルで機能しますか?+
時々。 Veo 3.1 と Seedance 2.0 は、単純な否定 (「背景に人がいない」、「画面にテキストがない」、「音楽がない」) に応答します。これらは、「ぼやけていない」または「アーティファクトがない」などの抽象的な否定には確実に反応しません。これらは願望的なものであり、指示できるものではありません。否定語は控えめに使用し、名前を付けることができる特定のものに対して使用します。
異なるモデル間で同じプロンプトを再利用できますか?+
ほとんどの場合、そうです。セクション 3 のパターンはモデルに依存しません。ただし、モデルごとに調整し、Kling 3.0 では映画撮影のボキャブラリーを取り除き、Seedance 2.0 では持続時間とアスペクト比の柔軟性を重視し、Veo 3.1 では音声の方向と映画撮影の用語を追加すると、より良い結果が得られます。同じ足場、照明編集。
テキストからビデオへのプロンプトと画像からビデオへのプロンプトを組み合わせる「正しい」方法はありますか?+
画像からビデオへの変換の場合、プロンプトは必要なモーションを説明するだけでよく、視覚的なアイデンティティはすでに画像内にあります。画像からビデオへのプロンプトは短く (10 ~ 30 ワード)、変更または移動する必要があるものに焦点を当てます。画像からビデオへの長い説明プロンプトは、参照画像と競合し、曖昧な結果を生み出す可能性があります。
プロンプト ライブラリを構築するが、優れたプロンプトは 1 つではない
優れた AI ビデオ出力を確実に得るクリエイターは、魔法のプロンプトを作成しているわけではありません。彼らは同じ 6 つの材料、同じ少数のパターン、そして一度に 1 つの変数を変更するという規律を使用しています。それでおしまい。個人用のプロンプト ライブラリ、つまりショット タイプごとに整理された数十の足場を構築すると、最初から始める必要がなくなり、出力の品質が週ごとに向上します。
muvi.video を開き、モデルを選択し、上記のパターンのいずれかを使用してプロンプトを作成し、繰り返します。最初のものは完璧ではありません。 10本目は素晴らしいものになるだろう。 100 番目のものがあなたのライブラリに保存され、もう最初から書くことはありません。
CTA ボタン: > AI ビデオの作成を開始
最終更新日: 2026 年 5 月。モデルが変更され、生産作業から新しいパターンが学習されると、このガイドを更新します。
Related Guides
実際に機能する AI ビデオ プロンプトの書き方 (2026 年柱ガイド)
ほとんどの「AI プロンプト ガイド」は、おそらく 10 本のビデオを作成した人によって書かれています。具体的に言うように言われます。 「シネマティック 4K」を追加するように言われます。そして、3 回目の試行で被写体がクローネンバーグのスケッチに変身した瞬間に、あなたは立ち往生してしまいます。