テキスト動画生成AI
概念はあるが元画像がない場合はここから開始します。シーンを書き、クリエイティブ目標に合ったモデルを選び、生成する前に期間、形式、音声を設定します。
元画像は不要 · ショットレベルのプロンプト構造 · 設定はモデルによって異なる
プロンプトは4段階の意図的な手順で作成する
有用なプロンプトは、1つのクリップに対する簡潔な指示のように読めるべきです。最初のテストは診断しやすくする
作業内容を定義する
クリップが伝えるべき内容と、広告フック、製品ビート、ストーリーモーメントなどどこで使用されるかを述べる
シーンをブロックする
主題、アクション、場所、時間帯、アイデアに関係する視覚的な詳細を記述する
カメラと音を指示する
1つのカメラの動き、ならびに選択したモデルがサポートするセリフ、アンビエンス、効果音の意図を加える
1つの要素を修正する
結果がうまくいかない場合、次のパスに影響した要素を特定できるようにブリーフの1つの部分を変更する
テキストが適切な出発点であるかを見極める
このワークフローを選ぶとき
テキストを先に使うと有効な場合
概念はあるが元画像がない場合はここから開始します。シーンを書き、クリエイティブ目標に合ったモデルを選び、生成する前に期間、形式、音声を設定します。
持ってくる
シーン、メッセージ、またはオープニングフック
説明する
被写体、アクション、設定、カメラ、音声
まず確認する
アクションとフレーミングが明確に伝わるかどうか
キャンペーンのフック探索
1つのクリエイティブ方向に決定する前に、開始のアクションやメッセージを比較する
絵コンテの動きに関するメモ
予定されたビートが、元の写真撮影や詳細な設計フレームを制作する前にどのように動くかをテストする。
オリジナルのシーンコンセプト
既存のビジュアルに依存しない製品、社会的、物語的、または映画的なアイデアをスケッチする。
テキストからビデオへのワークフローに関する質問
テキスト優先のビデオ計画
最初のプロンプトには何を含めるべきか?
一つの被写体、一つの明確なアクション、設定、カメラの指示、意図したムードや音から始める。縦型のソーシャルフックやワイドスクリーンの製品公開など、フレーミングが変わる場合は意図した使用法も含める。まずそのコンパクト版を生成し、メインのアクションと構図が明確になった後で二次的な詳細を追加する。
長いプロンプトの方がより良いビデオになるか?
プロンプトの長さよりも階層構造のほうが重要です。焦点を絞った簡潔なプロンプトは、指示のすべてに目的があり、注意を競う詳細が少ないため、レビューが容易です。主題と行動を最初に置き、次に設定とカメラを続け、最後に雰囲気や音を記述します。もし二つの指示が矛盾する場合は、形容詞を追加するのではなく、シーンを簡潔にしてください。
いつ画像から再スタートすべきですか?
参照となる主題、レイアウト、製品、キャラクター、または承認されたアートディレクションが、自由なビジュアル探索より重要な場合に、画像から動画への移行を行います。ソースフレームは生成に具体的なビジュアルの基準を与えます。構図がまだ交渉可能で、モデルにルックだけでなく動きも提案させたい場合は、テキストを使い続けてください。
ひとつの明確なショットのためにテキストから動画へのプロンプトはどう書けばよいですか?
プロダクション順でプロンプトを書きます:被写体を特定し、見える行動を述べ、特定の環境に置き、次に主要なカメラの動きを一つ説明します。照明、ペース、音は、その行動をサポートする場合のみ追加します。役立つ例はスタイルのリストより具体的で、フレームに何が入るか、何が変化するか、カメラがどこで止まるかを示します。
AI動画ブリーフで効果的なカメラ指示とは何ですか?
視聴者が認識できる支配的なカメラのアイデアを一つ選びます。例えば、ゆっくりとしたプッシュイン、横方向のトラッキングショット、固定されたワイドフレーム、またはコントロールされたハンドヘルドフォローなどです。被写体の位置とその動きの理由を追加します。短いクリップでいくつかの無関係な動きを組み合わせると、結果の評価が難しくなるため、複雑なカバレッジは別のショットとしてテストします。
どのように台詞、雰囲気、または効果音を計画すべきですか?
音を単なる雰囲気の言葉としてではなく、タイムラインの一部として記述してください。誰が話すか、台詞が始まるタイミング、どの環境音が場所を示すか、効果音が目に見える行動とともに配置されるかを明記します。音声が最初のテストで中心でない場合は、まずシーンとカメラを確認し、その後で制御されたフォローアップで音声指示を導入してください。
どのようにして一貫性のあるプロンプトのバリエーションを作ることができますか?
主題、設定、期間、アスペクト比、および核心となる動作は変更せずに保持します。1つの要素の決定(オープニングフック、カメラの距離、照明の扱い、またはエンディングのビートなど)を変え、それぞれのバージョンをノートにラベル付けします。これにより、プロンプトテストを有用な比較に変え、チームがなぜある生成された動画の方向性が別のものよりも強いのかを説明するのに役立ちます。
別のバージョンを生成する前に何を確認すべきですか?
まず、意図された動作が初見でも理解できるかどうかを確認します。次に、主題の連続性、空間の論理、カメラの動き、ペーシング、音声のタイミング、およびフレーム内に見えるテキストを確認します。結果を元のブリーフと比較し、最も影響の大きい不一致を選び、次の生成で修正する可能性が最も高い指示だけを変更します。
テキスト生成ビデオにはどのアスペクト比を選ぶべきですか?
ショットを書く前に配信チャンネルを選びましょう。縦型フレームは通常、被写体を画面中央付近に近づけて明確な動作を示す必要がありますが、ワイドスクリーン形式はより広い環境や横方向の動きをサポートできます。スクエアや縦長レイアウトはシンプルな演出が適しています。ジェネレーターで利用可能な比率を確認した後、そのフレーム用にプロンプトを作成し、後からクロップするのではなく最初から構成しましょう。
完成したビデオや役立つプロンプトのバージョンはどこで見つけられますか?
タスクの進行状況を追跡し、完了した結果を再確認するために、マイ作品を開きます。各有用なバージョンの横に、プロンプト、モデル、設定、および変更した単一の変数について短いメモを残してください。その軽量な記録は、強力な方向性を再現したり、後のテストを比較したり、編集やレビュー用に選択したバージョンをダウンロードする際に便利です。
