AI Prompting ガイド· Effective AI Prompts
AI Prompting · 全4回中の第1回 読了8分

効果的なAIプロンプト:構成・設定・改善の型

効果的なAIプロンプトとは、画像・動画モデルに「何を作るか」「どんな見た目にするか」「どの設定を重視するか」を迷わず伝える指示のことです。このガイドでは、何度でも使えるプロンプトの組み立て方、クリエイティブな文章と技術設定の切り分け、主要エンジンごとの得意傾向、思うような結果が出ないときの直し方まで解説します。

効くAIプロンプトは何が違うのか

効果的なAIプロンプトは、モデルに「何を見せるか」「どう見せるか」「どの設定で生成するか」を明確に伝えます。

優れたプロンプトは、長ければよいわけではありません。欲しい出力に対して、必要な情報が整理され、具体的で、余計がないことが重要です。画像なら、被写体、場所、構図、光、色、スタイル、制約。動画ならそこに、動き、タイミング、カメラワーク、テンポを加えます。

プロンプトは魔法の呪文ではなく、クリエイティブブリーフです。モデルがよい判断をできるだけの情報は必要ですが、指示が多すぎたり互いに矛盾したりすると、特に動画では仕上がりが散らかりやすくなります。

  • 最初に主役となる被写体を書く。
  • 被写体が置かれる状況をはっきりさせる。
  • フレーミング、光、色、スタイルを指定する。
  • 動画では動きとタイミングを加える。
  • ツールが対応している場合、技術的な条件は設定項目で指定する。

画像にも動画にも使えるプロンプトの型

プロンプトの型があると、毎回同じ順序で指示を組み立てられます。多くの画像・動画生成システムは、形容詞を並べただけの文章より、整理された指示に反応しやすいからです。

まずは同じ構成で下書きを作り、使うエンジンに合わせて削ったり足したりします。Midjourneyは、短く的確な言葉とパラメータの組み合わせが効きやすい傾向があります。OpenAI GPT Image、Google Imagen、Runway、Firefly、Luma、Pika、Veoは、自然な文章で明確に伝えると扱いやすいエンジンです。Stable DiffusionやWanでは、設定、seed、guidance、ワークフローツールを使って、より細かく制御できます。

画像から動画を作る場合は、画像に写っている内容をすべて書き直す必要はありません。参照画像がすでに被写体、構図、スタイル、光を固定しているため、テキストでは時間の中で何を変化させるかに集中します。

項目指定する内容画像の例動画の例
被写体主役となる人物、物、場所、アイデアステンレス製のウォーターボトル赤いウィンドブレーカーを着たランナー
状況どこに存在するか夜明けの濡れた黒い玄武岩の上日の出の霧がかかった橋の上
構図フレーミングと視点低い位置からの斜め3/4の商品写真目線の高さのミディアムトラッキングショット
光源、コントラスト、雰囲気柔らかな朝の光、冷たいリムライト霧越しの暖かな逆光
色とスタイル配色、媒体、ビジュアルの方向性落ち着いたグラファイトとシルバー、広告写真映画的なドキュメンタリー調、自然な色味
動き時間の中で何が変わるか静止画では不要4歩進み、立ち止まり、上を見上げる
カメラモーション視点がどう動くか通常は不要ゆっくり寄る、固定ショット、または穏やかなパン
制約変えてはいけないものラベルの文字を正確に保つクリップ全体で被写体を中央に保つ
設定文章外で指定する制御項目アスペクト比、サイズ、seed、quality長さ、FPS、解像度、アスペクト比、seed

曖昧な形容詞より、結果に効く具体性

具体的なプロンプトには、はっきり見える名詞、視覚的なディテール、制作現場で使う言葉が含まれています。一方で曖昧なプロンプトは、「美しい」「かっこいい」「いい感じ」「シネマティック」といった言葉に頼り、実際に何を見せたいのかが伝わりません。

好みを表す広い言葉は、画として指定できる要素に置き換えます。たとえば「いい感じのオフィス」ではなく、「朝日が入る角部屋のオフィス、オーク材の棚、リネン張りの椅子、柔らかな影、右側に見出しコピー用の余白」と書きます。これなら、物、レイアウト、光、用途までモデルに伝わります。

判断基準は、その情報が結果を変えるかどうかです。素材、ポーズ、カメラアングル、時間帯、配色、質感、動きの節目、編集上の制約など、画面に影響する情報を足します。フレームに影響しない情報や、互いにぶつかる条件は削ります。

  • 弱い例:「かっこいい商品写真。」
  • 改善例:「マットブラックのスピーカーをコンクリート台座の上に置いた、低いアングルのスタジオ写真。冷たいリムライト、柔らかな影、上部に余白。」
  • 弱い例:「ドラマチックな動画にして。」
  • 改善例:「小麦畑の上を嵐雲が流れていくワイドショット。固定カメラ、最後の1秒で稲妻、暗いブルーグレーのカラーグレーディング。」

表現の指示と技術設定は分ける

アスペクト比、解像度、seed、steps、guidance、FPS、durationなどは設定項目です。多くの場合、プロンプト本文の外で指定したほうが安定します。

この切り分けが重要なのは、プラットフォームによっては、別の設定欄で管理されている数値を文章内に書いても無視されることがあるためです。OpenAIの画像ツールは、sizeやstyleなどの設定を使います。Midjourneyは、アスペクト比、stylization、seed、versionといったパラメータをプロンプト末尾に付けます。Pikaには、duration、resolution、aspect ratio、seed、negative promptなどの項目があります。Veo、Runway、Fireflyも、duration、FPS、aspect ratio、resolutionを生成設定として案内しています。

検証するときは、可能ならseedを固定します。そのうえで、プロンプトの一部または設定を一つだけ変えて再生成します。どの変更が改善につながったのかが見えやすくなります。

設定制御するもの重要な理由
アスペクト比1:1、16:9、9:16、4:5などのフレーム形状Web、SNS、サムネイル、広告、動画フォーマットに合わせられる
解像度またはサイズ出力の細部とピクセル寸法高い値ほど細部や文字に有利だが、コストや生成時間が増える場合がある
seedランダム生成の開始点再現性のあるテストや、制御したバリエーション作成に役立つ
steps一部の拡散モデルが結果を磨き込む長さ増やすと細部が改善することがある一方、レンダリング時間も伸びる
guidanceまたはCFGプロンプトへの従いやすさ高いほど指示に寄りやすいが、自然なゆらぎが減ることもある
durationとFPSクリップの長さとフレームレート動画のタイミングは、エンジンが対応する設定に合わせる必要がある
参照画像人物やスタイル、レイアウト、最初のフレームの視覚的な基準対応プラットフォームでは一貫性を高められる

画像プロンプトと動画プロンプトの違い

画像プロンプトは1枚のフレームを描写します。動画プロンプトは、その1枚に加えて、時間の中で何が変わるかを描写します。

静止画では、画面に何が写るかに集中します。被写体、場所、構図、光、色、スタイル、文字、編集上の制約が中心です。つまり、ほとんどはビジュアル仕様書です。

動画では、ショットの流れを加えます。被写体の動き、カメラアングル、カメラの動き、テンポ、最後にどう終わるかを書きます。5秒程度のクリップなら、主な動きは一つ、主なカメラワークも一つに絞るのがうまくいきやすいです。

音声やセリフに対応しているプラットフォームでは、それらを別に分けて明確に書きます。Synthesiaのようなビジネス向けアバターツールでは、映画的なカメラショットより、テーマ、視聴者、目的、トーン、構成を指定するほうが有効です。

  • 画像の目的:「この1枚をどんな見た目にするか?」
  • 動画の目的:「最初に何が起き、次にどう動き、最後にどう終わるか?」
  • 画像→動画の目的:「この既存フレームにどんな動きを加えるか?」
  • アバター動画の目的:「誰に向けて、何を伝え、視聴者に何を理解してもらうか?」

どのAIエンジンを選ぶべきか

エンジンは、ワークフローで選びます。ホスト型の品質、セルフホストの制御性、クリエイター向け管理ツールの速さ、またはオールインワンの制作環境です。

OpenAI GPT Image、Google Imagen、Veo、Adobe Firefly、Midjourney、Synthesiaのようなクローズドなホスト型ツールは、高品質で手軽に使いたい場合に向いています。利用ごと、またはサブスクリプションで料金を支払い、各提供元の規約に従います。基盤モデルそのものは制御できません。

Stable DiffusionやWanのようなオープンウェイト系は、最も高い自由度があります。実行、調整、自動化、ファインチューニングまで可能ですが、環境構築、GPU、アップデート、保守も自分で担います。

Runway、Pika、Lumaのような管理型のクリエイター向け動画ツールは、シンプルな操作で素早く制作するために作られています。Seedance、Seedream、Klingは強力なクローズドシステムですが、地域やプラットフォームによって利用条件が変わることがあります。API連携やセルフホストなしで品質を出したいなら、Vynzoが現実的です。/studioから始めるか、/toolsでエンジン別のワークフローを探せます。

エンジンの使い方向いている用途トレードオフ
クローズドなホスト型API・アプリOpenAI GPT Image、Google Imagen、Veo、Adobe Firefly、Midjourney、Synthesia高品質、手軽なアクセス、本番制作向きのワークフローアクセス権を借り、規約に従い、プランまたは使用量に応じて支払う
オープンウェイト・セルフホスト可能Stable Diffusion、Wan最大限のカスタマイズ、自動化、ファインチューニング、プライベートな制作パイプラインハードウェア、セットアップ、バージョン、保守を自分で管理する
管理型のクリエイター向け動画ツールRunway、Pika、Luma短尺動画、画像→動画、スタイル検証、SNSクリップを素早く制作セルフホストよりモデルレベルの制御は少ない
地域依存のクローズドなクリエイターモデルSeedance、Seedream、Kling高品質な画像・動画、マルチモーダル入力、映画的な制御地域や提供元によって利用可否やワークフローが変わる
オールインワンのクリエイタースタジオVynzoプロンプトから画像・動画まで、すっきりした制作画面で完結インストール、GPU、ツールの切り替えなしで有力エンジンを使いたい場合に最適

一度に変えるのは一つだけ

プロンプト作りは検証です。まず基準となる出力を作り、結果を確認し、一つだけ変更して、もう一度生成します。

この習慣は動画で特に重要です。被写体、カメラワーク、光、長さ、seedを一度に変えると、何が良くなり、何が悪くなったのか分からなくなります。短いクリップの中に動き、場所、カメラワークを詰め込みすぎると、動画モデルは内容がぶれやすくなります。

確認には簡単な採点軸を使います。内容の一致、構図、動き、光、破綻、ブランドとの相性、権利面です。うまくいったら、プロンプト、seed、参照素材、設定、エンジンのバージョンを保存しておきます。

  • 1. 上の型に沿って、基準となるプロンプトを書く。
  • 2. アスペクト比、解像度、duration、seedなどの技術設定を決める。
  • 3. ツールが対応していれば、2〜4案を生成する。
  • 4. もっとも近い結果を選び、主な課題を一つに絞る。
  • 5. プロンプトの一文、または設定を一つだけ変える。
  • 6. 出力がブリーフに合うまで繰り返し、完成したレシピを固定する。

ネガティブプロンプトはいつでも効くのか

ネガティブプロンプトは一部のエンジンでは有効ですが、万能ではありません。多くのツールでは、望む結果を肯定形で指定するほうが安定します。

Stable Diffusion系のワークフローやStability APIでは、ネガティブプロンプトや重み付きプロンプトに対応していることがよくあります。Midjourneyは独自のパラメータ形式で除外指定ができます。Pikaにはネガティブプロンプト欄があります。一方で、肯定的な書き方を推奨するツールもあり、Wanのワークフローでは速度のためにCFGを1にすることがあるため、従来型のネガティブプロンプトが効きにくくなる場合があります。

エンジンがネガティブプロンプト向きに作られているなら使いましょう。そうでなければ、「清潔な白背景」「被写体は1人だけ、中央配置」「シャープなピント」「元のレイアウトを保持」のように、望む結果を直接書きます。編集では、何を変えてはいけないのかを具体的に指定します。

よくある失敗考えられる原因直し方
出力がありきたりに見える被写体、状況、スタイルの手がかりが足りない被写体の具体的な特徴、場所、構図、光、媒体を加える
画像編集で変わりすぎる固定したい領域が明確に書かれていない「背景だけを差し替える」「顔、ポーズ、レイアウト、文字は保持」と書く
画像内の文字が間違う正確に入れたい文言として指定されていない必要な文言を引用符で囲み、配置とフォントの雰囲気を指定する
動画が散らかった印象になる1クリップに動きやカメラワークを詰め込みすぎている被写体の主な動き一つ、カメラワーク一つに絞る
動画ごとに人物や物の同一性がぶれる描写、参照素材、光の条件がショットごとに変わっている対応している場合は、同じ表現と参照素材を使い回す
ネガティブプロンプトがほとんど効かないエンジンが十分に対応していない、またはguidanceが低い肯定形で書く、編集ツールを使う、対応ワークフローならguidanceを上げる
結果を再現しにくいseed、設定、モデルバージョンが変わっているプロンプト、seed、アスペクト比、解像度、duration、エンジンバージョンを記録する

権利、ポリシー、利用枠を守る

プロンプトが上手くても、制作責任がなくなるわけではありません。画像、動画、音声、ロゴ、書類をアップロードする場合は、必ず使用権限のある素材だけを使い、識別可能な人物や声の参照を使う前には同意を得てください。

ホスト型エンジンには、それぞれ独自の規約、コンテンツルール、料金、利用枠があります。また、プラットフォーム契約上の出力物の権利は、各国の法律上の著作権保護と同じではありません。著作権の扱いは、人間の創作関与や管轄地域によって変わる場合があります。

AI支援で作ったメディアを公開する際は、開示や来歴管理も計画しておきましょう。主要プロバイダーでは、コンテンツ認証やウォーターマークの仕組みが広がっています。制作チームは、プロンプト、元素材、編集内容、最終承認の記録を残しておくべきです。

  • 商用利用の前に提供元の規約を確認する。
  • 一般向けワークフローに機密情報や規制対象データを入れない。
  • 元ファイル、プロンプト、設定をプロジェクトに残す。
  • 人物、声、肖像の参照は同意に基づいて使う。
  • 公開前にブランドとの相性を確認する。

よくある質問

効果的なAIプロンプトの基本構成は?

被写体、状況、構図、光、色、スタイル、制約、設定を入れます。動画ではさらに、動き、カメラモーション、タイミング、長さを加えます。

AIプロンプトはどのくらいの長さがよいですか?

具体性を保てるだけの長さで、焦点がぼやけない短さが理想です。強いプロンプトは、明確な1〜4文と設定項目で十分なことが多いです。

ネガティブプロンプトは使うべきですか?

エンジンがしっかり対応している場合にだけ使いましょう。それ以外では、欲しい結果を肯定形の制約として書くほうが安定します。

動画プロンプトがごちゃつくのはなぜですか?

多くの場合、動きやカメラワークを入れすぎています。短いクリップでは、主な動き一つ、主なカメラワーク一つに絞るのが有効です。

良い結果を出すにはモデルをセルフホストする必要がありますか?

必要ありません。ホスト型や管理型のツールでも、セットアップなしで高品質な結果を作れます。Vynzoなら、/studioで画像・動画向けの有力エンジンを利用できます。

さらに学ぶ

プロンプトから成果物へ。あとは作るだけ。

ここで学んだテクニックをVynzoで実践。画像も動画も作れるオールインワンAIスタジオです。

無料ではじめる