Fellowi

AI動画プロンプトの書き方: 絵ではなく、動きを書く

著者: Fellowiチーム · · 7 分で読めます

暗いフレームを横切る藍色と紫の抽象的な弧がカメラの軌跡のように走り、中央にかすかなフィルムフレームの輪郭が見える画像。

下手な動画プロンプトの大半を直してくれる考え方がひとつあります。画像から動画を作るとき、画像はすでに仕事の半分を終えているということです。Fellowi Videoにアップロードしたものが、誰がフレームにいるか、何を着ているか、どこに立っているか、光がどう当たっているかを決めています。モデルはそれをすべて見ています。だからプロンプトが30語をかけてそれを繰り返すと、出発点を2回説明して、次の4秒についてはひとことも語っていないことになります。画像はを担い、プロンプトはどう動くかを担うのです。

画像プロンプトの書き方を読んだ方は、仕事の性質がどれほど違うかに注目してください。画像プロンプトはゼロからシーンを組み立てるので、細部は味方です。動画プロンプトは完成したシーンを受け取り、そこに時間を足します。シーンについての細部はもうノイズで、動きについての細部こそが信号です。

動画プロンプトが答えるべき5つのこと

毎回5つすべてを入れる必要はありません。ただ、良いプロンプトは少なくとも2つか3つに答えていて、弱いプロンプトはたいていどれにも答えていません。

1. カメラ: 動くのか、どう動くのか

固定、ゆっくり寄る、ゆっくり引く、左右へのやわらかなパン、手持ちのわずかな揺れ。どれかひとつを名指ししてください。ゆっくり動くカメラは、ほかに何も変わらなくても静止画を映像らしく見せる、いちばん簡単な方法です。

2. 被写体の動き: 人や物は何をするのか

振り向く顔、ひと呼吸、浮かんでくる笑み、風に持ち上がる髪、カップを包む指。小さく具体的なものが、大きく曖昧なものに勝ちます。「彼女が目を上げて微笑む」は伝わります。「彼女が自然に動く」ではモデルが推測するしかありません。

3. テンポ: どのくらいの速さで起きるのか

スローモーション、実時間、ゆったりした漂い、素早い一瞥。テンポが、4秒をひとつの瞬間に感じさせるか、細切れの編集に感じさせるかを決めます。迷ったら「ゆっくり」と書いてください。ゆっくりは意図に見え、速さは混乱に見えます。

4. 雰囲気と環境: 周りの世界で何が変わるのか

揺らぐ光、そよぐカーテン、降り始める雨、コーヒーから立つ湯気、日差しの中の埃。環境の要素がひとつあるだけでシーンに脈が生まれ、背景が貼り付けたように見えなくなります。

5. 音: 何が聞こえるべきか

Fellowi Videoはすべてのクリップに音声を生成し、それを操るのがプロンプトです。静かな雨、遠くの車の音、時計の音がする静かな部屋、葉を抜ける風、控えめな環境音楽。何も言わなければモデルが選びます。ひとつ言えば、たいてい聞いてくれます。

書き直し例

各組とも開始画像は同じ。変わるのはプロンプトだけです。

窓辺のポートレート

前: 「明るいアパートの窓辺に立つ、白いシャツを着た長い黒髪の美しい女性」

これは画像のキャプションです。モデルはすでにこの一語一語を知っていて、何が起きるかはどこにも書かれていません。

後: 「ゆっくり寄る。彼女は窓の方へ顔を向け、静かに息を吐く。髪の一筋がそよ風に持ち上がる。カーテンが揺れる。静かな部屋、外からかすかな街のざわめき」

カメラ、被写体の動き、環境、音がひと息に収まり、画像にあることは何ひとつ繰り返していません。

夕暮れの山の湖

前: 「山々と湖に沈む壮大で映画的な夕日、ドラマチックな光、4K、超写実的」

品質を表す形容詞は動きに何も与えませんし、「4K」は720pのクリップに求められるものではありません。

後: 「固定カメラ。水面にゆっくり波紋が広がり、雲が右へ流れ、峰に残る最後の光が少し弱まる。水面を渡る風、遠くの鳥が一羽」

写真タブで生成した写真

前: 「動かして。リアルに。彼女が部屋を横切り、スマホを取り、ソファに座り、笑ってカメラに手を振る」

4秒に4つの動作。モデルは全部を試みて、どれもやり終えません。

後: 「手持ちのわずかな揺れ。彼女がカメラをちらりと見て、ゆっくり笑顔になる。やわらかい室内の光が揺らぐ。別の部屋からくぐもった音楽」

始まりと終わりのあるひとつの動作で、クリップに余裕をもって収まります。ソファまで歩く姿も欲しいなら、それは文を長くすることではなく、別の開始画像で作る2本目のクリップです。AI写真を動かす記事で、そうやって連続した場面を組む手順を紹介しています。

クリップを台無しにする3つの間違い

画像をもう一度説明する

いちばん多く、いちばん仕方のない間違いです。画像プロンプトの練習が、まさにこれをするように体を慣らしてしまうからです。試してみてください。画像を隠してプロンプトを読む。それが静止画のキャプションとして通用するなら、まだ動画プロンプトは書けていません。モデルがすでに見ている言葉をすべて削り、その分を動きに使いましょう。

4秒に対して動作が多すぎる

振り向くのに約1秒。笑うのにもう1秒。一歩か二歩で残りが尽きます。それがクリップ全体です。はっきりした動き2つを超えた分は、ぼやけた塊に圧縮されるか、黙って捨てられます。その瞬間の核になる仕草をひとつ選び、残りはカメラと環境に任せてください。

画像と矛盾する

座っている人に走れと言わない。夜なのに明るい日差しを求めない。背を向けている人の目のクローズアップを頼まない。モデルは開始フレームを尊重しなければならないので、それに逆らうプロンプトは歪みや溶けたような変形、あるいはアップロードした顔とは別人に見える顔を生みます。画像にあるものと一緒に働いてください。求める動きは、まさにこのフレームから自然につながりうるものであるべきです。

出発点になる小さなテンプレート

当てはまるものを埋め、残りは消してください。

  • カメラ: 固定 / ゆっくり寄る / ゆっくり引く / やわらかなパン / 手持ちの揺れ
  • 被写体: 始まりと終わりのある仕草ひとつ
  • テンポ: ゆっくり / 実時間
  • 環境: 背景で動くものひとつ
  • 音: 環境音の手がかりを1つか2つ

文にすると:「ゆっくり引く。彼は本を下ろし、窓の外の雨を見る。ランプの光が揺らぐ。ガラスを打つ雨、落ち着くページの音」。これで完成した動画プロンプトです。

よくある質問

動画プロンプトはどのくらいの長さがいいですか?

短い文で1つから3つ。40語を超えているなら、たぶん画像を説明しているか動作を積み上げています。動き、テンポ、音だけが残るまで削ってください。

人物の見た目は書くべきですか?

それが動きの一部であるときだけです(「彼女の髪が持ち上がる」「彼のマフラーがはためく」)。外見は画像で固定されているので、言い直しても何も変わらず、役に立つ言葉の場所を奪うだけです。

レンダリングが失敗したら?

失敗したレンダリングに課金されることはありません。コインは返金され、Directorプランの枠は戻ります。たいていの直し方は単純化です。動作を減らし、テンポを落とし、開始画像に逆らう指示をなくす。同じ画像でもう一度試してください。

アダルトな内容を頼めますか?

Fellowiは18歳以上向けのプラットフォームで、大人同士のアダルトコンテンツは許可されています。未成年や同意のないものに関わるものは一切拒否されます。上のプロンプトの原則はまったく同じように当てはまります。動きを書き、1つか2つの拍に絞り、フレームと矛盾させないこと。

どこで試せますか?

ヘッダーの魔法の杖アイコンからスタジオを開くか、直接fellowi.com/videoへ。開始画像を選び、プロンプトを貼り付けて、よく選ばれた20の言葉が何をするか見てみてください。

実際に試してみる

あたたかく私的なAIコンパニオン。7日間無料、メッセージ30通、カード不要。

料金と上限

続けて読む