今すぐ登録で30%割引!無制限のAI動画生成を解放。割引を受ける
より優れたAI画像編集・生成プロダクト PicEnhancer を開発中。ほとんどの機能が無料です。今すぐ試す

AI動画で同じキャラクターを保つ方法:複数クリップで一貫性を出すコツ

Long Cheng
キャラクターシート、参照画像、シード値、ショット設計を組み合わせて、複数のAI動画クリップで同じ顔・衣装・声を保つ方法を解説します。
AI動画で同じキャラクターを保つ方法:複数クリップで一貫性を出すコツ
how-to
characters
prompts
veo4

最初のクリップは完璧でした。探偵はグレーのトレンチコートを着て、黒髪は短く、片方の眉の上に傷があります。ところが2本目を生成すると、コートは茶色に、髪は長くなり、傷は消えている。5本目を作るころには、同じ職業なだけの別人が5人並んでいる、ということになりがちです。

生成は毎回ゼロから始まります。モデルは前のクリップを覚えていないので、あなたが固定しなかった部分はすべて新しく作り直されます。解決策は、できるだけ多くを固定することです。テキストで、画像で、そしてモデルが対応していればシード値で。このガイドでは、それぞれの方法を使うべき順番に紹介します。


クリップごとにキャラクターが変わってしまう理由

AI動画モデルはプロンプトを読み、書かれていない部分をすべて自分の推測で埋めます。「ジャケットを着た若い女性」には、年齢、顔の形、髪型、ジャケットの色やデザイン、肌に当たる光など、数十もの空白があります。生成するたびに、その空白は違う形で埋められます。

つまり、一貫性の大部分は空白を減らすことにかかっています。モデルに任せる選択肢が少ないほど、キャラクターが変わる余地も小さくなります。そのための道具は3つです。

  1. 言葉:一字一句そのまま使い回す固定のテキスト説明。
  2. 画像:キャラクターの見た目をモデルに正確に示す参照フレーム。
  3. シード値:モデルのランダムな出発点を再現する数値(対応しているモデルのみ)。

使えるところでは、3つすべてを使いましょう。


ステップ1:キャラクターシートを書く

何かを生成する前に、短いキャラクターシートを書きます。これはキャラクターを固定的かつ具体的な言葉で説明したテキストのまとまりで、すべてのプロンプトに手を加えずに貼り付けて使います。

良いキャラクターシートは、次の4つの項目をカバーしています。

顔と体型

年齢層、顔の形、肌の色、瞳の色、髪の色、髪の長さ、髪型、体格、そして1〜2個の特徴的な目印。傷、そばかすの入り方、丸い銀縁メガネなどがあると、モデルは繰り返すべき具体的なディテールを得られますし、あなたもキャラクターのズレにすぐ気づけます。

衣装

アイテムごとに名前、色、素材を書きます。「マスタードイエローのウールのニット帽、真鍮ボタンのついたネイビーのキャンバス地ワークジャケット、白いTシャツ」は、「カジュアルな服」よりはるかに安定します。

声と振る舞い

音声付きのクリップを生成するなら、声の高さ、話す速さ、アクセント、雰囲気を記述します。「落ち着いた低い声で、少しかすれていて、ゆっくり話す」と書けば、すべてのクリップが同じ目標を目指します。編集の段階で声を後から入れる場合は、この部分を動画プロンプトから外してください。

スタイル

キャラクターが生きる世界のビジュアル:実写風、3Dアニメーション、アニメ調、フィルムグレイン、カラーグレーディングなど。スタイルが違えば、同じキャラクターでも別人に見えてしまいます。

キャラクターシートの例

MAYA: a woman in her early thirties with an oval face, warm brown skin, dark brown eyes, and shoulder-length black curly hair tied back with a red scrunchie. Small gold hoop earrings. Thin silver scar across her left eyebrow. She wears a mustard-yellow wool beanie, a navy canvas work jacket with brass buttons, and a plain white t-shirt. Calm, low voice with a slight rasp; she speaks slowly and smiles with one side of her mouth. Realistic cinematic style, soft natural light, gentle film grain.

(訳:30代前半の女性マヤ。卵形の顔、温かみのある褐色の肌、こげ茶色の瞳、赤いシュシュでまとめた肩までの黒い巻き髪。小さな金のフープピアスと、左眉を横切る細い傷。マスタードイエローのニット帽、ネイビーのワークジャケット、白いTシャツ。少しかすれた低く落ち着いた声。リアルな映画風スタイル。)

シートは例のように短い1段落にまとめましょう。薄すぎるシートは空白を残し、長すぎるシートは重要なディテールをシーンの説明の中に埋もれさせてしまいます。


ステップ2:まったく同じフレーズを使い回す

シートを書いたあとで最も多い失敗は、言い換えてしまうことです。1本目では「mustard-yellow beanie」と書き、2本目では「yellow knit hat」と書く。あなたにとっては同じものでも、モデルにとっては結果の異なる2つの別々のプロンプトです。

使い回しのルール:

  • シートはコピー&ペーストする。 記憶を頼りに打ち直さないこと。
  • 順番を変えない。 すべてのプロンプトの冒頭にキャラクターシートを置き、そのあとにシーンと動作を追加します。
  • 変えるのはシーンだけ。 場所、動作、カメラの動きはクリップごとに変わりますが、キャラクターのテキストは変えません。

シートを使い回したプロンプトの例

MAYA: a woman in her early thirties with an oval face, warm brown skin, dark brown eyes, and shoulder-length black curly hair tied back with a red scrunchie. Small gold hoop earrings. Thin silver scar across her left eyebrow. She wears a mustard-yellow wool beanie, a navy canvas work jacket with brass buttons, and a plain white t-shirt. Realistic cinematic style, soft natural light, gentle film grain.
Scene: Maya stands at a food truck window on a rainy evening and hands a paper cup of coffee to a customer. Medium shot, slow push in. She says, "Careful, it's hot." Rain on the metal roof, quiet street ambience.

(訳:雨の夜、キッチンカーの窓口でマヤが客に紙コップのコーヒーを手渡す。ミディアムショットでゆっくり寄る。「熱いから気をつけて」と言う。)

MAYA: (same sheet, pasted word for word)
Scene: Early morning. Maya unlocks the side door of the food truck and steps inside, switching on a string of warm lights. Wide shot from across the street, camera static. No dialogue. Birds and distant traffic.

(訳:早朝、マヤがキッチンカーの横のドアを開けて中に入り、温かい色のストリングライトをつける。通りの向かいからのワイドショット、カメラは固定。セリフなし。)

実際のプロンプトでは、「same sheet」の部分にシート全文を貼り付けてください。上の書き方は、この記事のスペースを節約するための仮の表記です。


ステップ3:参照画像で見た目を固定する

参照画像はテキストよりも強力なアンカーになります。モデルが顔を想像するのではなく、実際に見ることができるからです。

手順は次のとおりです。

  1. キャラクターのメイン画像を1枚作る。 画像生成ツールで作るか、使用権のある写真を使います。顔と衣装がしっかり見える、正面向きで光が均一な、はっきりしたフレームを選びましょう。
  2. 各クリップのイメージ・トゥ・ビデオで最初のフレームとして使う。 veo4.dev では、Veo 4 のオプションの参照画像がクリップの最初のフレームになります。Kling 3.0、Seedance 2.0、Wan 2.6 はオプションで最初のフレームを受け付け、Wan AI 2.2 は必ずあなたが用意した画像から始まります。
  3. それでもキャラクターシートはプロンプトに残す。 画像は最初のフレームを固定します。テキストは、クリップがそのフレームから動いていく間もキャラクターを安定させます。

最初のフレームと最後のフレーム

最初のフレームと最後のフレームの両方を受け付けるモデルもあります。veo4.dev では、Veo 3.1 と MiniMax H3 に両方の入力欄があります。モデルはあなたが選んだフレームに着地しなければならないので、これは一貫性を保つうえでとても役立ちます。両方のフレームに同じキャラクターが写っていれば、クリップのアンカーは1つではなく2つになります。

実用的なテクニックとして、気に入ったクリップの最後のフレームを保存し、次のクリップの最初のフレームに使う方法があります。こうすると、キャラクターがショットからショットへそのまま引き継がれます。

正面、斜め45度、全身の3種類くらいの小さな参照画像ライブラリを用意しておきましょう。新しいショットごとに最も近いものを選び、顔が切れないよう、画像のアスペクト比をクリップと揃えます。

イメージ・トゥ・ビデオのその他のオプションは、画像から動画を生成するページをご覧ください。


ステップ4:対応モデルではシード値を使う

シード値とは、モデルがランダムな出発点として使う数値です。同じプロンプト、同じ設定、同じシード値を使えば、シード値に対応したモデルはとてもよく似た結果を返します。

veo4.dev では、Happy Horse 1.0 と Wan AI 2.2 でシード値がモデルに渡されます。入力欄は詳細設定の中にあります。

一貫性のためのシード値の使い方:

  1. ランダムなシード値でいくつかのバージョンを生成する。
  2. キャラクターがイメージどおりに見えるものを見つけ、そのシード値をメモする。
  3. 次のクリップでもそのシード値を使い回し、プロンプトのシーン部分だけを変える。

シード値が最も効くのは、同じキャラクターと場所で動作やアングルだけを変えるような小さな変化のときです。シーンのテキストを大きく変えると、同じシード値でも結果は大きく変わります。それ以外のモデルでは、キャラクターシートと参照画像に頼りましょう。


ステップ5:小さな違いが目立たないショットを設計する

ここまでの方法をすべて使っても、小さなズレは起こり得ます。良いショット設計をすれば、そのズレにはずっと気づかれにくくなります。

  • ショットサイズを変える。 ワイドショットからクローズアップへのカットでは、視聴者はフレームが変わることを予期しているので、衣装の小さな変化が目立ちません。
  • 光の条件を揃える。 温かい夕焼けの光の中のキャラクターと、冷たいオフィスの光の中のキャラクターは、顔が同じでも別人に見えます。
  • 1クリップにつき動作は1つ。 動作が複雑になるほど動きが増え、動きが増えるほどクリップの途中で顔が変わる可能性が高まります。
  • ディテールショットを使う。 カップを持つ手や後ろ姿のショットなら、顔を繰り返し映さずにストーリーを伝えられます。
  • 生成の前に順番を決める。 ショット番号、ショットサイズ、動作、セリフ、そのショットを固定する画像を書いた短いショットリストを作り、その順番どおりに生成します。

ショットリストの例

ショットサイズ動作アンカー
1ワイド夜明けにマヤがキッチンカーの鍵を開けるメイン画像を最初のフレームに
2ミディアムカウンターの奥でマヤがコーヒーを淹れるショット1の最後のフレーム
3クローズアップマヤが微笑んでセリフを言う正面の参照画像
4ディテール手が客にカップを渡すテキストのシートのみ

一貫性チェックリスト

シリーズの各クリップを生成する前に、このリストを確認しましょう。

  • キャラクターシートが一字一句そのまま、プロンプトの冒頭に貼り付けられている。
  • 衣装のアイテムに色と素材が明記されている。
  • キャラクターに特徴的な目印が少なくとも1つある。
  • ビジュアルスタイルと光が、これまでのクリップと一致している。
  • モデルが対応している場合、参照画像または前のクリップの最後のフレームが添付されている。
  • モデル、アスペクト比、解像度がシリーズの他のクリップと揃っている。
  • シード値に対応したモデルでは、同じシード値を使い回している。
  • 各クリップに明確な動作が1つだけある。

よくある質問

すべてのクリップで完全に同一のキャラクターを作れますか?

毎回とはいきません。生成にはある程度のランダム性があるからです。ただし、固定のシートと参照画像を使えば、ばらつきは大きく抑えられます。必要な数より多めにテイクを生成し、合っているものを残すつもりで計画しましょう。

参照画像とテキストの説明、どちらが良いですか?

顔と衣装については、参照画像のほうが強力なアンカーになります。最も良い結果が出るのは両方を使う場合です。画像が見た目を固定し、テキストがクリップの動きの中でもそれを安定させます。

声を同じに保つにはどうすればいいですか?

すべてのプロンプトで、声の高さ、話す速さ、アクセント、雰囲気を同じように記述します。セリフは短くしましょう。参照画像が顔を固定するように声を固定する手段はないため、声が合っているテイクを選び、それ以外は作り直します。長いシリーズなら、声を録音するか編集で後から入れると、完全にコントロールできます。

1つのシーンに2人以上のキャラクターがいる場合は?

キャラクターごとに名前をはっきりつけた別々のシートを書き、それぞれに異なる特徴と色を持たせます。できればフレームの中で離して配置しましょう。よく似た2人のキャラクターは、混ざり合ってしまいがちです。


キャラクターシリーズを始めよう

キャラクターシートを書き、強いメイン画像を1枚作り、最初のショットを生成しましょう。今すぐ AI動画ジェネレーター で試すことも、画像ガイド付きのクリップなら Veo 4 に直接進むこともできます。シリーズを広げる準備ができたら、料金ページでプランをご確認ください。

さらにクリップを計画していますか?各ショットを演出するには カメラワーク・プロンプトガイド を、クリップがズレてしまったときの対処法は AI動画がおかしく見える理由 をお読みください。

AI動画で同じキャラクターを保つ方法:複数クリップで一貫性を出すコツ | Veo 4