2026年9月29日公開。モデルの価格は同日時点の提供元の定価で、MakeInfluencer.aiのクレジット計算に使っているのと同じ価格表から取っています。プラットフォームでは、実行のたびに正確なクレジット消費量が事前に表示されます。
AI動画の失敗は、たいてい同じところで起こります。長いプロンプトを書き、レンダリングを待ち、届いたクリップは顔がずれ、構図が違い、途中で光が変わっている。そこでやり直すと、そのたびに動画用のクレジットを消費します。これが最も高くつくクレジットです。
映画制作者たちは、生成モデルが存在するずっと前に、この問題を解決していました。ストーリーボードを描くのです。カメラを回す前に合意しておく、ショットごとに1枚の静止画です。同じ規律はAI動画にも通用し、しかもいまは、2つのモデルがそれぞれの役割で際立って優秀なため、以前よりうまくいきます。OpenAIのGPT Image 2.5は、精密でキャラクターの一貫した絵コンテのフレームを、1枚あたり数セントで描きます。ByteDanceのSeedance 2.5は、完成したフレームを、同期したネイティブ音声つきのクリップに動かし、フレームで確立した内容を保ちます。
このガイドは、その詳細版です。モデルが従えるショットリストの書き方、複数のフレームにわたって1人のキャラクターを安定させる方法、出力を実際に変えるカメラ用語、ショットの種類ごとのプロンプトのパターン、企画から完成した4本のクリップまでをすべてのプロンプトつきで示す完全な実例、行ごとの費用内訳、安いドラフトのワークフロー、ほかのAIストーリーボードジェネレーターとの率直な比較を取り上げます。最後に、ワンクリック版として、AI CanvasのStoryboard to Filmテンプレートを紹介します。
AIストーリーボードジェネレーターは何をするのか
AIストーリーボードジェネレーターは、台本や短い企画書を、ショットごとに1枚の静止画のシーケンスに変え、制作する前に動画を確認して承認できるようにするものです。従来のツールは、そこまででした。クライアントとの打ち合わせ用に、スケッチやストックイラスト風の絵を描くだけです。新しい世代の、ストーリーボードから動画を作るツールは、制作の工程を加えます。承認された各フレームが、動画クリップの開始フレームになるので、ボードは映像の計画ではなく、映像の前半になります。
この違いが重要なのは、画像モデルと動画モデルの失敗のしかたが違うからです。画像モデルは、構図、衣装、顔、光が得意で、やり直しも安く済みます。動画モデルは、動きと音が得意ですが、構図まで創作させると、能力を推測に使い、小さな推測が5秒や10秒の間に積み重なります。ストーリーボードは、問題を分けます。画像モデルはショットがどう見えるかを決め、動画モデルはどう動くかだけを決めるのです。
なぜ先にストーリーボードなのか
AIストーリーボードは、ムードボードではなく制作指示書です。各フレームは2つの問いに答えます。何を固定するのか(キャラクター、衣装、セット、光)、そして何が動くのか(1つの動作、1つのカメラワーク)です。フレームが承認されれば、動画モデルが創作する余地はほとんど残りません。
実際には、3つの効果があります。
- 動画のクレジットを使う前に、見た目を固められる。 キャラクター参照つきのGPT Image 2.5 Flareのフレームは、1K・中品質で、定価$0.039です。720pのSeedance 2.5 Turboの5秒クリップは$1.00です。フレームのほうが約25倍安いため、そこで試行錯誤しましょう。
- 同じ参照が、すべてのショットに入力される。 キャラクターの参照画像がすべてのフレームに入るため、ショットごとにずれるのではなく、シーケンス全体で顔が保たれます。
- シーケンス全体ではなく、1つのフレームか1つのクリップだけを生成し直せる。 3番目のショットが違っていたら、3番目のショットだけをやり直します。
2つのモデルと、相性のよい理由
GPT Image 2.5 Flare(フレーム)
OpenAIの2026年9月の画像モデル。GPT Image 2より鮮明で、遅延は約半分。構図と指示への追従に強く、最大16枚の参照画像を受け付けるため、キャラクターの一貫性を保てます。当社のテストでは、フレーム1枚あたり約27秒でした。
Seedance 2.5(クリップ)
ByteDanceの主力動画モデルで、2026年7月31日にリリース。開始フレームを、同期した音声つきの4〜30秒のクリップに動かし、フレームの被写体、衣装、照明を保ち、オプションで終了フレームも指定できます。ドラフトにはTurboティア、最終版には標準ティア。
GPT Image 2.5は、MakeInfluencer.aiでは2つのタイプで提供されています。テンプレートが使う生成モデルがFlareです。Sunburstは、顔、商品、レイアウトを保ったまま行う精密な編集向けにチューニングされており、承認したフレームの1点だけ(ジャケットの色を変える、キャラクターを左に動かすなど)を、ほかを描き直さずに変えたいときに適したツールです。
Seedance 2.5にも2つのティアがあります。Seedance 2.5 Turboは、720pまたは1080pで、1秒あたり$0.20または$0.22です。標準のSeedance 2.5は、480pから4Kに対応し、720pで1秒あたり$0.36です。どちらも同じプロンプトと同じ開始フレームを受け付けるため、ショットをドラフトから最終版に移すのは、書き直しではなくモデルの切り替えです。
どちらの役割も入れ替えられます。GoogleのNano Banana Proは、精密な構図より、多数のフレームで同一の顔を保つことが重要なときに強いフレームモデルですが、1フレーム$0.14かかります。AlibabaのWan 3.0は、720pで動かす最も安い方法で、1秒あたり$0.10です。テンプレートの初期設定がGPT Image 2.5 FlareとSeedance 2.5 Turboなのは、本稿執筆時点で、この組み合わせが1ドルあたりのフレームの精度と、1ドルあたりの動きの両方で最良だからです。
Sora 2について
OpenAIは2026年9月24日に、Sora 2 Videos APIを終了しました。Sora 2でフレームを動かす古いストーリーボードのチュートリアルは、どのAPIでももう動きません。いまストーリーボードのフレームを動かす現実的な選択肢は、Seedance 2.5、Wan 3.0、Kling 3.0、Veo 3.1 Fastです。
ショットリストの作り方:多くのAIストーリーボードが飛ばす部分
どのモデルを動かすより前に、ショットリストが必要です。順番に並べたショットの一覧と、それぞれが何を見せ、なぜ存在するのかです。期待外れのAIショートの多くは、モデルの失敗ではありません。その順番である理由のない、きれいな画像が4枚あるだけなのです。
4つのビートの構成
テンプレートは、ショート動画広告と映画学校の課題から借りた、4つのビートの構成を使っています。1回の作業で作れるほど小さく、物語として感じられるほど完結しています。
| ショット | 役割 | 構図 | 視聴者が知ること |
|---|---|---|---|
| 1. 状況説明 | 世界を見せる | ワイド、深い被写界深度、キャラクターは小さめから中くらい | 場所、時間帯、雰囲気 |
| 2. アクション | 主な出来事を見せる | ミディアム、腰から上、1つのはっきりした身体的な動き | キャラクターが何を望み、何をするか |
| 3. クローズアップ | 感情を見せる | 顔と手、浅い被写界深度 | 出来事に対して、キャラクターがどう感じているか |
| 4. 結末 | 物語を閉じる | より引いた、または固定の構図、少し間を置く | キャラクターの行き着いた先。雰囲気が変わったこと |
ワイドからミディアム、クローズアップ、そしてまた引いていく流れは、飾りではありません。編集者が、1世紀にわたって観客の位置関係を見失わせずにきた方法です。ワイドのショットは、視聴者に居場所を伝えます。寄っていくと、何が重要かを伝えます。最後に引くと、結末を味わう余白を与えます。このパターンを崩すなら、意図的に崩してください。手のクローズアップから始まり、ショット2でやっと部屋を見せる物語は成立しますが、企画書がそれを求めている場合に限ります。
1ショットにつき1つの動作
5秒のクリップに入る動作は、1つです。「彼女は振り向き、ドアまで歩き、ドアを開けて、振り返る」は4つの動作で、せわしないぼやけた映像になるか、途中で止まったクリップになります。「彼女は肩でドアを押し開ける」は、動画モデルが5秒できれいに動かせる、1つの動作です。物語にもっと必要なら、ショットを増やすか、その1つのショットの尺を長くします。
役立つテストがあります。そのショットを、動きを表す動詞が1つだけの一文で、友人に説明してみてください。「そして」が必要なら、分割しましょう。
書き出しておくべき連続性のルール
連続性は、人間のストーリーボード作家が意識せずにやり、モデルがまったくやらないことです。企画書に一度書いておけば、ショットライターが、すべてのショットに引き継ぎます。
- 衣装。 見えるすべての衣服と色を書きます。「黄色いレインジャケット、黒のカーゴパンツ、胸の前で斜めに掛けたグレーの配達バッグ」。
- 時間と天候。 「夜、小雨、濡れた地面」。ショット1で雨が降っていて、ショット3で乾いていると、シーケンスが崩れます。
- 光源。 「ネオンサインが主な光」。光の色を一定に保てます。
- 画面上の方向。 ショット2でキャラクターが左から右へ動くなら、振り返っていない限り、ショット4で右から現れてはいけません。方向が重要なら、「彼女は映像全体を通して左から右へ動く」と書きます。
- 小道具。 ショット2の荷物は、ショット4でも同じ荷物でなければなりません。
企画書に入れないもの
セリフは入れません。フレームには載せられず、動画モデルが、どんな音声とも合わない口の動きを付けたくなってしまうからです。画面上の文字やブランド名も入れません。生成フレームの文字は信頼できず、ロゴは権利の問題を生みます。企画書自体には、カメラの専門用語も入れません。レンズと光はショットライターがショットごとに加えるもので、「anamorphic 35mm」と書いた企画書は、すべてのショットを同じ構図に寄せてしまいます。
フレームをまたいだキャラクターの一貫性
ストーリーボードのワークフローを使う最大の理由が一貫性なので、独立した節を設けます。3つの層があり、3つすべてが必要です。
第1層:清潔な参照画像を1枚
すべてのフレームに、キャラクターの同じ参照画像を使います。参照は、光がよく、正面か斜め45度の、顔が隠れていないポートレートで、表情は無表情に近く、できれば映像で着せたい衣装のものが理想です。白いシャツを着た参照写真は、黄色いジャケットを求める企画書と衝突します。モデルはどちらを信じるかを決める必要があり、毎回同じ判断をするとは限りません。
MakeInfluencer.aiにすでにAIインフルエンサーがいるなら、キャラクターノードがその参照画像を直接取り込みます。いなければ、清潔なポートレートを1枚アップロードしてください。多くのシーンで通用する参照の作り方は、一貫したAIキャラクターガイドで、参照画像と学習済みモデルのトレードオフは、キャラクター一貫性ガイドで解説しています。
第2層:プロンプト内のアイデンティティのロック
参照だけでは足りません。プロンプトで、画像モデルに、その参照をどう扱うかを伝える必要があります。テンプレートのフレームプロンプトは、2文目でこう述べています。「The person in the reference image is the lead character: keep face, hair, skin tone and build identical to the reference.」この指示は、参照をショットの描写より上位に置くもので、ショットライターがキャラクターを大まかに描写してしまったときに、望ましい働きをします。
第3層:クリップにとっては、フレームが参照になる
Seedance 2.5がフレームを動かすとき、フレームが開始画像になります。モデルは、まさにそのピクセルから始めるため、フレームが持つアイデンティティは、クリップの最初のフレームにもあります。クリップでのずれは、動きから生じます。フレームに映っていなかった横顔が現れる首の回転や、細部を作り出すクローズアップです。クリップのプロンプトは、これに対して「keep the character, wardrobe, set and lighting exactly as in the frame」を加え、カメラワークを3つではなく1つにするよう求めます。
動かす前に、顔を確認する
4枚のフレームを並べて、顔だけを見てください。1枚の顔がおかしければ、そのクリップを実行する前に、そのフレームを生成し直します。$0.039のフレームで顔を直すほうが、$1.00のクリップで気づくより、常に安く済みます。
まだうまくいかないこと
完璧ではありません。最もよく見る失敗は次のとおりです。
- 横顔のショット。 正面の参照からは、キャラクターの横顔がどう見えるか、モデルには分かりません。ショットに横顔が必要なら、横から撮った2枚目の参照画像を加えてください。
- 非常に小さい顔。 状況説明のワイドでは、顔の高さが40ピクセルほどになることがあります。照合の手がかりが少なく、ずれやすくなります。ワイドでは、視聴者はシルエットと衣装で読み取るので、たいていは許容範囲です。
- 手と小道具。 物を持つ手は、画像モデルにも動画モデルにも、依然として弱点です。手の動作は、持つ、置く、押すといった単純なものにとどめてください。指の精密な操作が必要なものは避けましょう。
出力を変えるカメラ用語
どちらのモデルも、標準的な映画用語を理解しますが、すべての用語が効くわけではありません。以下は、得られる結果を確実に変える用語です。
構図の用語(フレームモデル向け)
| 用語 | GPT Image 2.5の反応 | 使いどころ |
|---|---|---|
| Extreme wide / establishing wide | キャラクターは小さく、環境が主役 | ショット1 |
| Full shot | 頭からつま先までがフレームに入る | 衣装と姿勢を見せる |
| Medium shot / waist-up | 胴体と手、顔が読み取れる | ショット2、ほとんどのアクション |
| Medium close-up | 胸から上 | 文脈を残した反応 |
| Close-up | 顔がフレームの大部分を占める | ショット3 |
| Over-the-shoulder | 手前に肩、その奥に被写体 | 2人のキャラクターのシーン |
| Low angle | カメラが目線より下、被写体が力強く見える | 決意の瞬間 |
| High angle | カメラが上から、被写体が小さく見える | 孤立、敗北 |
レンズの焦点距離は、遠近感を表す便利な略記です。「24mm」は、環境が多く入る、やや歪んだ広い画になります。「35mm」は、物語を語る自然な基本です。「50mm」は、人間の視覚に近い画です。「85mm」は、背景を圧縮して、顔を際立たせます。モデルは光学を厳密にシミュレートするわけではありませんが、これらの数字は、期待する方向に構図を動かします。
動きの用語(動画モデル向け)
| 用語 | Seedance 2.5の反応 | 向いている用途 |
|---|---|---|
| Slow push-in | カメラが被写体に近づく | 緊張感の演出、強調 |
| Pull-out / dolly back | カメラが遠ざかる | 結末、明かし |
| Tracking shot / follow | カメラが被写体と一緒に動く | 歩く、走る |
| Pan left or right | カメラが軸を中心に回転する | 空間を見せる |
| Tilt up or down | カメラが縦に回転する | 高さを見せる |
| Handheld | 小さな自然な揺れ | 切迫感、ドキュメンタリーの雰囲気 |
| Locked-off / static | カメラは動かない | 動作にショットを託す |
| Orbit | カメラが被写体の周りを回る | ヒーローの瞬間、控えめに使う |
最も役立つルールは、1ショットにつきカメラワークは1つです。「Slow push-in while panning left and tilting up」は、モデルに3つの動きを同時に解かせることになり、たいていどれか1つがうまくいきません。複雑なカメラワークが必要なショットは、おそらく2つのショットにすべきです。
2つ目のルールは、カメラワークをショットの役割に合わせることです。状況説明のショットには、ゆっくりしたパンかゆっくりしたプッシュインが向き、視聴者が空間を読み取る時間を与えます。アクションのショットには、追従かハンドヘルドが向きます。クローズアップには、何もしないか、非常にゆっくりしたプッシュインが合います。結末のショットには、プルアウトか、その瞬間に余白を持たせる固定のフレームが合います。
ショットの種類ごとのプロンプトのパターン
テンプレートは、各プロンプトを2つの部分から組み立てます。ショットの説明(ディレクターLLMがショットごとに新しく書く)と、固定のスペック(4ショットすべてで同一)です。キャンバスでは、ショットの説明が先で、空行をはさんでスペックが続きます。以下に、各部分に含めるべき内容を、再利用できるパターンとして示します。プロンプトは英語のまま使います。
フレームのスペック(すべてのフレームで固定)
テンプレートが、すべてのフレームに付け加える文言そのものです。
Photoreal cinematic storyboard frame in 16:9. The person in the reference image is the lead character: keep face, hair, skin tone and build identical to the reference. Anamorphic feel on a 35mm lens, motivated natural light, fine film grain, muted graded palette. Compose the frame so it can be animated into a five-second shot. Avoid: on-screen text, captions, logos, watermarks, split screens, extra people, distorted hands.
見た目以上に効いているフレーズが2つあります。「Compose the frame so it can be animated」は、モデルを、固まった、ポーズを取りすぎた構図から遠ざけ、動きの余地のあるフレームへ向かわせます。除外リストの「split screens」は、「storyboard」という言葉がプロンプトにあるときに、GPT Image 2.5がときどき、複数のコマが1枚に収まったストーリーボードを返してしまう現実の失敗を防ぎます。
クリップのスペック(すべてのクリップで固定)
Animate this storyboard frame as the shot described above. Keep the character, wardrobe, set and lighting exactly as in the frame. One clear camera move, natural believable motion, ambient sound design that matches the scene, no music, no on-screen text.
「No music」は意図的です。4つのクリップに、それぞれ別の生成音楽が付いていると、カットしてつなぐことができません。環境音(雨、車の音、足音、ルームトーン)ならきれいにつながり、完成したシーケンス全体に、どの編集ソフトでも1本の音楽を載せられます。
ショットの説明のパターン
各ショットの説明は、同じ3文の形にします。何が見え、キャラクターがどこにいるか。キャラクターが何をするか。構図、レンズ、光、雰囲気。以下のパターンは、出発点として使いやすいものです。
状況説明のワイド。 "Wide shot of [place] at [time], [weather]. [Character] is [small or medium] in frame, [one quiet action that sets the tone]. 24mm lens, deep focus, [light source] as the main light, [mood] atmosphere."
ミディアムのアクション。 "Medium shot, waist-up, of [character] [single physical action] in [part of the location]. [One detail that shows intent or stakes]. 35mm lens, [light source] from [direction], [energy word] mood."
感情のクローズアップ。 "Close-up of [character]'s face and hands as [the reaction or realization]. [One expression change]. 85mm lens, shallow depth of field, [motivated light], [mood]."
結末。 "[Wider or static framing] of [character] [final position or action] in [location]. [How the environment or light has changed since shot one]. [Lens], [light], the mood has shifted to [new mood]."
テンプレートが使うディレクターのシステムプロンプトは、LLMに、この種の2〜3文の説明だけを、見出し、リスト、コメントなしで出力し、文字、キャプション、ロゴを求めないよう指示します。どのショットライターノードでも編集できます。
完全な実例:企画から、4枚のフレーム、4本のクリップまで
すべてのプロンプトつきの、1回の実行の全体像です。テンプレートの初期設定を使っています。フレームはGPT Image 2.5 Flareで16:9、1K、中品質、クリップはSeedance 2.5 Turboで720p、5秒、音声オンです。
企画書
あなたが書くテキストは、これだけです。
Story: Mara, a 30-year-old courier, races the last delivery of the night through a rain-soaked market street and finds the shop already closed, then leaves the parcel on the step with a handwritten note tucked under the string. Setting: night market street, neon signage, light rain, wet cobblestones. Wardrobe: yellow rain jacket, black cargo trousers, grey courier bag across the chest. Tone: melancholic. Do not change the character's look between shots.
うまくいく理由は、キャラクター1人、場所1つ、結末のある1つの流れ、一度だけ書いた衣装、一度だけ書いたトーンだからです。場所が3つあったり、主役が2人いたりする企画書は、ボードがずれます。各フレームは独立に生成され、それらをつなぐのは、テキストと参照だけだからです。
4つのショットの説明
4つのショットライターノードは、それぞれ、企画書と、担当するビートの指示を受け取ります。典型的な出力は次のとおりです(LLMは温度0.8で動くため、実際の文言は異なります)。
ショット1、状況説明。 "Wide shot of a narrow night market street glistening with rain, shuttered stalls and pink and teal neon signs reflecting in the wet cobblestones. Mara, in her yellow rain jacket with the grey courier bag across her chest, is small in the middle distance, jogging toward camera between the stalls. 24mm lens, deep focus, neon as the main light, cold melancholic atmosphere."
ショット2、アクション。 "Medium shot, waist-up, of Mara stopping short in front of a small shop with its metal shutter pulled down, one hand still gripping the brown paper parcel. Rain beads on her yellow hood and her breath shows in the cold air. 35mm lens, teal neon from the left, tense and deflated mood."
ショット3、クローズアップ。 "Close-up of Mara's face and hands as she tucks a folded handwritten note under the string of the parcel, eyes lowered. A small, tired half-smile. 85mm lens, shallow depth of field, warm spill from a nearby lantern against the cold neon, quiet and tender."
ショット4、結末。 "Static wide shot from across the street: the parcel sits alone on the shop's step under a small awning while Mara walks away to the right, her yellow jacket the only warm color in the frame. The rain has eased to a drizzle. 35mm lens, neon and lantern light, the mood has shifted from urgency to quiet acceptance."
LLMが、企画書から改めて指示されなくても引き継いだものに注目してください。黄色いジャケット、グレーのバッグ、ネオン、雨です。企画書で、これらを一度だけ、はっきり書く理由がここにあります。
4枚のフレーム
各フレームノードは、ショットの説明、空行の後に付くフレームのスペック、そしてキャラクターの参照画像を受け取ります。フレーム2に実際に送られる完全なプロンプトは、次のとおりです。
Medium shot, waist-up, of Mara stopping short in front of a small shop with its metal shutter pulled down, one hand still gripping the brown paper parcel. Rain beads on her yellow hood and her breath shows in the cold air. 35mm lens, teal neon from the left, tense and deflated mood.
Photoreal cinematic storyboard frame in 16:9. The person in the reference image is the lead character: keep face, hair, skin tone and build identical to the reference. Anamorphic feel on a 35mm lens, motivated natural light, fine film grain, muted graded palette. Compose the frame so it can be animated into a five-second shot. Avoid: on-screen text, captions, logos, watermarks, split screens, extra people, distorted hands.
クリップを実行する前に、4枚のフレームを、短いチェックリストで確認してください。
- 4枚とも、顔が同じ人物か。
- 色を含めて、衣装は同一か。
- 光源は一貫しているか(ここではネオンで、昼光ではない)。
- 各フレームに、動かす余地のある動作が、ちょうど1つあるか。
- 文字、ロゴ、余計な人物が紛れ込んでいないか。
典型的な実行では、4枚のうち1枚が、やり直しを必要とします。最も多い修正は状況説明のワイドで、キャラクターが小さく、市場の通りにモデルが余計な人物を足すことがあります。そのフレームのノードだけを再実行してください。ほかの3枚はそのままです。
4本のクリップ
各クリップノードは、フレームを開始フレームとして、ショットの説明とクリップのスペックをプロンプトとして受け取ります。クリップ2の完全なプロンプトは、次のとおりです。
Medium shot, waist-up, of Mara stopping short in front of a small shop with its metal shutter pulled down, one hand still gripping the brown paper parcel. Rain beads on her yellow hood and her breath shows in the cold air. 35mm lens, teal neon from the left, tense and deflated mood.
Animate this storyboard frame as the shot described above. Keep the character, wardrobe, set and lighting exactly as in the frame. One clear camera move, natural believable motion, ambient sound design that matches the scene, no music, no on-screen text.
「one clear camera move」より細かく動きを指定したい場合は、クリップノード自身のプロンプトに1行加えてください。このシーケンスの例は次のとおりです。
| クリップ | 追加する動きの指示 | 理由 |
|---|---|---|
| 1 | "Slow push-in as she jogs toward camera, footsteps splashing." | 視聴者を通りに引き込む |
| 2 | "Handheld, slight shake, she exhales and her shoulders drop." | 切迫感が失望へ崩れていく |
| 3 | "Locked-off, only her hands and eyes move." | 小さな仕草にショットを託す |
| 4 | "Slow pull-out while she walks out of frame to the right." | 最後に、荷物だけが残る |
上のクリップは、テンプレートのフレームの1つから作った、Seedance 2.5 Turboの画像から動画の、実際のレンダリング結果です。4本のクリップを順に並べると、20秒の映像になります。好きな編集ソフトでつなぎ、下に1本の音楽を敷けば、1人の一貫したキャラクター、1つの場所、完結した流れを持つショートフィルムができあがります。
出来の悪いクリップを直す
1本のクリップがおかしいときは、やり直す前に原因を切り分けてください。
- クリップの途中で顔がずれる。 たいていは首の回転が原因です。「she keeps her face toward camera」を加えるか、新しい角度を見せないカメラワークを選びます。
- 起こることが多すぎる。 ショットの説明に動作が2つあります。1つに絞りましょう。
- 何も起こらない。 フレームがポーズを取りすぎています。もっと開けた構図でフレームを生成し直すか、クリップに、明確な動作の指示を加えます。
- 音が違う。 音を名指しします。「rain on the awning, distant traffic, no voices.」
- 動作に対してクリップが短すぎる。 そのノードの長さを8秒か10秒に上げます。Seedance 2.5は4〜30秒に対応します。
費用を、行ごとに見る
以下の数字はすべて、2026年9月29日に確認した、MakeInfluencer.aiの価格マニフェストの提供元定価です。クレジットの列は、プラットフォームの現在の換算を使っており、Canvasの実行ボタンには、開始前に正確な合計が表示されます。
| 工程 | モデルと設定 | 数 | 各回の定価 | 各回のおおよそのクレジット |
|---|---|---|---|---|
| ショット執筆 | ディレクターLLM | 4 | 1セント未満 | 1,000 |
| フレーム | GPT Image 2.5 Flare、1K中品質、キャラクター参照つき | 4 | $0.039 | 1,955 |
| クリップ | Seedance 2.5 Turbo、720p、5秒、音声オン | 4 | $1.00 | 50,126 |
| 1回の実行の合計 | 約$4.16 | 約212,000 |
キャラクター参照つきのフレームには、参照画像が入力になるため、GPT Image 2.5の通常のテキストから画像の価格($0.024)ではなく、編集の価格(1K中品質で$0.039)が適用されます。最初の1枚を超える参照画像1枚ごとに、$0.015が加わります。
請求額の96%は、クリップです。先にボードを承認する理由は、この一点に尽きます。
アップグレードとダウングレードの選択肢
| 変更 | 新しいクリップのコスト(5秒) | 4クリップの合計 | 見合うとき |
|---|---|---|---|
| 初期設定:Seedance 2.5 Turbo 720p | $1.00 | $4.00 | ドラフト、SNS向けのカット |
| Seedance 2.5 Turbo 1080p | $1.10 | $4.40 | ほとんどのプラットフォーム向けの最終カット |
| 標準のSeedance 2.5 720p | $1.80 | $7.20 | 複雑な動きのあるメインカット |
| 標準のSeedance 2.5 1080p | $4.50 | $18.00 | クライアントへの納品物 |
| Wan 3.0 720p | $0.50 | $2.00 | 予算重視の実行、単純な動き |
| Kling 3.0 Pro サウンドあり | $0.84 | $3.36 | Klingの動きの雰囲気を好むとき |
| Gemini Omni 1.1 Flash 360p | $0.15 | $0.60 | 動きのテストのみ |
賢い混合の構成は、ショット1、3、4をTurboの720p、アクションのショットだけを標準のSeedance 2.5の720pにすることです。クリップの費用は$4.80で、追加の支出は、動きが最も難しい場所に向かいます。
フレーム側では、品質を1Kのhighに上げると、参照つきで1フレーム$0.105で、クリップに比べれば、それでも微々たるものです。フレームからポスター用の静止画を取り出す予定があるときに使ってください。
ドラフトのワークフロー:確定する前に、動きを安く試す
Seedance 2.5 Turboはすでに低価格のティアですが、何度も試行錯誤する予定のボードには、さらに安い最初の工程があります。GoogleのGemini Omni 1.1 Flashは、360pの3〜10秒のクリップを1秒あたり$0.03でレンダリングするため、5秒の動きのテストは$0.15、約7,500クレジットです。開始フレームに対応し、音声は常にオンです。
このワークフローは、一部のプラットフォームが「ドラフトモード」の機能として売っているものですが、3つの工程にすぎません。
フレームの工程
企画書、ショットライター、フレームだけを実行します。4枚のフレームをすべて承認します。費用:定価で約$0.16。
360pでの動きの工程
各クリップノードを、Gemini Omni 1.1 Flashの360p、5秒に設定します。悪い角度を見せてしまうカメラワーク、合わない動作、タイミングに注目します。動きの指示を調整します。費用:4クリップで$0.60。
最終工程
クリップノードを、720pか1080pのSeedance 2.5 Turboに戻し、メインカットだけは標準のSeedance 2.5にして実行します。費用:組み合わせによって$4.00〜$7.20。
注意点は、正直に述べておきます。別のモデルによる360pのドラフトが教えてくれるのは、構図、テンポ、カメラワークについてであり、Seedance 2.5が動きを正確にどうレンダリングするかではありません。その価値は、モデルに依存しないミスを見つけることにあります。5秒ではなく8秒が必要な動作や、キャラクターの頭を切ってしまうプッシュインなどです。すでに実行したことのあるボードでは、動きの工程を飛ばして、そのままTurboに進んでください。
所要時間:秒ではなく、分で見込む
GPT Image 2.5 Flareのフレームは、2026年9月のテストで、1枚あたり約27秒でした。Seedance 2.5は、スペック表から想像するより遅いです。実際のテストでは、720pの4秒のTurboの画像から動画のクリップが、ローンチ週に、送信から完成ファイルまで約9分かかり、その大半は、提供元側のキューの待ち時間のようでした。1回の実行に10〜20分かかると見込み、その間はほかの作業をしてください。タブを閉じても構いません。Canvasは動き続け、結果はノードに反映されます。
AIストーリーボードジェネレーターの比較
これらのツールは、Storyboard to Filmのワークフローと、それぞれ異なる形で重なります。以下の機能の記載は、2026年9月に各社の公開ページで確認したもので、公開されていない情報は、表にその旨を書いています。
| ツール | フレーム | フレームを動画にするか | キャラクターの一貫性 | 備考 |
|---|---|---|---|---|
| MakeInfluencer.ai Storyboard to Film | GPT Image 2.5 FlareまたはSunburst、Nano Banana Pro、ほか | はい、同じ実行内で:Seedance 2.5、Seedance 2.5 Turbo、Wan 3.0、Kling 3.0、Gemini Omni | 自分のAIインフルエンサーか参照写真を、すべてのフレームに入力 | ダッシュボード、Canvas、REST API、MCP。実行前にクレジット消費量を表示 |
| Higgsfield Popcorn | 独自のストーリーボードモデル、最大8フレーム、最大4つの参照 | フレームは、KlingやVeoなどの別の動画モデルの開始フレームとして使う | 参照と、一貫したシーケンスの生成 | アプリ。生成前にクレジットを表示 |
| LTX Studio | 台本をシーンとショットに分割。FLUXまたはNano Bananaのフレーム | はい:LTX独自のモデルに加え、第三者のレビューがKling、Seedance、Veoを含むと挙げているパートナーモデル | キャラクターとオブジェクトを、再利用できる「Elements」として保存 | プリビズとピッチデッキのために作られたアプリ |
| Boords | 台本から、スケッチ、ベクター、実写風のフレーム | 動画クリップはなし。タイミング確認用の音声つきアニマティック | キャスト、ロケ地、小道具を一度名前をつけ、@で参照 | 代理店とブランドチーム向け |
| StoryboardHero | フレームごとに、タイトル、説明、アクション、ナレーションをつけたフレーム | MP4のアニマティックを書き出し。生成動画ではない | 公開ページでは、主要機能として扱われていない | マーケティングとSNS動画向け |
見方はこうです。クライアントに見せるボードだけが必要なら、BoordsとStoryboardHeroはそのために作られており、ほかにはないレビュー機能を備えています。タイムラインつきのエンドツーエンドの映像ツールがほしいなら、LTX Studioが最も完成度が高いです。Higgsfield Popcornは、アプリ内で一貫性が強く、より長いボード(最大8フレーム)を作りますが、アニメーションは別の工程に任せます。Storyboard to Filmテンプレートの強みは、クリエイターにとってはもっと限定的で具体的です。すでに持っているキャラクターからボードが始まり、フレームとクリップが1つのグラフで動き、すべてのノードをプラットフォーム上のどのモデルにも差し替えられます。
Higgsfieldのツールセットの全体像は、Higgsfield代替ガイドをご覧ください。動画モデルのトレードオフ全般については、2026年のAI動画生成ツールおすすめをご覧ください。
ワンクリック版:AI CanvasのStoryboard to Film
Storyboard to Filmテンプレートは、ここまでのすべてを、1回の実行にまとめています。AI Canvasを開き、映像制作者向けのテンプレートからこれを選び、最初のノードに企画書を、2番目のノードにキャラクターを入れて、実行を押してください。
具体的に何が動くのか。
- ストーリー企画書ノード1つ。 ストーリー、舞台設定、衣装、トーンを書き込む、穴埋め形式のテンプレートがあらかじめ入っています。
- キャラクターノード1つ。 顔の参照として、すべてのフレームノードに接続されます。
- ショットライターLLMノード4つ。 それぞれにディレクターのシステムプロンプトと、担当するビート(状況説明、アクション、クローズアップ、結末)の指示があり、温度は0.8、最大160トークンです。
- GPT Image 2.5 Flareのフレームノード4つ。 16:9、1K、中品質で、それぞれ1枚を出力します。
- Seedance 2.5 Turboのクリップノード4つ。 720p、5秒、音声オン。それぞれ、フレームを開始フレームとして、ショットの説明をプロンプトとして受け取ります。
すべてのノードが編集できます。よくある変更は次のとおりです。
- メインカットのクリップノードを1つ、標準のSeedance 2.5と1080pに設定する。
- アクションのショットの長さを、8秒か10秒に上げる。
- 新しいフレームではなく、既存の静止画の精密な編集が必要なときは、フレームノードをGPT Image 2.5 Sunburstに切り替える。
- ポスター品質の静止画がほしいときは、フレームの品質をhighにする。
- 4つのショットライターすべてで、ディレクターのシステムプロンプトを編集し、全体のスタイルを変える。たとえば「documentary, handheld, available light」。
クリップを実行する前に、ボードを承認する
テンプレートを一度実行し、4枚のフレームを確認して、外れたものだけを生成し直してください。各クリップは、その時点の最新のフレームを読み込むため、1枚のフレームを直してそのクリップだけを再実行すれば、費用は4本ではなく1本分で済みます。
4ショットを超えて
4ショットは、出発点の形であって、上限ではありません。拡張するには、次のようにします。
- ビートを増やす。 ショットライター、フレーム、クリップの一連のノードを複製し、新しいショットライターに、専用のビートの指示(「Write SHOT 5, the reaction of a second character...」)を与えます。企画書とキャラクターのノードを、それに接続します。
- ショットを長くする。 どのクリップも、Seedance 2.5で最長30秒まで動かせます。それを超える場合は、APIでSeedance 2.5のVideo Extendを使い、クリップを最後の30秒から続けます。
- 複数のシーン。 シーンごとの企画書と同じキャラクターで、テンプレートをシーンごとに1回実行します。衣装とトーンの記述は、企画書をまたいで同一にしてください。
- 縦型のカット。 フレームノードを9:16に変更します。画像から動画のクリップは開始フレームの形に従うため、全体の流れがReelsやTikTok向けの縦型になります。
同じパイプラインをAPIで構築する
テンプレートのすべての機能は、MakeInfluencer.aiのREST APIから利用でき、企画書のスプレッドシートから大量のボードを生成したいときに役立ちます。流れは次のとおりです。
gpt-image-2.5-flareで各フレームを生成し、キャラクター画像をimageUrlsで渡します。terminalがtrueになるまで/generations/image/{id}をポーリングし、URLを取得します。- 各クリップを、フレームのURLを
startFrameUrlとして、seedance25turboに送信します。開始フレームがあると、APIは自動的に画像から動画を選びます。 terminalがtrueになるまで/generations/video/{id}をポーリングします。
Seedance 2.5 APIガイドには、リクエストとレスポンスの完全な例があり、GPT Image 2.5 Flare APIのページには、フレームのすべてのパラメーターが載っています。クレジットは、ダッシュボード、Canvas、APIで共通で、preview-creditsは、課金せずに、あらゆるリクエストの正確なコストを返します。
よくある質問
AIストーリーボードジェネレーターとは何ですか?
台本や企画書を、ショットごとに1枚の静止画のシーケンスに変え、動画を制作する前に計画して承認できるようにするツールです。Storyboard to Filmテンプレートのような、ストーリーボードから動画を作るツールは、制作の工程を加え、承認された各フレームを、クリップに動かします。
この方法で、AIで短編映画を作れますか?
はい。1回の実行で、5秒のクリップが4本でき、1人のキャラクターと完結した流れを持つ20秒のシーケンスになります。より長い映像には、長さを上げるか、ショットの連なりを足すか、シーンごとにテンプレートを1回実行してください。現在の動画モデルで、長編映画を1回の生成で作れるものはありません。1〜3分のショートなら、複数回の実行と編集ソフトで、現実的に作れます。
ストーリーボードのフレームには、GPT Image 2.5とNano Banana Proのどちらが向いていますか?
GPT Image 2.5 Flareのほうが構図の指示に正確に従い、参照つきフレームで$0.039と、Nano Banana Proの$0.14よりも安いです。多数のフレームで同一の顔を保つ点では、Nano Banana Proのほうが強いことがあります。ショット1で両方を試し、キャラクターに合うほうを残してください。詳しくは、GPT Image 2.5とNano Banana Proの比較をご覧ください。
4本のクリップを通して、キャラクターは一貫しますか?
キャラクターの参照がすべてのフレームに入力され、Seedance 2.5は与えられたフレームそのものを動かすため、テキストだけから動画を作るより、はるかによく似姿が保たれます。完璧ではなく、首の回転と非常に小さな顔が、最もずれやすいです。4枚のフレームを並べて確認し、顔がおかしいフレームは、そのクリップを実行する前に生成し直してください。
1回の実行にはどのくらいかかりますか?
フレームは1枚あたり約30秒です。クリップはもっとかかります。ローンチ週のテストでは、Seedance 2.5 Turboのクリップ1本に約9分かかりました。1回の実行に、10〜20分を見込んでください。
自分で描いたストーリーボードのスケッチを、動画にできますか?
はい、ただし1つ工程が増えます。スケッチの画像入力ノードを追加してフレームノードにつなぎ、GPT Image 2.5 Sunburstに、構図を保ったままキャラクター参照で実写風にレンダリングさせます。そのあと、レンダリングされたフレームを動かします。鉛筆のスケッチを、動画モデルで直接動かすと、動くスケッチになりがちで、たいていは望むものではありません。
費用はいくらですか?
初期設定の、フレーム4枚とクリップ4本の実行で、提供元の定価で約$4.16です。開始前に、実行ボタンにクレジットで表示されます。フレームはその約4%です。4本のクリップをすべて、標準のSeedance 2.5の720pにアップグレードすると、合計は約$7.36になります。
無料で試す方法はありますか?
テンプレート全体については、ありません。フレームもクリップもクレジットで動き、新規アカウントに無料クレジットは付かないため、現在のプランは料金ページをご確認ください。無料でできるのは、AIストーリーボードジェネレーターのページのプレビューで、1枚ずつフレームを試すことです。アカウントなしで、当社独自のオープン画像モデルが動きます。GPT Image 2.5のフレームにはかないませんが、クレジットを使う前に、構図とレンズを試すには十分です。
最初のボードを始める
アカウントを作り、プランを選ぶ
MakeInfluencer.aiに登録し、料金ページでプランかクレジットバンドルを選びます。
AI Canvasを開き、Storyboard to Filmを選ぶ
ストーリー、舞台設定、衣装、トーンを書いた1段落の企画書を貼り付け、キャラクターを選んで、実行を押します。
フレームを承認してから、クリップを仕上げる
外れたフレームを生成し直し、メインカットを標準のSeedance 2.5にアップグレードして、4本のクリップを、1本の音楽とともにつなぎます。
AI Canvasを開いてテンプレートを実行するか、AI動画ジェネレーターで単発のショットを試すか、Seedance 2.5 APIガイドを読んで、同じパイプラインをコードで構築してください。ご質問は[email protected]までお寄せください。