ストーリーモードガイド
白紙の状態から完成した動画まで、アプリの中だけで作りきる
🎬 ストーリーモードとは v3.0.0
ストーリーモードは、ひとつのアイデアを「プロンプト・ナレーション・効果音まで揃ったシーン表」に変えるパイプラインです。タイトル(あるいは既に書き上げた台本)を渡すだけで、リサーチ → シノプシス → 台本 → シーン分割 → オーディオ → プロンプトと順に進み、各ステップの成果物をそのまま次のステップへ受け渡します。AutoFlowCutの外に出る必要はありません。
題材やタイトル、あるいは完成した台本はあるけれど、シーンもプロンプトも音声もまだ無いとき。その全部をストーリーモードが作ります。
絵コンテ表や字幕、アプリの外で用意したオーディオパッケージが既にあるとき。ファイルインポートガイドをご覧ください。
💡 ヒント: 2つの道は結局同じ場所で合流します。シーンがどちらから入ってきても、その後の生成とエクスポートはまったく同じように動きます。
🧭 ステッパーの全体像
ストーリー画面の上部にステッパーがあります。各ステップはチップになっていて、クリックすればそのステップが作った結果をいつでも見直せます。チップの中の色付きドットが状態を示します — 待機・進行中・完了・エラー。
0 設定 → ① リサーチ → ② シノプシス → ③ 台本 → ④ シーン分割 → ⑤ オーディオ → ⑥ プロンプト
(任意) (ゲート) [自動] [自動] [自動]
▶ 一括実行
| ステップ | 次のステップへ渡すもの |
|---|---|
| 0 設定 | ジャンル、生成AI、出力言語、台本の分量、シーン分割単位、レビュー設定、タイトル — そして(任意で)貼り付け・読み込んだ台本 |
| ① リサーチ | 参考YouTube動画の構造分析と、ファクトチェック済みの主張 |
| ② シノプシス | あらすじと、確定した登場人物リスト |
| ③ 台本 | 完成した台本本文 |
| ④ シーン分割 | シーン、話者ごとのセグメント(感情つき)、効果音の指示 |
| ⑤ オーディオ | 話者ごとに分かれたナレーショントラックと、生成された効果音 |
| ⑥ プロンプト | シーンごとの画像プロンプトと動画プロンプト |
💡 補足: リサーチとシノプシスは実行ステップではなくゲートです。プロジェクトに該当する場合だけクリックでき、そうでなければグレーのままです。取り込んだ画像にシーンが固定されているプロジェクトでは、それを書き換えるステップはロックされます。
0️⃣ 設定
パイプラインの入口タブです。ここで選んだ内容はプロジェクトと一緒に保存されるので、後で開き直してもフォームはそのまま復元されます。
オプション
| 項目 | 内容 |
|---|---|
| 物語のタイプ | 選べるジャンルは出力言語によって変わります。韓国語なら野談(朝鮮の説話)、英語ならダークヒストリー。どちらの言語でも汎用の既定値であるカスタムが使えます。 |
| 生成AI | 台本を書くモデル — ClaudeまたはCodex。対応モデルではドロップダウンの隣に推論レベルの選択も表示されます。 |
| 出力言語 | 韓国語または英語。アプリのUI言語ではなく物語の言語です。 |
| 台本の分量 | 数値と単位。分はどちらの言語でも使え、韓国語なら文字数、英語なら単語数でも指定できます。最大60分。 |
| シーン分割単位 | シーン基準(目標の長さを最小~最大秒で指定、既定は5~10秒)または文単位。シーン分割を参照。 |
| レビュー | 台本・シーン・プロンプトそれぞれの自動レビュー切り替えと、回数(1~5回)。 |
| タイトル | 任意。空のまま台本がある場合は、シーン分割の直前にAutoFlowCutがタイトルを自動生成します。 |
2つの始め方
タイトルから始める
タイトルを入力して✨ 開始を押すと、シノプシスのゲートに進みます。AIがあらすじと登場人物の案を作り、確定するのは人間です。
自分の台本から始める
入力欄に台本を貼り付けるか、.txt / .md ファイルをドラッグ&ドロップします(📁 ファイル選択でも可)。✨ 開始を押すと台本がそのまま保存され、シノプシスのゲートがその台本から登場人物を逆抽出します。
💡 補足: 台本が既にある場合、ボタンは↻ 変更内容で再開に変わります。実際に何かを変えたときだけ有効になり、押すと台本から作り直すので、意図して押してください。
1️⃣ リサーチ 任意
題材を決める前に、YouTubeで既に通用しているものを確かめます。リサーチはシノプシスの手前にあり、まだ台本が無いプロジェクトで使えます。キーワードで検索するので、タイトルすら不要です。
進め方
検索
キーワードを入れ、件数(10 / 20 / 30件)とアップロード期間(すべて・直近1週間・直近30日)を選びます。YouTubeのURLを貼り付けて動画を手動で追加することもできます。
参考動画を選ぶ
結果はサムネイル・チャンネル・再生回数・投稿日が並ぶカードで返ってきます。使いたいものにチェックを入れ、カードをダブルクリックすると詳細(登録者数、公開日、バイラル指数、インライン再生)が開きます。
分析
まとめて分析は3段階を続けて実行します — 字幕取得 → 構造分析 → ファクトチェック。字幕取得・構造分析・ファクトチェックを個別に実行することもでき、長引くときは⏹ 中断で止められます。
確定またはスキップ
このリサーチを使うを押すとプロジェクトに保存され、シノプシスへ進みます。スキップならリサーチ無しでそのままシノプシスへ。
参考動画を物語のビートに分解して要約し、共通する論点と主要な主張を抽出します。
主張ごとに検証済み・反証・未検証の判定と根拠リンクが付きます。チェックした主張だけがプロジェクトに取り込まれ、既定では検証済みのみです。
⚠️ yt-dlpが必要です。 リサーチはyt-dlpで検索結果と字幕を取得します。インストールされていない場合は、OSに応じたインストールコマンドがパネルに表示されます。
📜 参考・再構成のための機能です。 他人の字幕を無断で複製・再配布すると著作権侵害になるおそれがあります。アプリもリサーチパネルの冒頭で同じ注意を表示します。
2️⃣ シノプシス ゲート
シノプシスは、機械が物語を持って走り出す前に人間が一度確認する場所です。ここで登場人物を確定するまで、シーン分割もオーディオもプロンプトも始まりません。
やること
- タイトルから始めた場合: AIがあらすじをストリーミングで書き下ろし、編集可能なテキスト欄に流し込みながら、登場人物の案も提示します。
- 自分の台本から始めた場合: 逆向きに動きます — 持ち込んだ台本から登場人物とあらすじを逆抽出します。
- リサーチを確定していればリサーチのコンテキストを含めるチェックボックスが現れます。これが唯一のスイッチで、リサーチが黙って注入されることはありません。
- あらすじは自由に編集でき、行数と文字数がリアルタイムで表示されます。
登場人物カード
1行が1人で、どの欄も自分で書き換えられます。行の追加・削除も自由です。
| 項目 | 使われる場所 |
|---|---|
| 名前 | シーン表の話者名になり、のちに@メンションの呼び名になります |
| 性別 | 男性 / 女性 / 不明。ナレーター選択モーダルを先に絞り込み、性別の食い違う声を選んだときに警告します |
| 民族 | 自由入力。画像プロンプト内の人物の外見描写に組み込まれます |
| 年齢 | 自由入力 |
| 役割 | 自由入力 |
| プロンプト | 人物の外見。リファレンスカードを生成するときに使われるのが、まさにこのテキストです — 登場人物と@メンションを参照 |
ナレーションだけの台本などで登場人物がまったく居ない場合は、パネルがそう伝えます。空のまま確定して先に進めます。
レビューと没入感スコア
レビューを押すと、AIが自分の書いたシノプシスを読み直し、没入感を100点満点で採点したうえで書き直します。回数は1~5回で指定します。エディタの下のバッジには最初のスコアと最後のスコアが並んで表示されるので、書き直しが本当に効いたかどうかが目で分かります。スコアが下がった回の修正稿は破棄され、その旨がログに残ります。
✅ 確定: タイトルから始めた場合、ボタンはこのシノプシスで台本を生成で、押すとそのまま台本ステップへ進みます。自分の台本から始めた場合は登場人物を確定で、台本には手を触れず登場人物だけをコミットします。
3️⃣ 台本
台本は、この先のすべての唯一の基準です。モデルが書いている間はリアルタイムで流れ込み、書き終わるとエディタに変わって、いつでも自分の手で直せます。
今のタイトルと設定で台本全体を作り直します。新しい生成が失敗した場合は、前の台本がそのまま残ります。
すでに書かれた分をそのままに、止まったところから書き継ぎます。長い台本が短く終わってしまったときに便利です。
シノプシスと同じ検討・修正ループで、没入感スコアと回数指定もそのままあります。設定で自動レビューを入れておけば、生成のたびに自動で回ります。
編集した台本を保存し、シーン分割までを一度に実行します。タイトルが空ならまず自動生成します。
💡 補足: 生成中はストップウォッチが経過時間を示し、⏹ 中断で止められます。推論レベルを上げると最初の一文字が出るまで時間がかかることがありますが、そのときも時計が「動いている」ことを教えてくれます。
4️⃣ シーン分割
台本をシーンに、シーンをさらにセグメントに刻みます。セグメントとは、話者と感情が紐づいたナレーション・台詞の一行か、効果音の指示です。
指定した目標の長さ(最小~最大秒、既定は5~10秒)に合わせてシーンを切ります。
1文につき1シーン。話者が変わるところでは必ず切り、短すぎる断片は結合し、10秒を超えるものは分割します。
シーン表
列は3つ — 番号、話者、セグメント。キャラクターの台詞にはその下に感情が付きます(普通・喜び・悲しみ・怒り)。ナレーションには付きません。ナレーターには感情を与えないからです。効果音の行はSFXと表示され、台詞の代わりに効果音の説明が入ります。
感情は飾りではありません。TTSエンジンにそのまま渡される演技の指示です。
🔁 切り方が気に入らない場合は? 表のすぐ上に分割単位と長さの範囲があります。変更して↻ シーン再分割を押してください。何度でもやり直せます。
5️⃣ オーディオ
話者ごとに声を割り当て、効果音の指示ごとに音を付けます。出来上がるのは話者ごとに分かれたナレーショントラックです。登場人物の多い物語が、一人の朗読ではなく配役のある芝居に聞こえるのはこのためです。
声のキャスティング
パネルの上部に話者の一覧があります。各行に人物名・性別バッジ・外見が表示され、🎙 ボタンを押すと声の選択モーダルが開きます。
- 話者ごとに別のエンジンを。 Typecast・Gemini・ElevenLabsで絞り込むか、すべてのままにできます。同じ物語の中で人物ごとに違うエンジンを使っても構いません。
- 検索と試聴。 名前や特性で検索し、性別で絞り、カードの再生ボタンで声を聴いてから決められます。ElevenLabsの共有ボイスはリモート検索なので、最初のページより先を探すには2文字以上の入力が必要です。
- 性別タグ。 どのカードにも男性・女性・不明のタグが付きます。タグが無い、または間違っている場合は、カードを右クリックして自分で指定できます。
- 不一致の警告。 人物の性別と選んだ声の性別が食い違うと、ボタンに ⚠ が出ます。ブロックはしません — 間違いではなく意図であることを確認させるだけです。
- デフォルトボイス。 そのままにしておくと、そのエンジンの既定の声にフォールバックします。
感情 — キャラクターにだけ
シーン分割がキャラクターの台詞に付けた感情は、そのままTTSエンジンに渡され、その場面に合った演技になります。ナレーターは意図的に除外しています。感情を込めるナレーターは落ち着きなく聞こえ、揺れないナレーターこそが物語を運ぶからです。
効果音
効果音はシーン分割の段階で台本から自動的に抜き出され、該当するシーンに配置されます。表では説明つきのSFX行として現れます。生成はElevenLabsが担当し、行から1つずつ試聴できます。
行ごとの操作
| 操作 | 動作 |
|---|---|
| ▶ テスト | そのセグメント1つだけを、選んだ声で合成してすぐ再生します — キャスティングが合っているかを確かめるためにバッチ全体を回す必要はありません |
| ▶ / ⏹ | すでに生成済みのオーディオを再生・停止します |
| ↻ | そのセグメント1つを強制的に再生成します |
各行には状態(待機・進行中・完了・エラー)も表示され、バッチの実行中はリアルタイムで更新されます。
🎧 生成が終わると、表の上にタイムラインが現れ、すべての声のトラックと効果音が字幕に沿って並びます。オーディオパッケージをインポートしたときに見えるのと同じタイムラインです。↻ オーディオ再生成は、エンジンや声が実際に変わったセグメントだけを合成し直します。
6️⃣ プロンプト
最後のステップは、シーンごとに画像プロンプトと動画プロンプトを書きます。材料はそのシーンの要約とセグメントのテキスト、確定した登場人物の外見描写、そしてスタイルです。表はシーン1つが1行で、2つのプロンプトを並べて表示します。
プロンプトも台本と同じ扱いです — 回数を指定できるレビューボタンと、設定にある自動レビューの切り替え。↻ プロンプト再生成ですべて書き直します。
💡 補足: ここで作られたプロンプトは通常のシーン表にそのまま入るので、AutoFlowCutのどこからでも編集を続けられます。アプリで直接でも、Claude CodeからMCPサーバー経由でも構いません。
⚡ 自動と一括実行
任せられるステップに自動を入れて▶ 一括実行を押せば、パイプラインは最後まで自分で進みます。
動作のルール
- 自動のチェックボックスはチップの中にあり、人手なしで回せる3つのステップにだけ付いています — シーン分割・オーディオ・プロンプト。設定と台本にはありません。台本は人が見るべきものだからです。
- 一括実行は自動が入ったステップだけを順に実行し、残りは飛ばします。台本が完了している必要があり、どこかでエラーが出れば即座に止まります。
- オーディオは既定でオフです。TTSは回すたびに費用がかかるため、オンにするのは意図的な操作にしてあります。
- 先にシノプシスのゲートで登場人物を確定してください。未確定のあいだ、一括実行は無効のままです。
💡 おすすめの進め方: シーン分割とプロンプトは自動のままにし、オーディオは声の選択モーダルで何行か試聴するまでオフにしておきます。声に納得できたらオンにして、一括実行で仕上げましょう。
🎭 登場人物と@メンション
登場人物は台本の中に留まりません。シノプシスのゲートで名簿を確定した瞬間、人物たちはリファレンスタブにリファレンスカードとして自動登録されます。カードで編集したプロンプト欄が、そのままリファレンス画像を生成するテキストです。
シーンに人物を指定する
シーンのプロンプトの中で@に続けて人物名を入力すると、そのリファレンス画像に結びついたチップに変わります:
@scholar が灯火の下にひとり座り、窓の外には雨の音
一致したメンションはシアンのチップになり、一致しなかったメンションは赤い波線の下線が付いたテキストのまま残るので、リファレンスが本当に付いているかが常に分かります。人物名が重要なのはこのためです — 名前がそのまま呼び名になります。
📖 @メンションの詳細な仕様(一致ルール、チップ、リファレンス画像)はファイルインポートガイドにあります。ストーリーモードは、その登場人物をただで用意してくれるだけです。
🚀 生成とエクスポート
パイプラインが最後まで進むと、ストーリーモードは完成したプロジェクトを引き渡します — シーン、プロンプト、リファレンスになった登場人物、そしてオーディオ。ここから先に、ストーリー専用の手順はひとつもありません。
画像と動画を生成する
インポートしたプロジェクトとまったく同じようにシーンを生成にかけます — Google Flowログイン、または自分のGemini / Veo APIキー。結果パネルのタイムライン・結果表・グリッドで確認してください。
直すべきところを直す
プロンプトを直して1シーンだけ再生成する、台詞を1行だけ録り直す、シーンを分割し直す。どのステップにも、ステッパーのチップからいつでも戻れます。
編集ソフトへエクスポート
CapCut、Adobe Premiere Pro(.prproj)、Vrew(.vrew)へ書き出します。ナレーショントラックと効果音も、別々のオーディオトラックとして一緒に渡ります。
📖 次に読むもの: プロジェクトフォルダをどこに置き、どう開くかはCapCutエクスポートガイドで説明しています。