「テキストを打ち込んだら、そのまま映画みたいな映像が出てきたらいいのに」——AI ショート動画を始めたばかりの頃、誰もが一度はそう思います。実際、2024年以降のテキスト動画生成は、その願いにかなり近いところまで来ました。ただし、いきなり「魔法のボタン」を押すだけでは、思った通りの映像は出てきません。鍵になるのは、プロンプトの書き方と、その前後のワークフローです。
この記事では、AI ショート動画制作をこれから始める人に向けて、MiniMax H3 を搭載した「墨川导演台(MiniMax H3 AI 导演台)」を使った、プロンプトから映像完成までの流れを、ステップバイステップで解説します。
なぜ「プロンプト1行」では良い映像にならないのか
テキスト動画生成と聞くと、こうイメージしがちです。
「夕暮れの街を歩く少女、シネマティック、4K」
これを入力すれば、それっぽい映像は出ます。しかし、ショート動画として「見られる」クオリティにするには、次の3つが足りません。
- 人物・场景の一貫性(カットが変わっても同じ人物・同じ場所に見えるか)
- カット間のつながり(前のショットと次のショットが自然につながるか)
- 音声・セリフ・音楽(ショート動画は「音」が命)
つまり、テキスト動画生成は「1回のガチャ」ではなく、設計図(脚本・分镜)→ 素材(参考图)→ 生成 → 音声というパイプラインで考える必要があります。墨川导演台は、まさにこのパイプラインを1つの作業台にまとめたツールです。
ステップ1:AI 编剧で「六段式脚本」と分镜を作る
最初からプロンプトを手書きする必要はありません。墨川导演台の AI 编剧 は、チャット形式で対話しながら、六段式の脚本と分镜(絵コンテ)の下書きを生成してくれます。
- 対応言語は中国語・英語・スペイン語・アラビア語・日本語の5言語
- AI は返答するだけでなく、下書きを実際に脚本ライブラリへ書き込みます
日本語で「30秒のショート動画、テーマは雨の日のコンビニ、主人公は一人の女性」のように話しかければ、シーン割りが返ってきます。ここで大切なのは、分镜(カット割り)の段階で情報を詰め込みすぎないこと。1カット=1アクションくらいが、テキスト動画生成が破綻しにくいコツです。
できあがった脚本は 脚本库 で管理し、必要なら 导入/新建 で自分の脚本を読み込むこともできます。
ステップ2:资产库で「一貫性」を仕込む
ここが初心者と中級者の分かれ目です。テキスト動画生成でよくある失敗が「カットごとに顔が変わる」「背景が別の場所になる」問題。これを防ぐのが 资产库 です。
- 角色(キャラクター)/场景(シーン)/道具(小道具)/参考视频を登録
- 参考画像をアップロードして、人物・场景の一貫性を保つ
さらに AI 制图 機能で、分镜の首帧(ファーストフレーム)・尾帧(ラストフレーム)・角色参考图を生成できます。文生图・图生图の両方に対応しているので、
- まずキャラの参考图を AI 制图で作る
- それを资产库に登録
- 各カットの首帧・尾帧を生成
という順番で進めると、映像の統一感がぐっと上がります。
ステップ3:项目库で生成し、音频库で仕上げる
素材がそろったら 项目库 で実際の生成です。
- プロジェクト単位で生成タスクとバージョンを管理
- 単镜生成(1カットずつ)と批量生成(一括)の両方に対応
批量生成は便利ですが、最初は単镜生成で1カットずつ確認するのがおすすめです。うまくいったカットのプロンプトをテンプレート化してから、横展開しましょう。
映像ができたら音声です。音频库 では、
- 音色克隆(声のクローン)
- 对口型(リップシンク)
- 背景音乐・效果音
を扱えます。さらに AI 配音 は IndexTTS 2.5 による多言語配音で、情绪控制(感情のコントロール)も可能。ナレーションのトーンを変えるだけで、同じ映像でも印象が大きく変わります。
ちなみに AI MV 機能を使えば、音楽に合わせたミュージックビデオ生成もできます。ショート動画のBGM主体の構成なら、こちらも選択肢に入ります。
ステップ4:ローカル/クラウド/API から実行環境を選ぶ
墨川导演台の実行モードは3つです。
- 本地部署:自分の GPU マシンで実行(推論はローカル)
- 云部署:自分で借りた GPU クラウドサーバーに SSH 接続して推論
- API 调用:インターフェース経由で导演台の機能を利用
クラウド推論は ComfyUI ワークフローを使い、参考图の一貫性・分镜のつながり・批量キューをサポートします。対応クラウドは AutoDL・阿里云・腾讯云・仙宫云・自定义 SSH 服务器。SSH で接続する際はローカルトンネルのポートが自動で分離されるので、複数ユーザーでも混線しません。
たとえば仙宫云で試す場合の流れは次の通りです。
- 仙宫云の私有镜像に接続(公開イメージではありません)
- 仙宫云公式サイト(https://www.xiangongyun.com/register/B1H9M6 )で再登録し、招待コード B1H9M6 を入力
- 登録・認証後、アカウント ID を客服(WeChat: ymcandai)へ送付
- テストアカウントが開通すると导演台の镜像が見えるので、それでインスタンスをデプロイ
- インスタンス右側の SSH をクリックし、ホスト・ポート・パスワードを取得
- 导演台の「云部署」ページに SSH Host / SSH Port / SSH 密码を入力
- 「验证 SSH」→「启动云端 ComfyUI」 の順にクリックし、緑の起動成功表示を待つ
- あとは脚本を書いて映像生成をテストするだけ
生成ログやシステム状態は AI 日志 / 系统志 でリアルタイムに確認できます。動かないときは、まずここを見るのが鉄則です。
実践のコツ:プロンプトは「動画の文法」で書く
最後に、テキスト動画生成で効くプロンプトの考え方をまとめます。
- 1カット1アクション:動きを詰め込みすぎない
- カメラワークを明示:「ゆっくり前進」「固定ショット」など
- 光と時間帯を指定:「夕方の逆光」「室内の暖色照明」
- 参考图と組み合わせる:言葉で説明しづらい顔・服装は画像で渡す
- 首帧・尾帧を意識:始点と終点を決めると、つながりが安定する
AI 编剧・对话系の機能では、自前の LLM API Key を接続することもできます。自分の好みのモデルで脚本を練りたい人は、この辺りを調整してみてください。
まとめ:まずは「1本」作ってみる
AI ショート動画は、特別な才能がなくても始められます。大切なのは、
- AI 编剧で脚本と分镜を作る
- 资产库で一貫性を仕込む
- 项目库で単镜生成→批量生成
- 音频库で音を仕上げる
という流れを、まず1本通してみることです。実行環境はローカルでもクラウドでも構いません。分からないことがあれば、客服 WeChat:ymcandai に聞くか、淘宝で「杨墨川AI」を検索してみてください。最新の対応状況や環境要件は、公式サイト(www.ymcdirector.com)や客服微信で確認するのが確実です。
最初の1本はぎこちなくても大丈夫。2本目、3本目と作るうちに、プロンプトの解像度が上がっていきます。まずは今日、30秒のショート動画を1本完成させてみましょう。🎬