AIショート動画入門:プロンプトから MiniMax H3 の映像を作る方法

2026-10-05 · 日本語 · https://blog.ymcdirector.com

「テキストを打ち込んだら、そのまま映画みたいな映像が出てきたらいいのに」——AI ショート動画を始めたばかりの頃、誰もが一度はそう思います。実際、2024年以降のテキスト動画生成は、その願いにかなり近いところまで来ました。ただし、いきなり「魔法のボタン」を押すだけでは、思った通りの映像は出てきません。鍵になるのは、プロンプトの書き方と、その前後のワークフローです。

この記事では、AI ショート動画制作をこれから始める人に向けて、MiniMax H3 を搭載した「墨川导演台(MiniMax H3 AI 导演台)」を使った、プロンプトから映像完成までの流れを、ステップバイステップで解説します。

なぜ「プロンプト1行」では良い映像にならないのか

テキスト動画生成と聞くと、こうイメージしがちです。

「夕暮れの街を歩く少女、シネマティック、4K」

これを入力すれば、それっぽい映像は出ます。しかし、ショート動画として「見られる」クオリティにするには、次の3つが足りません。

  • 人物・场景の一貫性(カットが変わっても同じ人物・同じ場所に見えるか)
  • カット間のつながり(前のショットと次のショットが自然につながるか)
  • 音声・セリフ・音楽(ショート動画は「音」が命)

つまり、テキスト動画生成は「1回のガチャ」ではなく、設計図(脚本・分镜)→ 素材(参考图)→ 生成 → 音声というパイプラインで考える必要があります。墨川导演台は、まさにこのパイプラインを1つの作業台にまとめたツールです。

ステップ1:AI 编剧で「六段式脚本」と分镜を作る

最初からプロンプトを手書きする必要はありません。墨川导演台の AI 编剧 は、チャット形式で対話しながら、六段式の脚本と分镜(絵コンテ)の下書きを生成してくれます。

  • 対応言語は中国語・英語・スペイン語・アラビア語・日本語の5言語
  • AI は返答するだけでなく、下書きを実際に脚本ライブラリへ書き込みます

日本語で「30秒のショート動画、テーマは雨の日のコンビニ、主人公は一人の女性」のように話しかければ、シーン割りが返ってきます。ここで大切なのは、分镜(カット割り)の段階で情報を詰め込みすぎないこと。1カット=1アクションくらいが、テキスト動画生成が破綻しにくいコツです。

できあがった脚本は 脚本库 で管理し、必要なら 导入/新建 で自分の脚本を読み込むこともできます。

ステップ2:资产库で「一貫性」を仕込む

ここが初心者と中級者の分かれ目です。テキスト動画生成でよくある失敗が「カットごとに顔が変わる」「背景が別の場所になる」問題。これを防ぐのが 资产库 です。

  • 角色(キャラクター)/场景(シーン)/道具(小道具)/参考视频を登録
  • 参考画像をアップロードして、人物・场景の一貫性を保つ

さらに AI 制图 機能で、分镜の首帧(ファーストフレーム)・尾帧(ラストフレーム)・角色参考图を生成できます。文生图・图生图の両方に対応しているので、

  • まずキャラの参考图を AI 制图で作る
  • それを资产库に登録
  • 各カットの首帧・尾帧を生成

という順番で進めると、映像の統一感がぐっと上がります。

ステップ3:项目库で生成し、音频库で仕上げる

素材がそろったら 项目库 で実際の生成です。

  • プロジェクト単位で生成タスクとバージョンを管理
  • 単镜生成(1カットずつ)と批量生成(一括)の両方に対応

批量生成は便利ですが、最初は単镜生成で1カットずつ確認するのがおすすめです。うまくいったカットのプロンプトをテンプレート化してから、横展開しましょう。

映像ができたら音声です。音频库 では、

  • 音色克隆(声のクローン)
  • 对口型(リップシンク)
  • 背景音乐・效果音

を扱えます。さらに AI 配音 は IndexTTS 2.5 による多言語配音で、情绪控制(感情のコントロール)も可能。ナレーションのトーンを変えるだけで、同じ映像でも印象が大きく変わります。

ちなみに AI MV 機能を使えば、音楽に合わせたミュージックビデオ生成もできます。ショート動画のBGM主体の構成なら、こちらも選択肢に入ります。

ステップ4:ローカル/クラウド/API から実行環境を選ぶ

墨川导演台の実行モードは3つです。

  • 本地部署:自分の GPU マシンで実行(推論はローカル)
  • 云部署:自分で借りた GPU クラウドサーバーに SSH 接続して推論
  • API 调用:インターフェース経由で导演台の機能を利用

クラウド推論は ComfyUI ワークフローを使い、参考图の一貫性・分镜のつながり・批量キューをサポートします。対応クラウドは AutoDL・阿里云・腾讯云・仙宫云・自定义 SSH 服务器。SSH で接続する際はローカルトンネルのポートが自動で分離されるので、複数ユーザーでも混線しません。

たとえば仙宫云で試す場合の流れは次の通りです。

  • 仙宫云の私有镜像に接続(公開イメージではありません)
  • 仙宫云公式サイト(https://www.xiangongyun.com/register/B1H9M6 )で再登録し、招待コード B1H9M6 を入力
  • 登録・認証後、アカウント ID を客服(WeChat: ymcandai)へ送付
  • テストアカウントが開通すると导演台の镜像が見えるので、それでインスタンスをデプロイ
  • インスタンス右側の SSH をクリックし、ホスト・ポート・パスワードを取得
  • 导演台の「云部署」ページに SSH Host / SSH Port / SSH 密码を入力
  • 「验证 SSH」→「启动云端 ComfyUI」 の順にクリックし、緑の起動成功表示を待つ
  • あとは脚本を書いて映像生成をテストするだけ

生成ログやシステム状態は AI 日志 / 系统志 でリアルタイムに確認できます。動かないときは、まずここを見るのが鉄則です。

実践のコツ:プロンプトは「動画の文法」で書く

最後に、テキスト動画生成で効くプロンプトの考え方をまとめます。

  • 1カット1アクション:動きを詰め込みすぎない
  • カメラワークを明示:「ゆっくり前進」「固定ショット」など
  • 光と時間帯を指定:「夕方の逆光」「室内の暖色照明」
  • 参考图と組み合わせる:言葉で説明しづらい顔・服装は画像で渡す
  • 首帧・尾帧を意識:始点と終点を決めると、つながりが安定する

AI 编剧・对话系の機能では、自前の LLM API Key を接続することもできます。自分の好みのモデルで脚本を練りたい人は、この辺りを調整してみてください。

まとめ:まずは「1本」作ってみる

AI ショート動画は、特別な才能がなくても始められます。大切なのは、

  • AI 编剧で脚本と分镜を作る
  • 资产库で一貫性を仕込む
  • 项目库で単镜生成→批量生成
  • 音频库で音を仕上げる

という流れを、まず1本通してみることです。実行環境はローカルでもクラウドでも構いません。分からないことがあれば、客服 WeChat:ymcandai に聞くか、淘宝で「杨墨川AI」を検索してみてください。最新の対応状況や環境要件は、公式サイト(www.ymcdirector.com)や客服微信で確認するのが確実です。

最初の1本はぎこちなくても大丈夫。2本目、3本目と作るうちに、プロンプトの解像度が上がっていきます。まずは今日、30秒のショート動画を1本完成させてみましょう。🎬

墨川导演台 · MiniMax H3 公式サイト →

WeChat QR

WeChat: ymcandai · Taobao: 杨墨川AI

記事一覧