MENU

【日本は“使える側”】MiniMax H3がオープンウェイト公開|ComfyUIでローカル動画生成、商用利用・必要PCまで解説

本サイトではAmazonアソシエイトを含むアフィリエイト広告を利用しています。

           ┌─────────────────────────────┐
                🛒 Amazonで最新ガジェットをチェック

             PC・タブレット・ゲーミングデバイス・周辺機器を探す

           └─────────────────────────────┘

AI動画生成が、また一段階変わろうとしています。

中国のAI企業MiniMaxは2026年7月31日、新しい動画生成モデル「MiniMax H3」を発表しました。

MiniMax H3は、

  • テキスト
  • 画像
  • 動画
  • 音声

を組み合わせて理解し、映像と音声を同時に生成できるマルチモーダル動画生成AIです。

最大15秒、2K解像度、ネイティブステレオ音声生成にも対応するとされています。

そして8月2日、さらに大きな動きがありました。

MiniMax H3のモデルウェイトが公開されたのです。

つまり、MiniMaxのクラウドサービスへアクセスして動画を作るだけではなく、モデルデータを自分の環境へダウンロードし、ComfyUIなどを使ってローカルで動かせるようになりました。

しかし今回、AI Motion Labが特に注目したのは性能だけではありません。

ライセンスを確認すると、MiniMax H3のオープンウェイト版は、

  • アメリカ
  • EU
  • イギリス
  • 韓国

を対象地域から除外しています。

日本は除外されていません。

つまり2026年8月8日時点のライセンス文面では、日本はMiniMax H3のオープンウェイト版を利用できる「Applicable Territory」に含まれています。

これは日本のAIクリエイター、動画制作者、ComfyUIユーザーにとって、かなり興味深い状況です。

この記事では、

  • MiniMax H3とは何か
  • オープンウェイトとは何なのか
  • 日本では本当に使えるのか
  • なぜ米国やEUでは制限されているのか
  • 日本語音声は使えるのか
  • ComfyUIでローカル生成できるのか
  • 普通のPCでも動かせるのか
  • 商用利用はできるのか
  • 日本の副業・動画制作で何ができそうか

まで、初心者向けに整理します。

※本記事は2026年8月8日時点のMiniMax公式情報、Hugging Face上の公式モデルカード・ライセンス、ComfyUIコミュニティの検証情報をもとにしています。ライセンスや提供条件は今後変更される可能性があります。

オープンウェイトって、無料の動画生成AIが公開されたってこと?

かなり近い。ただし“オープンソース”とは少し違う。まずそこから整理しよう

目次

MiniMax H3とは?

MiniMax H3は、MiniMaxが2026年7月31日に発表した動画生成モデルです。

従来の動画生成AIでは、

  • Text to Video
  • Image to Video
  • Video to Video
  • 音声生成
  • キャラクター参照
  • モーション参照

などが別々の機能として提供されることが多くありました。

H3では、これらを一つのマルチモーダル生成システムとして扱うことを目指しています。

MiniMax公式は、H3について「テキスト・画像・動画・音声からなるマルチモーダルな文脈を統合理解できる」と説明しています。

MiniMax H3でできること

公式モデルカードで確認できる主な入力方式は次のとおりです。

  • テキストから動画+音声
  • 画像から動画+音声
  • 最初と最後の画像を指定した動画生成
  • 複数画像を参照した動画生成
  • 動画を参照した生成
  • 音声を参照した生成
  • 画像・動画・音声を組み合わせた生成

Referenceモードでは最大9枚の画像、最大3本の動画、最大3本の音声を組み合わせることができます。入力ファイル総数は最大12です。

これは、単純に、

「猫が走っている動画を作って」

と依頼するだけではありません。

例えば、

この人物画像を使い、この動画のカメラワークを参考にし、この音声の声質で、日本語のセリフを話させる

といった使い方へ発展できます。

日本人にうれしいポイント:日本語音声に正式対応

MiniMax H3の公式モデルカードでは、安定対応する会話言語として11言語が掲載されています。

その中には日本語も含まれています。

対応言語は、

  • 日本語
  • 中国語
  • 英語
  • 韓国語
  • フランス語
  • ドイツ語
  • イタリア語
  • スペイン語
  • ポルトガル語
  • ロシア語
  • アラビア語

です。

これは日本のクリエイターにとって重要です。

AI動画生成では、

映像はきれいだけど、日本語を話させると不自然

という問題がありました。

H3は映像を作ってから別のAIで音声を後付けするのではなく、映像とステレオ音声を同時生成する設計です。

そのため、

  • 日本語の会話
  • 効果音
  • 環境音
  • BGM
  • キャラクターの動き

を一つの生成工程でまとめられる可能性があります。

日本向けショート動画との相性はかなり良さそう

例えば、

  • LINE風ショートドラマ
  • AIキャラクター動画
  • 商品紹介
  • 観光PR
  • アニメ風ショート
  • YouTube Shorts
  • Instagram Reels
  • TikTok

などへの応用が考えられます。

もちろん、日本語品質については実際の声質、イントネーション、漢字の読み、長い会話などを検証する必要があります。

しかし、「日本語が正式な安定対応言語に入っている」こと自体は大きなポイントです。

そして最大のニュース:モデルウェイトが公開された

MiniMax H3のモデルデータは、Hugging Faceで公開されています。

モデルカード上のサイズは33B parametersです。

これによって、対応するPCやGPUがあれば、

MiniMaxのWebサービスだけでなく、自分のPC上でH3を動かす

ことが可能になりました。

これが「オープンウェイト」です。

オープンウェイトとオープンソースは違う

ここは非常に重要です。

MiniMax H3について、「オープンソースになった」と紹介されることがあります。

しかし、厳密にはオープンウェイトと表現する方が適切です。

オープンウェイト

学習済みモデルの重みをダウンロードできる。

完全なオープンソース

モデルウェイトだけでなく、

  • 学習コード
  • 学習方法
  • 学習データ
  • 全パイプライン
  • 再現に必要な情報

などまで広く公開される。

H3では主要なモデルウェイトは公開されていますが、システム全体がすべて公開されているわけではありません。

“自分のPCで動かせる”のは事実。でも“H3のすべてが公開された”わけではない。この違いは重要

ローカル版はクラウド版と完全に同じではない

H3の完全なシステムは、公式資料では3つのモジュールから構成されています。

H3-Context-IR

複雑な画像・動画・音声・文章の関係を理解し、H3が処理しやすい形へ整理する前処理システム。

H3-Base

実際の動画と音声を生成する中心モデル。

H3-Regenerate-2K

生成された768p映像を、元のコンテキストを使いながら2Kへ再生成するシステム。

現在オープンウェイトとして公開されている中心はH3-Baseです。

ローカルH3-Baseでは768p出力が基本となります。H3-Context-IRはホスト型システムのため公開版には含まれず、H3-Regenerate-2Kもまだ公開されていません。MiniMaxは2K再生成モジュールについて、技術が安定した段階で公開すると説明しています。

したがって、

「オープンウェイト版を入れれば、クラウド版と全く同じ2K H3が完全ローカルで使える」

という説明は、現時点では正確ではありません。

現在の整理

機能ローカル公開
H3-Base
768p動画+音声
Text to Video
Image to Video
Reference to Video
日本語音声
H3-Context-IR×・API利用
H3-Regenerate-2K×・未公開
完全ローカル2K公式ワークフロー現時点では×

ここは記事で必ず説明したい部分です。

日本が「使える側」に入っている

そして今回、AI Motion Labとして最も注目したいのがライセンスです。

MiniMax H3 Community Licenseでは、

Applicable Territory = Excluded Territoriesを除く世界

と定義されています。

Excluded Territoriesは、

  • European Union
  • United Kingdom
  • Republic of Korea
  • United States of America

です。

日本は含まれていません。

したがって、2026年8月8日時点のライセンス文面をそのまま読む限り、日本国内でMiniMax H3のオープンウェイト版を利用することは認められています。

これは結構珍しい

AI関連ニュースでは、

「海外では使えるけど日本はまだ対象外」

ということもあります。

今回は逆です。

日本のユーザーは、H3のオープンウェイト利用について対象地域内に入っています。

一方、アメリカ・EU・イギリス・韓国では、オープンウェイト版を利用するにはMiniMaxへ個別にライセンス申請する仕組みが用意されています。Hugging Face上にも、この4地域向けの申請フォームが掲載されています。

“日本では何をしても自由”という意味ではありません。しかし、オープンウェイト利用の地域条件という点では、日本は現在かなり面白い位置にいます

なぜ米国・EU・英国・韓国が除外されている?

MiniMaxは、動画生成AIを巡る規制環境が複雑で急速に変化していることを理由として説明しています。

特に、

  • 肖像
  • 著作権
  • コンテンツ安全性
  • 責任あるAI運用

などについて地域ごとに規制体系が異なるため、すべての地域でオープンウェイトを同時提供するのではなく、まず条件を明示して公開する方針を取ったとしています。

つまり、

日本だけ特別に優遇された

とまでは言えません。

しかし結果として、現時点では日本の個人ユーザーや開発者がローカルH3を試しやすい状況になっています。

日本で使える=何を生成してもいい、ではない

ここは非常に重要です。

MiniMaxのライセンスでも、知的財産権を侵害する使用は禁止されています。

また、MiniMaxは生成物について権利を主張しない一方で、生成物とその利用については利用者側が責任を負うと明記しています。

日本でも、

  • 著作権
  • 肖像権
  • パブリシティ権
  • 商標
  • 個人情報
  • 不正競争

などを考える必要があります。

文化庁も生成AIと著作権について、生成・利用段階では既存著作物との類似性や依拠性などを個別に検討する必要があるという考え方を公表しています。

特に注意したい使い方

  • 有名アニメキャラクターをそのまま使う
  • 芸能人の顔を無断使用する
  • 他人の声を本人のように再現する
  • 市販映画の映像をReferenceに使用する
  • 他人の広告をそのまま再生成する
  • 第三者の画像を許可なく素材として使用する

ローカルAIにはクラウドサービスほど強い入力制限がない場合があります。

だからこそ、利用者自身が判断する必要があります。

商用利用はできる?

MiniMax H3 Community Licenseには商用利用についての条件もあります。

ライセンス上、商用製品・サービスの年間収益が2,000万米ドルを超える場合は、MiniMaxから事前の書面による許可を取得する必要があります。

また、MiniMax H3を組み込んだ商用製品・サービスでは、UI上に「MiniMax H3」を明示する条件があります。

個人クリエイターや小規模事業者が生成動画を制作する場合と、H3自体を組み込んだ有料AIサービスを提供する場合では条件が異なる可能性があります。

副業や業務利用を考える場合は、公開時点の最新ライセンスを必ず確認してください。

AI Motion Labとしての考え方

例えば、

自宅PCでH3を使ってショート動画を作り、自分のYouTubeへ投稿する

という使い方と、

MiniMax H3を組み込んだ動画生成サービスを他人へ有料提供する

では意味が違います。

後者はライセンス条件や利用者向けの安全対策まで確認する必要があります。

ComfyUIがすでにMiniMax H3へ対応

ローカルAIユーザーにとって大きいのが、ComfyUI対応です。

H3のオープンウェイト公開とほぼ同時に、ComfyUIコミュニティではH3対応ワークフローが公開されました。

利用可能なワークフローには、

  • Text to Video
  • Image to Video
  • First / Last Frame
  • Reference to Video
  • 動画編集

などがあります。

公式Hugging Faceモデルカードでも、推奨推論環境の一つとしてComfyUIが記載されています。

日本の個人ユーザーにはComfyUIが重要

SGLangを使ったMiniMax公式のデプロイ例では4GPU構成が掲載されています。

これは一般家庭には現実的ではありません。

一方、ComfyUIでは、

  • 量子化モデル
  • CPUオフロード
  • VRAM管理
  • キャッシュ
  • 推論最適化

などによって、一般向けGPUでも動かす試みが進んでいます。

普通のゲーミングPCでも動く?

ここは「動く」と「快適」を分ける必要があります。

MiniMaxの公式モデルは33B規模で、BF16のままでは非常に重いモデルです。

しかし、コミュニティではすでに軽量化・量子化した構成が試されています。

コミュニティ報告例

ComfyUI開発コミュニティの検証では、

  • RTX 3060
  • VRAM 12GB
  • システムRAM 32GB
  • NVMe SSD

という構成で、864×480・約5秒の動画を約9分で生成できたという報告があります。

別の報告では、RTX 5090で5秒・約0.4MPの生成が標準状態で約75秒、各種最適化後は約30~40秒程度まで短縮されています。

これらはコミュニティ測定であり、公式保証ではありません。

しかし、

MiniMax H3はデータセンター専用で、家庭のGPUでは絶対に動かない

という状況ではなくなりつつあります。

AI Motion Labの目安

PC環境H3ローカル利用
GPUなし現実的ではない
VRAM 8GB強い最適化が必要
VRAM 12GB低解像度・短時間なら実験候補
VRAM 16GBローカル検証候補
VRAM 24GBかなり試しやすい
48GB以上本格的な検証向き

これは現時点のコミュニティ情報をもとにした目安であり、今後ComfyUIや量子化モデルの改善によって必要スペックは下がる可能性があります。

公開からまだ数日。ローカルAIはここから最適化が一気に進む。今の必要スペックだけで将来を判断するのは早い

日本にとって面白い理由は「ローカルAI動画」が現実になってきたこと

これまでローカルAIというと、

  • Stable Diffusion
  • Flux
  • ローカルLLM
  • 音声生成

などが中心でした。

動画生成は必要VRAMや計算量が大きく、クラウドサービスが主流でした。

MiniMax H3の登場によって、

高品質な動画+音声生成モデルを自宅PCへ置く

という選択肢が、現実的な方向へ進み始めています。

日本の副業では何に使える?

1.YouTube Shorts

キャラクター、背景、セリフ、効果音をまとめて生成。

2.Instagram Reels

縦長9:16にも対応するため、SNS向け動画を作りやすいです。H3は21:9、16:9、4:3、1:1、3:4、9:16など幅広い比率へ対応しています。

3.商品紹介

商品の画像をReferenceとして、広告用動画の試作を作る。

4.ブログのSNS展開

ブログ記事から15秒の解説動画を作る。

5.AIキャラクター

オリジナルキャラクター画像+日本語音声+動作を組み合わせる。

6.企業向けプロトタイプ

本番広告を撮影する前に、

こんな映像になります

というイメージ動画を短時間で制作する。

特に広告、EC、ブランド、ゲーム、製品デザインは、MiniMax自身もH3の主要用途として挙げています。

日本企業にも影響する?

可能性はあります。

経済産業省が2026年3月に公開したAI事業者ガイドライン第1.2版では、AI開発者・提供者・利用者それぞれについて、安全性、公平性、プライバシー、セキュリティ、透明性などを考慮したAI利用が求められています。

H3を企業がローカル運用できれば、

  • 素材をクラウドAIへ送らない
  • 社内GPUで試作する
  • 独自ワークフローを作る
  • 自社向けに調整する

といった選択肢が生まれます。

ただし、

ローカルだから企業情報を何でも入力してよい

わけではありません。

社内ルール、ライセンス、著作権、情報管理を含めて運用する必要があります。

「日本が有利」というより「今、日本から試せる」

今回のニュースを、

日本だけがMiniMax H3を自由に使える!

と表現するのは言いすぎです。

しかし、

米国・EU・英国・韓国ではオープンウェイト利用に追加ライセンスが必要なのに対し、日本は現在のCommunity LicenseのApplicable Territoryに含まれている

のは事実です。

そして、

  • 日本語音声へ正式対応
  • ComfyUI対応
  • モデルウェイト公開
  • 商用利用への道もある

という条件がそろっています。

日本のAIクリエイターにとっては、かなり面白いタイミングです。

結論:MiniMax H3は日本のローカルAI動画にとって重要なモデルになるかもしれない

MiniMax H3は、高性能な動画生成AIが登場したというだけのニュースではありません。

重要なのは、

モデルウェイトが公開され、自分のPCで動画+音声生成を試せるようになった

ことです。

さらに日本では、現在のCommunity License上、オープンウェイト版を利用できる地域に含まれています。

日本語音声も公式にサポートされています。

そしてComfyUIもすでに対応しています。

一方で、

  • ローカル版は現時点でH3-Base中心
  • 完全な公式2Kワークフローはまだローカルだけでは完結しない
  • モデルは非常に重い
  • 商用利用にはライセンス条件がある
  • 著作権や肖像権は利用者が確認する必要がある

という注意点もあります。

これは“誰でもノートPCで無料動画生成”というニュースじゃない。でも、これまでクラウドに閉じていた高性能動画AIが、自宅GPUへ降りてきたことが重要

しかも日本語で話せて、日本はオープンウェイトを試せる地域。ショート動画を作っている人にはかなり気になるね

MiniMax H3は、日本のローカルAI動画制作を一気に広げるモデルになるのか。

公開されたばかりの今は、まだ答えは出ていません。

しかし、2026年後半に注目しておきたいローカル動画生成AIの一つであることは間違いなさそうです。

この記事が気に入ったら
フォローしてね!

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!

この記事を書いた人

AI Motion Lab編集部のローカルLLM・技術担当。Ollama、LM Studio、llama.cpp、ComfyUIなど、自宅のパソコンでAIを動かす方法を解説します。プライバシー、必要なPC性能、導入手順まで実践的に検証します。

目次