MiniMax H3の動画と音声を細かく制御できる「ComfyUI-MiniMaxH3」

30秒でわかる

  • MiniMax H3の動画・音声生成を、ComfyUIで細かく組み立てられる無料の拡張ノード集
  • 省メモリのストリーミング読み込みとBlockSwap(使わない部分を一時的にCPUへ移す仕組み)に対応
  • 文章・画像・動画・音声の参照、最初と最後のフレーム指定、複数カットの絵コンテ編集をまとめて扱える

何が変わった

ComfyUI-MiniMaxH3 ↗は、MiniMax H3で映像と音声を一緒に生成するためのComfyUI拡張です。モデルを必要な分だけ順番に読み込むストリーミングとBlockSwapにより、グラボメモリの負担を抑える構成を選べます。bf16、fp16、fp8、int8、nvfp4など複数の重み形式を自動判定します。文章だけの動画生成に加え、最初・最後のフレーム指定、画像・動画・音声の参照、複数カットを組み立てる絵コンテ、動画と音声の同時デコードまでノードで接続できます。上級者向けにはLoRA(特徴を追加する小型データ)や生成速度を調整する設定も用意されています。

誰に関係する

MiniMax H3の生成手順を細かく調整し、省メモリ設定や絵コンテも使いたいComfyUI利用者に向いています。モデルファイルは別途用意し、MiniMax H3の最新ライセンスに従って利用する必要があります。

公式情報

GitHub(xiaolibai-sys/ComfyUI-MiniMaxH3) ↗