MiniMax H3でalibaba-paiの8step LoRAを使ってみました

Xを見ると興味深いMiniMax H3情報がたくさんあります

新しい8step LoRA

 Xで見つけた下記のポストで発見しました。動画生成が高速化できそうなので試してみました。

鈴木憂一 | Highdrama on Twitter / X

まずは下記のWebサイトからMiniMax-H3-FL2VA-Acc-8Step.safetensorsをダウンロードします。このファイルは下の拡張機能をインストールした後にComfyUI/models/pdd_accフォルダの中に入れます。通常のLoRAとは取り扱いが異なるようです。

alibaba-pai/MiniMax-H3-Acc-LoRAs · Hugging Face

次に下記のWebサイトからComfyUI-MiniMax-H3-PDD-Accという拡張機能をインストールします。

GitHub - Jalen-Brunson/ComfyUI-MiniMax-H3-PDD-Acc at 83353308bc14dc49b2d82e263a1cafb94169b849

ノードの接続については上記のWebサイトのサンプルのワークフローが参考になりました。

  • example_workflows/pdd_acc_t2v_basic.json
シンプルな8stepsのワークフローです。追加するノードもMax H3 PDD Acc LoRA (Apply)ノードだけです。
  • example_workflows/pdd_acc_t2v_warmup_split.json

こちらはKサンプラーが2段階になっているワークフローです。

生成時間をチェック

 480x704ピクセルの5秒動画の生成時間で現在の設定からどのくらい高速化するかチェックしてみました。

(現在の設定)8steps LoRAはminimax_h3_turbo_4step_ema_ckpt850を使っています。1回目 156秒 / 2回目 137秒でした。

(MiniMax-H3-FL2VA-Acc-8Step)1回目 153秒 / 2回目 135秒でした。生成時間はほとんど同じだったのでちょっとがっかりだったのですが,サンプラーをeulerに変更したところ,1回目 132秒 / 2回目 105秒と20秒以上高速化されました。
シンプルワークフローもKサンプラー2段階ワークフローも概ね110秒台で生成できました。2分を切ったことに驚きました。

映像は問題なし,音声が…

 生成された動画を確認したところ,映像は現在の設定と大きく変わらない印象でしたが,音声は今ひとつな感じでした。(私の環境だけかもしれません)
20秒の高速化は捨てがたいので何とかして解決したいですが,まだWeb上に使用例が少ない状態なので…と書いていたらXで下記のポストを見つけました。

Photogenic Weekend on Twitter / X

公式でサポートされるので,うまくいけば解決できるかもと期待しています。

この記事へのコメント

コメントはまだありません。

コメントを送る

必須
 
※ メールアドレスは公開されません
任意
必須
Loading...  画像の文字を入力してください
9
10
11
12
13
14
15
16