Skip to content
Merged
Show file tree
Hide file tree
Changes from all commits
Commits
File filter

Filter by extension

Filter by extension

Conversations
Failed to load comments.
Loading
Jump to
Jump to file
Failed to load files.
Loading
Diff view
Diff view
12 changes: 8 additions & 4 deletions docs.json
Original file line number Diff line number Diff line change
Expand Up @@ -310,7 +310,8 @@
"tutorials/video/minimax/minimax-h3-native",
"tutorials/video/minimax/minimax-h3-multiframe",
"tutorials/video/minimax/minimax-h3-fun-controlnet",
"tutorials/video/minimax/minimax-h3-prompt-guide"
"tutorials/video/minimax/minimax-h3-prompt-guide",
"tutorials/video/minimax/minimax-h3-fastvideo"
]
},
{
Expand Down Expand Up @@ -3951,7 +3952,8 @@
"zh/tutorials/video/minimax/minimax-h3-native",
"zh/tutorials/video/minimax/minimax-h3-multiframe",
"zh/tutorials/video/minimax/minimax-h3-fun-controlnet",
"zh/tutorials/video/minimax/minimax-h3-prompt-guide"
"zh/tutorials/video/minimax/minimax-h3-prompt-guide",
"zh/tutorials/video/minimax/minimax-h3-fastvideo"
]
},
{
Expand Down Expand Up @@ -7268,7 +7270,8 @@
"ja/tutorials/video/minimax/minimax-h3-native",
"ja/tutorials/video/minimax/minimax-h3-multiframe",
"ja/tutorials/video/minimax/minimax-h3-fun-controlnet",
"ja/tutorials/video/minimax/minimax-h3-prompt-guide"
"ja/tutorials/video/minimax/minimax-h3-prompt-guide",
"ja/tutorials/video/minimax/minimax-h3-fastvideo"
]
},
{
Expand Down Expand Up @@ -10598,7 +10601,8 @@
"ko/tutorials/video/minimax/minimax-h3-native",
"ko/tutorials/video/minimax/minimax-h3-multiframe",
"ko/tutorials/video/minimax/minimax-h3-fun-controlnet",
"ko/tutorials/video/minimax/minimax-h3-prompt-guide"
"ko/tutorials/video/minimax/minimax-h3-prompt-guide",
"ko/tutorials/video/minimax/minimax-h3-fastvideo"
]
},
{
Expand Down
141 changes: 141 additions & 0 deletions ja/tutorials/video/minimax/minimax-h3-fastvideo.mdx
Original file line number Diff line number Diff line change
@@ -0,0 +1,141 @@
---
title: "FastVideo FastH3:ComfyUI ワークフロー例"
description: "FastVideo FastH3 ディスティルドチェックポイントを使い、ComfyUI で 8 サンプリングステップで同期オーディオ付きの MiniMax H3 動画を生成します。テキストから動画、最初と最後のフレームワークフローに対応。"
sidebarTitle: "FastVideo FastH3"
translationSourceHash: e5a337b0
translationFrom: tutorials/video/minimax/minimax-h3-fastvideo.mdx
translationBlockHashes:
"_intro": 096c332e
"Requirements": bcdeb37e
"FastH3 Text to Video": e9a7420a
"FastH3 Image to Video": ec7d82bf
"Model downloads": bc93d525
"Workflow structure notes": 77b7c476
---

[FastVideo FastH3](https://huggingface.co/FastVideo/FastVideo-FastH3-8-Step-V2) は、FastVideo チームが MiniMax H3 を DMD2 で蒸留したチェックポイントで、ベースモデルの完全なスケジュールの代わりに **8 サンプリングステップ**でネイティブ同期オーディオ付きの動画を生成します。H3 のテキストエンコーダー、動画 VAE、オーディオ VAE をそのまま使うため、出力設定はベースモデルと同じままで、サンプリングだけが大幅に短縮されます。

FastH3 プレビューは Nuva Lab と NVIDIA FastGen チームとの共同開発によるものです。蒸留の詳細は [FastH3 発表記事](https://haoailab.com/blogs/fasth3-preview/) を参照してください。ComfyUI に同梱されているのは 8 ステップ V2 チェックポイントで、Comfy-Org が [FastVideo-FastH3-Comfy](https://huggingface.co/FastVideo/FastVideo-FastH3-Comfy) リポジトリで再パッキングしました。

FastH3 は、動きとオーディオの忠実度をいくらか犠牲にして速度を得るモデルです。ドラフト、反復、短時間での仕上げに適しています。最高品質が必要な場合はベースの MiniMax H3 ワークフローを使用してください。

<UpdateReminder/>

<Note>
この蒸留チェックポイントはテキストから動画、最初と最後のフレームによる画像から動画のみに対応しています。Ref2VA(マルチリファレンス条件付け)は蒸留されていません。リファレンスベースの生成にはベースの [MiniMax H3 ワークフロー](/ja/tutorials/video/minimax/minimax-h3-native) を使用してください。
</Note>

## 要件

- ComfyUI 0.36.0 以降
- MiniMax H3 のテキストエンコーダーと VAE(ベースモデルと共通、下記の一覧を参照)

## FastH3 テキストから動画

テキストプロンプトから 8 ステップで同期オーディオ付きの動画を生成します。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_fastvideo_fasth3_t2v.mp4"></video>

{/* TODO: Enable Cloud template when it is available in Comfy Cloud */}
{/*<CardGroup cols={2}>
<Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=video_fastvideo_fasth3_t2v&utm_source=docs&utm_medium=referral&utm_campaign=minimax-h3">
Comfy Cloud で開く
</Card>
</CardGroup>*/}

<CardGroup cols={2}>
<Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_fastvideo_fasth3_t2v.json">
JSON をダウンロード、またはテンプレートライブラリで "FastVideo FastH3: Text to Video" を検索
</Card>
</CardGroup>

### プロンプトのコツ

1. **シーン全体を説明する**: まず全体のシーン(場所、キャラクター、何が起きているか)を述べ、次に時間順のショットに分割します
2. **ショット・カメラ・オーディオ**: ショット、カメラワーク、伴奏オーディオ(セリフ、効果音、音楽)を 1 つのプロンプトブロックで記述します
3. **解像度**: H3 のネイティブキャンバスは短辺 768px、上限は 768x1344 で、解像度は 32 の倍数に丸められます
4. **長さ**: 長さの入力は、24fps におけるモデルの 17 フレーム/ブロック(17k+5)グリッドにスナップされます
5. **ステップ数は 8 で固定**: この蒸留チェックポイントは 8 ステップで学習されています。スケジューラのステップ数を変更すると品質が低下します

プロンプト作成のリソースについては、[プロンプトガイド](/ja/tutorials/video/minimax/minimax-h3-prompt-guide) を参照してください。

## FastH3 画像から動画

静止画を同期オーディオ付きで動かします。最初と最後のフレームの制御にも対応しています。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_fastvideo_fasth3_i2v.mp4"></video>

{/* TODO: Enable Cloud template when it is available in Comfy Cloud */}
{/*<CardGroup cols={2}>
<Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=video_fastvideo_fasth3_i2v&utm_source=docs&utm_medium=referral&utm_campaign=minimax-h3">
Comfy Cloud で開く
</Card>
</CardGroup>*/}

<CardGroup cols={2}>
<Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_fastvideo_fasth3_i2v.json">
JSON をダウンロード、またはテンプレートライブラリで "FastVideo FastH3: Image to Video" を検索
</Card>
</CardGroup>

**入力素材**

このファイルを対応する `LoadImage` ノードにアップロードするか、自分の画像を使用してください:

<CardGroup cols={2}>
<Card title="red_line_barrier.png" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/red_line_barrier.png">
画像から動画ワークフローのサンプル最初のフレーム
</Card>
</CardGroup>

### 最初と最後のフレームモード

`MiniMaxH3ImageToVideo` ノードの `first_frame` と/または `last_frame` に画像を接続すると、2 つのキーフレーム間の動きを生成します。どちらも接続しない場合はテキストから動画になります。

### プロンプトのコツ

1. **動きとオーディオを説明する**: 見た目は画像が担うため、プロンプトは動き、カメラ、伴奏オーディオに集中してください
2. **長さ**: 長さの入力は、24fps におけるモデルの 17 フレーム/ブロック(17k+5)グリッドにスナップされます
3. **ステップ数は 8 で固定**: スケジューラは 8 ステップのままにしてください。チェックポイントはそのスケジュールで蒸留されています

## モデルダウンロード

拡散モデルは FastVideo リポジトリから、テキストエンコーダーと VAE はベースの MiniMax H3 モデルと共通です。

<CardGroup cols={2}>
<Card title="拡散モデル: fastvideo_fasth3_8step_v2_pruned_int8_convrot" icon="download" href="https://huggingface.co/FastVideo/FastVideo-FastH3-Comfy/resolve/main/diffusion_models/fastvideo_fasth3_8step_v2_pruned_int8_convrot.safetensors">
<code>ComfyUI/models/diffusion_models/</code> に配置
</Card>
<Card title="テキストエンコーダー: qwen3vl_32b_minimax_h3_nvfp4_awq" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors">
<code>ComfyUI/models/text_encoders/</code> に配置
</Card>
<Card title="VAE: minimax_h3_video_vae_fp16" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_video_vae_fp16.safetensors">
<code>ComfyUI/models/vae/</code> に配置
</Card>
<Card title="VAE: minimax_h3_audio_vae_fp32" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_audio_vae_fp32.safetensors">
<code>ComfyUI/models/vae/</code> に配置
</Card>
</CardGroup>

### モデルの保存場所

```
ComfyUI/
├── 📂 models/
│ ├── 📂 diffusion_models/
│ │ └── fastvideo_fasth3_8step_v2_pruned_int8_convrot.safetensors
│ ├── 📂 text_encoders/
│ │ └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
│ └── 📂 vae/
│ ├── minimax_h3_video_vae_fp16.safetensors
│ └── minimax_h3_audio_vae_fp32.safetensors
```

## ワークフロー構造のメモ

両方の FastH3 ワークフローは、ベースの H3 構成と以下のノードを共有し、蒸留固有の設定が加わっています:

- **BlockSparseAttention**: Video Sparse Attention(VSA)を `keep_percent` 10、スケジュールの 20% から実行し、品質を保ちながら注意計算のコストを削減します
- **MiniMaxH3SigmaShift**: 蒸留スケジュールに合わせた H3 シグマシフト(動画 10、オーディオ 3)を適用します
- **ComfyMathExpression**: 長さの入力を、24fps の 17k+5 グリッド上の有効なフレーム `length` に変換します
- **サンプラー**: `res_multistep` サンプラー、`simple` スケジューラ、8 ステップ
Loading
Loading