# Seedance 2.5とMiniMax H3比較：尺と料金で選ぶ

> 15秒超の一続きのシーンや1080pならSeedance 2.5、15秒以内の音付きカットや2KならMiniMax H3、速さ優先ならH3-Max。公式定価で生成費も計算できます。

- Source: https://www.aifreeapi.com/ja/posts/seedance-2-5-vs-minimax-h3
- Language: ja
- Published: 2026-08-26
- Updated: 2026-09-23
- Publisher: AI Free API (https://www.aifreeapi.com)

2026年9月23日時点では、どちらを先に試すかはカットの条件でほぼ決まります。画質は、Arenaのブラインド投票ではテキストから動画でほぼ互角、画像から動画でH3がやや上という結果で、どちらかが全面的に優れているわけではありません。

| 納品したいもの | 先に試すモデル | 理由 |
|---|---|---|
| 15秒を超える一続きのシーン（最大30秒） | Seedance 2.5 | 1回で4〜30秒を生成できる。H3は15秒が上限なので、つなぎ目ができる |
| 1080pで納品するカット | Seedance 2.5 | ModelArkでは1080p（10-bit）を出力する。H3の選択肢は768Pか2K |
| 画像・動画・音声の参照が多い、既存動画の編集や延長 | Seedance 2.5 | 参照素材は最大50点。編集と延長もAPIで指定できる |
| 15秒以内の音付きカットを2Kで納品 | MiniMax H3 | 2Kでも1秒$0.13。768Pで確認してから2Kに作り直す方法もある |
| 絵コンテ確認や案出しなど、試行回数と待ち時間を優先 | MiniMax H3-Max | 480Pなら1秒$0.05。高速化向けの派生モデルで、2Kはない |
| 自前のGPUで動かしたい | MiniMax H3（H3-Base） | 公開ウェイトがあるのは768pのBaseだけ |

料金はすべてBytePlus ModelArkとMiniMax APIの公式定価（USD）です。ネット上には「Seedance 2.5は1080p非対応」「10秒で$4.62」「H3は4K対応」といった情報もありますが、いずれも別の提供経路の数字です（後述）。

## 公式APIの仕様：Seedance 2.5は4〜30秒、H3は4〜15秒

Seedance 2.5の公式APIは[BytePlus ModelArkのドキュメント](https://docs.byteplus.com/en/docs/ModelArk/2607688)で、H3とH3-Maxは[MiniMaxの動画生成ガイド](https://platform.minimax.io/docs/guides/video-generation)で仕様が公開されています。

| 項目 | Seedance 2.5 | MiniMax-H3 | MiniMax-H3-Max |
|---|---|---|---|
| 公式の提供先 | BytePlus ModelArk（`dreamina-seedance-2-5-260628`） | MiniMax API（従量課金のみ） | MiniMax API（従量課金のみ） |
| 1回の尺 | 4〜30秒 | 4〜15秒（整数） | 5〜15秒（整数） |
| 解像度 | 480p・720p（8-bit）、1080p（10-bit） | 768P、2K | 480P、768P |
| 参照素材 | 最大50点（画像30・動画10・音声10）。音声だけの参照も可 | 画像9枚、動画3本、音声3本まで。動画と音声はそれぞれ合計15秒まで。混在は合計12ファイルまで | 参照生成に対応（入力条件はH3と同じ表で案内） |
| 主な生成方法 | テキスト、始端・終端フレーム、参照生成、編集、延長 | テキスト、始端・終端フレーム、参照生成 | テキスト、始端・終端フレーム、参照生成 |
| 日本語の台詞 | 日本語を含む11言語をネイティブサポート | 日本語を含む11言語を安定サポート | 個別の記載なし |
| 課金単位 | 100万トークンあたり | 出力1秒あたり | 出力1秒あたり |

表の数字を読むときに注意したい点が2つあります。

1つ目は解像度です。720pと768P、1080pと2Kは同じ規格ではありません。「H3の2Kのほうが1080pより安い」という比較は成り立ちますが、画素数も後処理も違うので、同じ品質を安く買えるという意味にはなりません。

2つ目は尺です。30秒1本の生成と、15秒2本をつないだ30秒は別物です。2本に分けると、顔・衣装・照明・カメラの速さ・背景音が切れ目で変わる可能性があり、そのつなぎ目を直す作業が発生します。

Seedance 2.5の編集は、`ratio=adaptive`、`duration=-1`、4〜30秒の参照動画という条件付きです。編集結果は入力より最大0.4秒短くなることがあります。H3はモデルカード上、24FPS・32kHzステレオの音声を映像と同時に生成します。

利用開始の条件も違います。ModelArkでSeedance 2.5を有効にするには、残高$30超、$30以上のAI Savings Plan、Seedance 2.5のリソースパックのいずれかが必要と案内されています。ただし同じページの準備手順には「リソースパックを購入していないと有効化できない」とも書かれているので、有効化画面の表示で確認してください。MiniMaxのH3とH3-Maxは従量課金APIだけで使え、[動画パッケージはH3に対応していません](https://platform.minimax.io/docs/guides/pricing-video)。日本は[BytePlus Model Serviceの提供国リスト](https://docs.byteplus.com/en/docs/ModelArk/availability)に含まれていますが、実際に使えるかどうかは購入時点で決まるとされています。[MiniMaxの利用規約](https://platform.minimax.io/protocol/terms-of-service)が除外しているのは包括的な制裁対象の国・地域だけで、支払いはStripe経由です。

## 画質の比較：Arenaのブラインド投票ではほぼ互角

画質については、モデル名を伏せて2本の動画を見比べる[Arena](https://arena.ai/leaderboard/text-to-video)の投票結果が参考になります。2026年9月22日時点の順位表では次のとおりです（Seedance 2.5は720p版での参加）。

| 部門 | Seedance 2.5 | MiniMax H3 | 直接対戦の勝率 |
|---|---|---|---|
| テキストから動画 | 1474±9（7位） | 1460±9（8位） | 251戦でSeedance 2.5が52.6% |
| [画像から動画](https://arena.ai/leaderboard/image-to-video) | 1477±7（4位） | 1495±5（1位） | 620戦でH3が52.4% |

テキストから動画はスコアの幅が重なっており、ほぼ互角です。画像から動画は幅が重ならず、H3が上位です。商品画像やキービジュアルを動かすカットが中心なら、H3を先に試す理由になります。一方、2モデルの直接対戦はどちらも勝率52%台で、対戦数から見て誤差の範囲（251戦で約±6ポイント、620戦で約±4ポイント）に収まります。

[Artificial Analysis](https://artificialanalysis.ai/video/leaderboard/text-to-video)の音声付き部門では、H3-MaxがH3より上位です（テキストから動画1227対1220、画像から動画1195対1181）。Seedance 2.5は2026年9月23日時点で掲載されていません。

どちらも一般的なプロンプトに対する好みの投票で、自分の案件のカットが納品基準を満たすかとは別の指標です。順位は投票が増えると変わります。

## 1カットの生成費を公式定価で計算する

### Seedance 2.5（BytePlus ModelArk）

[ModelArkの料金ページ](https://docs.byteplus.com/en/docs/ModelArk/1099320)では、Seedance 2.5はトークン課金です。

| 出力解像度 | 入力動画なし | 入力動画あり |
|---|---|---|
| 480p・720p | $10.70 / 100万トークン | $6.40 / 100万トークン |
| 1080p | $11.70 / 100万トークン | $7.00 / 100万トークン |

トークン数の目安は次の式で求めます。

トークン数 ≈（入力動画の秒数＋出力の秒数）× 幅 × 高さ × fps ÷ 1024

16:9、24fps、入力動画なしで計算すると、720p（1280×720）10秒は216,000トークンで約$2.31、1080p（1920×1080）10秒は486,000トークンで約$5.69です。同じ式で5秒を計算すると720pが$1.156、1080pが$2.843になり、料金ページの公式例と一致します。

| 尺 | 480p | 720p | 1080p |
|---|---|---|---|
| 5秒 | $0.514（公式例） | $1.156（公式例） | $2.843（公式例） |
| 10秒 | 約$1.03 | 約$2.31 | 約$5.69 |
| 15秒 | ― | 約$3.47 | 約$8.53 |
| 30秒 | ― | 約$6.93 | 約$17.06 |

条件を変えると金額も変わります。

- 16:9以外の比率では画素数が変わるので、幅と高さを入れ替えて計算し直します。
- 入力動画を使う編集や延長では単価が下がる一方、入力動画の秒数も加算されます。入力動画ありのタスクには最低消費量もあります。公式例では720p・出力5秒で$1.244〜$4.838です。
- 課金されるのは生成に成功した動画だけで、審査などで失敗した分はかかりません。成功したものの使えなかった動画は課金されます。
- 実際の請求は、APIが返す`usage.completion_tokens`で決まります。

長いカットの費用を抑えるにはDraftモードが使えます。`draft=true`で作る480pのプレビューは、通常の480pと同じ料金です。内容を確認してから同じ設定で最終版を作れますが、Draftから作る最終版は現時点で1080pのみ、DraftのタスクIDの有効期間は7日です。プレビューと最終版で2回課金されるので、10秒なら約$1.03＋約$5.69＝約$6.72になります。1080pで何度も作り直すより安く済む場合に使います。

### MiniMax H3とH3-Max

MiniMaxは[従量課金の料金ページ](https://platform.minimax.io/docs/guides/pricing-paygo)で1秒あたりの定価を出しています。

| モデル | 解像度 | 1秒あたり | 10秒 | 15秒 |
|---|---|---|---|---|
| MiniMax-H3 | 768P | $0.08 | $0.80 | $1.20 |
| MiniMax-H3 | 2K | $0.13 | $1.30 | $1.95 |
| MiniMax-H3-Max | 480P | $0.05 | $0.50 | $0.75 |
| MiniMax-H3-Max | 768P | $0.08 | $0.80 | $1.20 |

出力のほかに、入力素材にも料金がかかります。

- H3：音声は無料。画像は5枚まで無料で、6枚目から1枚$0.04。入力動画は入力の秒数に対して、2Kなら1秒$0.13、768Pなら$0.08。
- H3-Max：音声は無料。画像は2枚まで無料で、3枚目から1枚$0.074。入力動画は480Pで1秒$0.0553、768Pで$0.143。

H3には、生成済みの768P動画を2Kに作り直すRegeneration（`MiniMax-H3-Regeneration`）もあります。料金は出力1秒あたり$0.05ですが、元の768Pタスクで使った入力素材が再度課金されます（画像は5枚まで無料、以降1枚$0.025、動画は元の入力秒数×$0.05）。

10秒1本だけなら、768Pの$0.80＋作り直しの$0.50で$1.30となり、最初から2Kで作るのと同じです。差が出るのは何度も試すときです。3回試して1本を採用する場合、すべて2Kで作ると$3.90、768Pで3回試してから採用した1本だけを2Kにすると$2.40＋$0.50＝$2.90（入力素材の再課金を除く）になります。公式ドキュメントでRegenerationの対象として案内されているのはMiniMax-H3の768P出力で、H3-Maxの出力が対象になるかは記載がありません。

### 30秒のシーンを作る場合

30秒の一続きのシーンでは、生成費の差がはっきり出ます。

| 作り方 | 生成費（定価・入力素材なし） |
|---|---|
| Seedance 2.5、720p、30秒を1本 | 約$6.93 |
| Seedance 2.5、1080p、30秒を1本 | 約$17.06 |
| H3、2K、15秒を2本 | $3.90 |
| H3、768P、15秒を2本 | $2.40 |

![30秒のシーンをSeedance 2.5で1本作る場合とMiniMax H3の15秒2本をつなぐ場合の生成費を横棒で比べ、H3側につなぎ目を示した図](https://www.aifreeapi.com/posts/ja/seedance-2-5-vs-minimax-h3/img/thirty-second-scene-cost.webp)

生成費だけならH3が安く見えますが、これは同じものを買う比較ではありません。H3の2本には切れ目があり、人物や背景、音のつながりを編集で整える作業が加わります。Seedance 2.5の30秒は、途中で手や小道具が崩れると30秒分をまとめて作り直すことになります。どちらの負担が重いかは、シーンの内容と編集体制で決まります。

## ネット上の価格や「4K対応」が食い違う理由

同じモデルでも、提供経路が違えば仕様も単価も変わります。見かける数字がどの経路のものかを確認すれば、食い違いの多くは説明できます。

| よく見かける情報 | 実際の出どころ |
|---|---|
| 「Seedance 2.5は1080p非対応」「720p 10秒で$4.62」 | [BytePlus LASの拡張動画](https://docs.byteplus.com/en/docs/byteplus_las/video_gen_enhanced)という別経路。基本単価1秒$0.303×解像度係数（720pは1.525）で、Seedance 2.5は480pと720pのみ |
| 「Seedance 2.5は10秒で$4.62、1080pなら約$11」 | [fal.aiの再販価格](https://fal.ai/learn/devs/seedance-2-5-vs-minimax-h3)。720pまで1,000トークンあたり$0.0214で、ModelArkの定価のおよそ2倍。なお、fal自身の[モデルページ](https://fal.ai/seedance-2.5)ではfalでの出力は480p・720pとされており、1080pの金額はfalの比較記事にしか出てこない |
| 「H3は4K対応」 | fal.ai上のH3で、768Pのベースを2K・4Kにアップスケールする経路（4Kは1秒$0.16）。MiniMax公式APIには4Kがない |
| 「H3の料金は公表されていない」 | 現在はMiniMaxの従量課金ページにH3とH3-Maxの定価が載っている |

![Seedance 2.5の720p 10秒の料金をModelArk、BytePlus LAS、fal.aiで比べ、MiniMax H3の出力解像度を公式APIとfal.aiで比べた図](https://www.aifreeapi.com/posts/ja/seedance-2-5-vs-minimax-h3/img/route-price-map.webp)

ModelArkのSeedance 2.5は1080pに対応し、720p 10秒の定価は約$2.31です。LASやfal.aiの数字を使うと、Seedance 2.5の費用をおよそ2倍に見積もることになります。逆に、fal.aiやLASを実際に使うなら、その経路の価格で計算してください。比べるときは、経路・通貨・尺・解像度を揃えてください。

## 秒単価だけでは「使えるカット1本」の費用は出ない

秒単価の比較で決めると、あとで予算がずれます。使えるカット1本の費用は、おおよそ次のように考えます。

使えるカット1本の費用 ≈ 1回の生成費 × 採用までの試行回数 ＋ 2K化や延長などの追加生成 ＋ つなぎや修正の作業時間

試行回数は素材と要求によって変わるので、固定の数字はありません。下の表は、10秒のカットを1回・3回・5回で採用できた場合の生成費です（上の表の丸めた金額から計算）。

| 作り方（10秒） | 1回で採用 | 3回で採用 | 5回で採用 |
|---|---|---|---|
| Seedance 2.5、1080p | $5.69 | $17.07 | $28.45 |
| Seedance 2.5、720p | $2.31 | $6.93 | $11.55 |
| H3、768Pで試して採用分だけ2K | $1.30 | $2.90 | $4.50 |
| H3-Max、768P | $0.80 | $2.40 | $4.00 |

たとえば、Seedance 2.5の1080pが1回で使えて、H3では5回かかるとしても、生成費はH3のほうが安く収まります。一方で、30秒のシーンをH3の2本つなぎで作り、つなぎ目の修正に編集者が1時間かかるなら、その人件費が生成費の差を上回ることもあります。表の数字に、自分の現場の試行回数と作業時間を当てはめてください。

待ち時間も判断材料になります。[Kie.aiが紹介したAskVeniceのテスト](https://kie.ai/blog/minimax-h3-max-vs-seedance-2-5)では、同じプロンプトでH3-Maxは768p・15秒を18秒、Seedance 2.5は1080p・15秒を4分56秒で生成しました。解像度が違い、1回だけの結果なので品質や一般的な速度の比較にはなりませんが、何十回も試す案出しの段階では、待ち時間の差がそのまま作業量の差になります。

## MiniMax H3のうちローカルで動かせるのはH3-Baseだけ

H3には公開ウェイトがありますが、ローカルで動かせるのはシステムの一部です。[H3のモデルカード](https://huggingface.co/MiniMaxAI/MiniMax-H3)によると、H3は3つの要素で構成されています。

| 構成要素 | 役割 | ローカル実行 |
|---|---|---|
| H3-Context-IR | 複雑な入力指示を整理して、H3が扱いやすい形に変換する | 不可（APIのみ） |
| H3-Base | 768pの映像と音声を生成する（FL2VAとRef2VAのチェックポイント） | 可（公開ウェイト） |
| H3-Regenerate-2K | 768pの結果と元の入力から2Kで作り直す | 不可（APIのみ。公開は「準備ができ次第」） |

モデルカードはContext-IRを最終品質に大きく影響する要素と位置づけ、パイプラインに組み込むか、Prompting Guidanceに沿って自前の前処理を作るよう強く勧めています。ローカルのBaseだけで得られるのは768pで、公式APIと同じ品質や2Kは得られません。2Kまで再現したい場合は、ローカルのBaseにContext-IRとRegenerate-2KのAPIを組み合わせる「Full 2K Workflow」が案内されています。

ローカルでの動かし方は、[MiniMaxのローカル実行ガイド](https://platform.minimax.io/docs/guides/local-deploy-h3)に2つの方法があります。

- ComfyUI：バージョン0.30.0以降でT2V・I2V・R2Vのテンプレートが用意されています。使うのはComfy-Orgが変換した枝刈り・量子化版（INT8やNVFP4）のウェイトで、公式チェックポイントとは出力品質やメモリ使用量が異なることがあります。最低限必要なGPUメモリは公開されていないので、手元の環境で試すしかありません。テンプレートによっては、少ないステップで生成するためのLoRA（FL2Vの8ステップ版、Ref2Vの4ステップ版）を使います。
- SGLang：HTTPのAPIとして提供する方法です。ガイドの検証構成はNVIDIA B200を8基積んだ1ノードで、モデルカードのコマンド例も4GPUです。

H3のモデル本体は33Bパラメータで、微調整を含む開発向けに完全なウェイトが公開されています。ただし、ローカルで動かす費用はゼロではありません。GPUの購入やレンタル、保存領域、運用の手間がかかります。

### 日本でH3を使うときのライセンス

公開ウェイトは[MiniMax H3 Community License](https://huggingface.co/MiniMaxAI/MiniMax-H3/blob/main/LICENSE)（2026年8月2日付）で提供されており、ApacheやMITのような一般的なオープンソースライセンスではありません。

- 除外地域はEU、英国、韓国、米国です。日本は除外地域に含まれていません。
- ライセンス本文では、除外地域でのH3の出力の利用・複製・配布・表示も認められていません。ウェイトを自分で動かして作った動画を除外地域向けに配信する案件では、条文の確認が必要です。
- 年間売上が2,000万ドルを超える商用製品・サービスでは、事前に書面での許可が必要です。
- 地域の制限はオープンウェイトの展開が対象です。MiniMax公式の[ライセンスQ&A](https://huggingface.co/MiniMaxAI/MiniMax-H3/blob/main/docs/QA-about-License.md)は、H3のAPIは世界中で利用でき、制限はオープンウェイトに限った一時的なものだと明言しています。APIを使う場合はMiniMaxの利用規約に従います。

ここでの説明は法的助言ではありません。商用で使う前に、最新の条文を法務担当と確認してください。

## 同じ条件の小さなテストで最終判断する

候補を絞ったら、少ない本数のテストで決めます。比べるのは同じプロンプトではなく、同じ納品条件です。プロンプトの書き方や参照素材の指定方法はモデルごとに違うので、文面はそれぞれに合わせて構いません。

1. 実際の案件に近いカットを3本用意します。たとえば、15秒を超えて場面が2回変わる一続きのシーン、小さな文字や手の動きが入る商品カット、日本語の短い台詞がある顔の寄りです。
2. 画角、映すべき要素、人物や商品の参照素材、音声の条件、合格の基準を揃えます。参照素材は上限まで入れず、人物・場所・動き・音に1つずつ役割を割り当てます。
3. 各カットで、採用までの試行回数、使える秒数、人物や商品の再現度、指示どおりか、音声の修正量、待ち時間、請求額、手作業の時間を記録します。
4. 記録した試行回数と作業時間を、前の節の計算に当てはめます。

テスト費用の目安は、10秒のカットを3回ずつ作ると、1カットあたりSeedance 2.5の720pで約$6.93、H3の768Pで$2.40です。15秒を超えるシーンは、尺に合わせて前の節の表で見積もってください。1080pや2Kは、採用候補が決まってから試せば抑えられます。日本語の台詞は、商品名の読み方、声の一貫性、口の動きとの一致を必ず聞いて確認してください。

テストの結果は、次のように読みます。

- 15秒を超える連続性や多数の参照が効いて、作り直しの回数も許容範囲なら、Seedance 2.5に決めます。
- 15秒以内のカットで足りて、つなぎの手間を吸収できるなら、H3の768Pで試して採用分を2Kにする流れが安く済みます。
- 案出しや絵コンテの段階だけならH3-Maxで回し、方向が決まってから本番用のモデルに移ります。
- どちらも人物や商品を保てないなら、カットを短く分けるか、ほかのモデルも候補に入れます。

Arenaの順位は多くの人の好みを平均したもので、自分の素材や演出で合格するかどうかは、このテストでしか分かりません。

## よくある質問

### MiniMax H3は4Kに対応していますか？

MiniMax公式のAPIは768Pと2Kまでで、4Kはありません。「4K対応」はfal.ai上で768Pのベースをアップスケールする経路のことです。公式の2Kは、最初から2Kで生成するか、768Pの結果をRegenerationで作り直して得ます。

### H3-MaxはH3の上位版ですか？

位置づけは上位版ではなく、速度を重視した派生モデルです（Artificial Analysisの投票ではH3より上位ですが、2Kには対応していません）。MiniMaxとfal.aiの共同リリースで、fal.aiがH3をもとに高速化向けに追加学習しています。[fal.aiは2026年8月27日に発表](https://blog.fal.ai/introducing-h3-max-by-fal/)し、5秒の動画を約3秒で生成できるとしています。解像度は480Pと768Pだけで2Kはなく、尺は5〜15秒です。768Pの料金はH3と同じ1秒$0.08ですが、無料の参照画像は2枚までです。音声は、fal.aiによればすべての生成に同期した音声が付きます（MiniMaxのドキュメントには明記がありません）。

### Seedance 2.5は本当に1080pで出力できますか？

BytePlus ModelArkのAPIなら、1080p（10-bit）を出力できます。1080p非対応とされているのはBytePlus LASの拡張動画です。使うサービスの仕様表で、Seedance 2.5の解像度欄を確認してください。

### 日本からH3のローカル版を商用で使えますか？

日本はライセンスの除外地域ではないため、ライセンス上は利用できる地域に入ります。ただし、年間売上2,000万ドル超の商用製品では事前の書面許可が必要です。また、除外地域（EU、英国、韓国、米国）では出力の利用や表示も認められていないので、ローカル版で作った動画をそうした地域に向けて配信する案件では条文の確認が欠かせません。地域の制限はオープンウェイトが対象で、MiniMaxのAPIは世界中で利用できます。

## ほかの動画生成モデルと比べる場合

まだ2つに絞れていない場合は、[2026年の動画生成モデル比較：8モデルを制作条件から選ぶ](/ja/posts/ai-video-models-comprehensive-comparison-2025)から候補を選んでください。Seedanceの中で2.5・2.0・Fast・Miniのどれにするか迷っている場合は、[2026年のSeedance動画モデル比較：2.5・2.0・Fast・Miniの選び方](/ja/posts/seedance-video-models-2026)を読んでください。Seedance 2.5をH3以外のモデルと比べるなら、[Seedance 2.5とWan 3.0の選び方：同じ条件で最初の1本を試す](/ja/posts/seedance-2-5-vs-wan-3)と[Seedance 2.5とGemini Omni、先に試すべきはどちらか](/ja/posts/seedance-2-5-vs-gemini-omni)が参考になります。
