ブログ一覧

HunyuanVideoの使い方・特徴(2026)|プロンプトの勘所とブラウザで試す手順

2026年9月23日11 分で読める

HunyuanVideoの使い方・特徴(2026)

TL;DR — HunyuanVideo は、テキストから短い動画を作る text-to-video 系のオープンソース動画モデルです(2026年時点)。特徴はプロンプトへの素直な追従と動きの自然さで、シネマ寄りの表現から日常的なワンカットまで扱えます。使いこなすコツは、画像プロンプトの感覚を捨てて「主体・動作・カメラ・速度」を短く絞ること。ローカルに ComfyUI を構築しなくても、ComfyStudio の official_hunyuan_t2v_v1 ワークフローならブラウザだけで試せます。ただしコスト面は正直に書いておくと、HunyuanVideo は1回の生成で660クレジット(1クレジット=1円なので660円)で、新規登録でもらえる無料枠100クレジットでは足りません。無料枠のまま動画を1本試したい場合は、97クレジットで回せる official_ltx_t2v_v1 から始めてください。

「HunyuanVideo ってどんな動画モデル?」「プロンプトはどう書けばいい?」「ComfyUI を入れないと試せない?」——この記事は、HunyuanVideo を2026年時点の事実ベースで中立に整理し、プロンプトの勘所と、ブラウザだけで試す手順までをまとめたものです。特定モデルを持ち上げたり他社を貶めたりはせず、住み分けが分かる形で解説します。

結論:HunyuanVideo は「プロンプト追従の素直さ」が持ち味の text-to-video

先に結論です。HunyuanVideo は Tencent が公開したオープンソースの動画生成モデルで、テキストのプロンプトから短い動画クリップを生成する text-to-video を主な用途とします(2026年時点)。数ある動画モデルの中での立ち位置は、ざっくり次のように捉えると分かりやすいです。

  • プロンプトに素直:指示した動作・被写体を比較的そのまま反映しやすい傾向。
  • 動きが自然:人物の所作やカメラの移動が破綻しにくく、シネマ寄りの絵作りに向く。
  • オープンソース:重みが公開されており、ComfyUI などのワークフローに組み込みやすい。

一方で、動画生成は画像生成よりも計算コストが高く、ローカルで動かすには相応の VRAM とセットアップが要ります。ここが「入れてみたいけど手が止まる」最大の理由です。だからこそ、まずはクラウドで挙動を掴んでから判断するのが現実的です。

無料のまま、動画を 1 本つくるカード不要・100クレジット無料
無料で動画をつくる

HunyuanVideo の特徴(2026年時点)

動画モデルは更新が速いので、ここでは「バージョンに左右されない基本的な性格」を中心に押さえます。

  • text-to-video が主戦場:静止画を用意しなくても、文章だけで動くクリップが作れます。1枚絵を動かす image-to-video とは書き方が変わります(後述)。
  • プロンプト追従の良さ:動作・シーン・雰囲気の指示が反映されやすいため、狙った絵に寄せやすい。抽象語より具体語が効きます。
  • 自然なモーション:人物の振り向き・歩行、髪や布の揺れといった細かい動きが比較的安定します。
  • 短尺前提:多くの動画モデルと同様、数秒のクリップ生成が基本。長尺は複数本をつないで作るのが定石です。

「HunyuanVideo 1.5」のような新しいバージョン名を見かけることがありますが、バージョンが上がっても基本の書き方(動きを絞る・カメラを具体的に)は変わりません。ComfyStudio で使えるワークフローは順次アップデートされるため、実際に使えるモデル名・バージョンは生成画面で確認してください。

HunyuanVideo のプロンプトの勘所

HunyuanVideo で失敗する典型は、画像生成と同じ感覚で書いてしまうことです。画像プロンプトは「見た目」を細かく指定しますが、動画プロンプトは「どう動くか」を指定します。次の4要素に絞ると破綻しにくくなります。

  1. 主体(誰・何が) — 「制服の少女が」「一台の車が」など、動く対象を明示。
  2. 動作(どう動く) — 動きは1〜2個まで。「振り返って微笑む」のような一連の動作はOK、「踊って走って手を振る」は破綻の元。
  3. カメラワーク — 「ゆっくりズームイン」「時計回りにオービット」など映画用語が効きます。曖昧な「ダイナミックに」は解釈されません。
  4. 速度・質感 — 「スローモーション」「シネマティック」など、空気感を決める形容詞を1つだけ。

text-to-video では外見も文章で決める必要があるため、image-to-video より少し長め(目安100〜150語)になります。ただし動きの指示は詰め込まず、主要な動作1つに集中させるのがコツです。

プロンプト例(コピペ用の型)

穴埋め式のテンプレートです。動画モデルは英語キャプションで学習されていることが多く、動きの指示は英語のほうが精度が出やすい傾向があります。

[主体の外見と場所] が [動作] する。カメラは [カメラワーク]。[速度・質感]。

  • A young woman in a school uniform stands by a window and slowly turns toward the camera, her hair swaying gently. Slow zoom in, cinematic, soft afternoon light. → 制服の女性が窓辺に立ち、ゆっくりこちらを向く。髪がそっと揺れる。ゆっくりズームイン、シネマティック、柔らかな午後の光
  • A lone car drives along a coastal road at sunset, camera tracking from the side, warm golden light, smooth motion. → 夕暮れの海沿いの道を一台の車が走る。カメラが横から追従、暖かい黄金の光、滑らかな動き

ネガティブ指定が使えるワークフローなら「歪み・余分な指・急な変形・チラつき」を弾いておくと、一貫性を保ちやすくなります。

他の動画モデルとの住み分け(2026年時点)

HunyuanVideo だけが正解ではありません。用途に応じて使い分けるのが賢い選び方です。ComfyStudio で扱える主な動画モデルの性格を、中立に並べます(下の表は傾向の整理であり、優劣や順位を保証するものではありません)。

モデル(2026年時点)主な用途書き方の傾向
HunyuanVideotext-to-video、自然なモーション主体+動作+カメラを具体的に。プロンプト追従が素直
Wan 2.2image-to-video、穏やかな動き1枚絵を動かす用途。動きを1つに絞る
Klingシネマ表現、大きな動きカメラワーク(ドリー・オービット)を具体的に
LTXまず動きを確認する用途動画ワークフローの中では最も安い。無料枠でも回せる

生成コストの目安(2026年時点・5秒の生成で確保されるクレジット数)は次のとおりです。official_ltx_t2v_v1 30 / official_seedance_1_pro_fast_t2v_v1 33 / official_wan22_i2v_v1 45 / official_hunyuan_t2v_v1 112 / official_kling_3_0_t2v_v1 126。1クレジット=1円なので、そのまま円換算になります。尺を変えると秒数に比例します(official_wan22_i2v_v1 だけは尺によらず定額)。HunyuanVideo は5秒だと無料枠100クレジットを超えますが、尺を4秒(90クレジット)以下にすれば無料枠に収まります。

たとえば「手持ちの1枚絵を動かしたい」なら image-to-video が得意な Wan 2.2、「テキストからワンカット作りたい」なら HunyuanVideo、という住み分けです。モデル比較をもう少し深掘りしたいときは AI 動画モデル比較、Kling 単体の使い方は Klingの使い方ガイド が参考になります。プロンプトの書き方そのものを固めたいなら AI 動画プロンプトのコツ もあわせてどうぞ。

ComfyStudio の official_hunyuan_t2v_v1 でブラウザから試す手順

HunyuanVideo をローカルで動かすには VRAM の確保・環境構築・モデル管理といったハードルがあり、ここで止まる人が少なくありません。ComfyStudio は ComfyUI のワークフローをクラウドで実行する日本発の AI 生成 SaaS で、手元の GPU を問わずブラウザだけで HunyuanVideo の text-to-video を試せます。インストール不要・GPU不要で、料金は1クレジット = 1円の従量課金です。

  1. 無料登録する — 登録だけで100クレジットが付与されます(クレジットカード不要)。HunyuanVideo は5秒で112クレジットなので、無料枠のまま回すなら尺を4秒(90クレジット)以下にします。もっと安く動画の感触を掴むなら、5秒30クレジットの official_ltx_t2v_v1 もあります。
  2. official_hunyuan_t2v_v1 を開く — HunyuanVideo の text-to-video ワークフローを選びます。尺は1〜5秒から選べて、5秒なら112クレジット(=112円)です。
  3. プロンプトを書く — 上の型で「主体・動作・カメラ・速度」を指定。動きは1つに絞る。
  4. コストを確認して生成 — 生成前に画面へ表示される実額を確認してから回します(5秒なら HunyuanVideo は112クレジット、LTX は30クレジット)。
  5. プロンプトだけ書き換えて再生成 — seed を固定して、動作・カメラ・速度を1要素ずつ調整すると当たりを見つけやすいです。

動画は画像生成より原価が高いぶんコストも上がります。参考までに、アニメ調イラストの official_text_v1 は1枚4クレジットで、無料枠100クレジットなら約25枚分です。同じ100クレジットで回せる動画は、5秒の official_ltx_t2v_v1(30クレジット)なら3本、HunyuanVideo なら4秒(90クレジット)で1本、と考えてください。表示額の確認は毎回おすすめします。1クレジット=1円なので、表示額がそのまま円換算になります。

よくある質問(Q&A)

Q. HunyuanVideo は image-to-video(1枚絵を動かす)にも使えますか? A. HunyuanVideo は text-to-video(テキストから動画)が主な用途です(2026年時点)。手持ちの1枚絵を動かしたい場合は、image-to-video が得意な Wan 2.2 などのワークフローが向きます。ComfyStudio では用途に合わせてワークフローを選べるので、生成画面で対応モードを確認してください。

Q. HunyuanVideo 1.5 との違いは何ですか? A. 動画モデルはバージョンが更新され続けており、新しいバージョンほど品質や速度が改善される傾向があります。ただしプロンプトの基本(動きを1〜2個に絞る・カメラを具体的に書く)はバージョンが変わっても共通です。ComfyStudio で実際に使えるバージョンは生成画面に表示されるモデル名で確認してください。

Q. ComfyUI を入れなくても HunyuanVideo を試せますか? A. はい。ComfyStudio のようなクラウド型 SaaS なら、インストールや GPU の用意なしにブラウザだけで HunyuanVideo の text-to-video ワークフロー(official_hunyuan_t2v_v1)を実行できます。HunyuanVideo は5秒の生成で112クレジット(=112円)かかるため、無料登録でもらえる100クレジット(カード不要)で回すなら尺を4秒(90クレジット)以下にしてください。もっと安く動画生成の挙動を掴みたい場合は、5秒30クレジットで回せる official_ltx_t2v_v1 を先に試してください。

まとめ:まずは1本、ブラウザで試してみる

HunyuanVideo は、プロンプト追従の素直さと自然なモーションが持ち味の text-to-video 系オープンソースモデルです(2026年時点)。使いこなすコツは、画像プロンプトの感覚を手放して「主体・動作・カメラ・速度」を短く絞ること。ローカル構築のハードルは、クラウドで挙動を掴んでから判断すれば回避できます。コストはHunyuanVideo が1回660クレジット(=660円)、無料枠100クレジットで回せる動画ワークフローは official_ltx_t2v_v1(97クレジット)だけなので、まず LTX で動画生成の勝手を掴んでから HunyuanVideo に進むのが無駄がありません。

▶ 無料登録して動画生成をブラウザで試す(100クレジット付与・クレジットカード不要/無料枠で回せる official_ltx_t2v_v1 から開始)

Start Free
無料のまま、動画を 1 本つくる

登録だけで 100 クレジット。 この記事で使っている LTX-Video 13B は 30 クレジットなので、 追加の支払いなしで 1 本つくれます。カード登録は不要です。

関連記事