ハッピーホース 1.1 AIビデオジェネレーター
Happy Horse 1.1は、アリババのAIビデオモデルで、ビデオと同期オーディオを1回の処理で同時に生成します。オーディオ処理を別途行う必要も、手動で同期する必要もありません。7言語に対応したネイティブリップシンク、音声的に一致する口の形、シーンごとに最大9つの参照文字、そして21:9の超ワイドを含む9つのアスペクト比に対応しています。Tagshop AI上で最も高性能なオーディオビジュアル生成モデルです。
Happy Horse 1.1 が何を生み出すか見てみましょう
このギャラリーにあるすべての動画は、Tagshop AIのHappy Horse 1.1を使用して生成され、音声は一度の処理で同期されています。
Happy Horse 1.1とは何ですか?
Happy Horse 1.1 is Alibaba's AI video generation model that generates video and synchronized audio together in a single pass, dialogue, sound effects, ambience, and music all in sync with the motion from one generation. It offers native lip-sync across seven languages, English, Mandarin, Cantonese, Japanese, Korean, German, and French, with mouth shapes phonetically matched to each spoken language. Up to nine reference images can be used per generation, with each character called by index in the prompt, enabling consistent multi-character and ensemble scenes. It outputs 720p or 1080p video in clips of 3 to 15 seconds across nine aspect ratios, from vertical 9:16 to ultrawide cinematic 21:9, making it the most versatile audio-visual generation model on Tagshop AI. Available from $14/month with full commercial licensing on all paid plans.
ハッピーホース1.1:技術仕様
Tagshop AIにおけるHappy Horse 1.1生成の正確なパラメータ
開発者
アリババ
世代時間
10~15分
動画再生時間(ネイティブ)
3~15秒(デフォルトは5秒)
動画の長さ(ビデオエージェント)
最大1分
解決
720p(ドラフト)、1080p(配信)
ネイティブオーディオ
はい、音声と映像を一度に生成します
オーディオの種類
会話、効果音、雰囲気、音楽
リップシンク言語
7: 英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語
リップシンク法
言語ごとに音声的に一致する口の形
参考画像
最大9文字まで、文字1~文字9としてインデックス付けされます。
アスペクト比
16:9、9:16、1:1、4:3、3:4、21:9、9:21、5:4、4:5
入力モード
テキストから動画へ、画像から動画へ、参照から動画へ
キャラクターの一貫性
顔、服装、声はどのカットでも一貫している
プロンプトの最大文字数
2,500文字
商用ライセンス
有料プランすべてで商用利用が可能です。
透かし
有料プランはすべて透かしなし
ハッピーホース1.1の理由
Happy Horse 1.1をTagshop AI上で最も優れたオーディオビジュアル生成モデルたらしめる4つの機能

音声と映像。ワンパスで、常に同期。

7つの言語。発音に完璧な口の形。

最大9人のキャラクター。名前で呼ばれます。すべてのショットで一貫性があります。
Happy Horse 1.1 を使って、テキスト、画像、または参照から作成する
Tagshop AI の Happy Horse 1.1 で生成する 3 つの方法と、7 つの言語でのネイティブリップシンク
テキストからビデオへ
シーン、登場人物、セリフ、アクション、カメラワークについて説明してください。プロンプトには、リップシンク用の言語を含めてください。プロンプトは最大2,500文字まで対応しています。このスペースを使って、音響の詳細(環境音、音楽スタイル、効果音)と視覚的な詳細を説明してください。
画像から動画へ
静止画像を最初のフレームとしてアップロードすると、Happy Horse 1.1 がそれを同期音声付きの 1080p 動画にアニメーション化し、画像の元の照明とディテールを保持します。
ビデオへの参照
キャラクターごとに1枚ずつ、最大9枚の参考画像をアップロードしてください。プロンプトでは、提供した順番に合わせて、キャラクター1、キャラクター2などとそれぞれ参照してください。シーンとアクションを説明してください。Happy Horse 1.1では、各キャラクターが常に同じ位置に配置されます。
リップシンク言語
英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語。正確な音声同期のために、プロンプトで言語を指定してください。




ハッピーホース1.1のすぐに使えるプロンプト集
プロンプトをTagshop AIに直接コピーして、音声が同期したビデオを生成します。
Prompt: 「パリのカフェのテーブルでフランス語を話しながら笑っている二人の友人、手持ちカメラ、温かい午後の光、カフェの環境音、顔のクローズアップ、9:16」
Prompt: 「夕暮れ時、屋上ディナーテーブルを囲んで3人の同僚が乾杯。グラスがカチンと鳴り、笑い声と会話が響き、温かい黄金色の光が降り注ぐ。参照画像から文字1、文字2、文字3を使用。16:9」
Prompt: 「ニュースキャスターがスタジオのデスクで夕方のヘッドラインを読み上げる。スタジオ音声は同期済み、プロ仕様の照明、クリアで説得力のある映像、16:9」
Prompt: 「光沢のある床の上でスニーカーが回転し、ヒップホップのビートが回転に合わせてシンクロする。マクロレンズ、高コントラストのスタジオ照明、1:1」
Prompt: 「夕暮れ時の屋上でチェロ奏者が演奏する。壮大なオーケストラの楽曲が生成・同期され、カメラがゆっくりと引いて街のスカイラインが映し出される。21:9」
Prompt: 「ブランドの広報担当者が自信満々に中国語でカメラに向かって話す。スタジオの背景は清潔で、衣装はプロフェッショナルな仕上がり。口の動きも同期しており、参考画像から文字1を使用。9分16秒」
Prompt: 「4人の友人がキッチンカウンターを囲んで一緒に料理をし、英語で自然な会話が交わされる。温かい家庭的な照明、ドキュメンタリー風のスタイル、登場人物1~4は参考資料から引用、16:9」
Prompt: 「夜明けに一人のハイカーが山稜にたどり着く。風の音と鳥のさえずりが聞こえる。ゆっくりとした映画のようなカメラワーク、超ワイドフォーマット、21:9」
Tagshop AIのHappy Horse 1.1を使ってAI動画を作成する方法
プロンプト、画像、または参考資料から、音声が同期された完成ビデオまで。
Happy Horse 1.1で作成できるもの
多言語キャンペーンから多キャラクターのブランドフィルムまで、Happy Horse 1.1はあらゆるオーディオ・ビデオ複合フォーマットに対応します。
多言語グローバルキャンペーン
複数キャラクターが登場するブランドフィルム
パフォーマンスおよびミュージックビデオコンテンツ
商業広告制作
対話主導型ソーシャルコンテンツ
マルチフォーマットキャンペーン配信
Happy Horse 1.1とTagshop AI上の他のAIビデオモデルとの比較
Happy Horse 1.1とKling AI 3.0、Seedance 2.0、Vidu Q3の比較:クリエイティブなニーズに最適なモデルを選びましょう
Tagshop AI のその他の AI モデル
最先端のAIビデオモデルがすべて1つのプラットフォームに集約され、いつでもモデルを切り替えることができます。
Tagshop AIにおけるHappy Horse 1.1について、各ブランドが語る内容
Happy Horse 1.1に関するよくある質問
Tagshop AI の Happy Horse 1.1 について知っておくべきことすべて。
音声と映像を一度に処理。7つの言語。9つの文字。9つのフォーマット。



