ハッピーホース 1.1 AIビデオジェネレーター

Happy Horse 1.1は、アリババのAIビデオモデルで、ビデオと同期オーディオを1回の処理で同時に生成します。オーディオ処理を別途行う必要も、手動で同期する必要もありません。7言語に対応したネイティブリップシンク、音声的に一致する口の形、シーンごとに最大9つの参照文字、そして21:9の超ワイドを含む9つのアスペクト比に対応しています。Tagshop AI上で最も高性能なオーディオビジュアル生成モデルです。

Happy Horse 1.1 が何を生み出すか見てみましょう

このギャラリーにあるすべての動画は、Tagshop AIのHappy Horse 1.1を使用して生成され、音声は一度の処理で同期されています。

Happy Horse 1.1とは何ですか?

Happy Horse 1.1 is Alibaba's AI video generation model that generates video and synchronized audio together in a single pass, dialogue, sound effects, ambience, and music all in sync with the motion from one generation. It offers native lip-sync across seven languages, English, Mandarin, Cantonese, Japanese, Korean, German, and French, with mouth shapes phonetically matched to each spoken language. Up to nine reference images can be used per generation, with each character called by index in the prompt, enabling consistent multi-character and ensemble scenes. It outputs 720p or 1080p video in clips of 3 to 15 seconds across nine aspect ratios, from vertical 9:16 to ultrawide cinematic 21:9, making it the most versatile audio-visual generation model on Tagshop AI. Available from $14/month with full commercial licensing on all paid plans.

ハッピーホース1.1:技術仕様

Tagshop AIにおけるHappy Horse 1.1生成の正確なパラメータ

開発者

アリババ

世代時間

10~15分

動画再生時間(ネイティブ)

3~15秒(デフォルトは5秒)

動画の長さ(ビデオエージェント)

最大1分

解決

720p(ドラフト)、1080p(配信)

ネイティブオーディオ

はい、音声と映像を一度に生成します

オーディオの種類

会話、効果音、雰囲気、音楽

リップシンク言語

7: 英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語

リップシンク法

言語ごとに音声的に一致する口の形

参考画像

最大9文字まで、文字1~文字9としてインデックス付けされます。

アスペクト比

16:9、9:16、1:1、4:3、3:4、21:9、9:21、5:4、4:5

入力モード

テキストから動画へ、画像から動画へ、参照から動画へ

キャラクターの一貫性

顔、服装、声はどのカットでも一貫している

プロンプトの最大文字数

2,500文字

商用ライセンス

有料プランすべてで商用利用が可能です。

透かし

有料プランはすべて透かしなし

ハッピーホース1.1の理由

Happy Horse 1.1をTagshop AI上で最も優れたオーディオビジュアル生成モデルたらしめる4つの機能

音声と映像の共同制作 ハッピーホース 1.1

音声と映像。ワンパスで、常に同期。

Tagshop AIの他のAIビデオモデルはすべて、まずビデオを生成してからオーディオを生成するか、あるいはオーディオ生成を別途行う必要があります。Happy Horse 1.1は、ビデオとオーディオを一度に生成します。セリフ、効果音、環境音、音楽はすべてビデオと同時に生成されるため、手動で位置合わせをする必要なく、最初のフレームから同期が取れています。口の動きと発話が一致する必要のある会話シーン、動きがビートに合わせる必要のあるパフォーマンスビデオ、オーディオが映像と同じくらいブランド価値を高める製品広告など、この同時生成により、他のすべてのモデルが必要とするワークフロー手順が不要になります。プロンプト1つ、生成1回、オーディオが同期された完成クリップ1つ。
多言語ネイティブリップシンク ハッピーホース 1.1

7つの言語。発音に完璧な口の形。

Happy Horse 1.1は、英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語の7言語でネイティブリップシンクをサポートし、各言語の特定の音に合わせて口の形を音声的に調整します。これは、翻訳された音声に単一言語のリップシンクシステムを適用するものではありません。各言語には独自の音声モデルがあるため、フランス語の会話シーンでは、フランス語の音声に英語の口の形を適用するのではなく、正確なフランス語の口の形が生成されます。多言語キャンペーンを展開するグローバルブランド、複数の市場で同じシーンをローカライズするコンテンツチーム、そして視聴者の母国語で登場人物が説得力のある話し方をする必要があるあらゆる制作において、この多言語対応の正確さこそが、Happy Horse 1.1を最適な選択肢にする理由です。
9つの参照キャラクター ハッピーホース 1.1

最大9人のキャラクター。名前で呼ばれます。すべてのショットで一貫性があります。

Happy Horse 1.1 は、1 世代につき最大 9 枚の参照画像を受け付け、各キャラクターにはインデックス (character1 ~ character9) が割り当てられ、プロンプトで名前を指定して呼び出します。モデルは各キャラクターの顔、衣装、声をすべてのカットに引き継ぐため、複数のキャラクターが共演するアンサンブルシーンは、複数の個別のキャラクタークリップから組み立てるのではなく、単一の世代で処理されます。繰り返し登場するキャストのブランドキャンペーン、複数のキャラクターが登場する対話シーン、アンサンブルストーリーテリングにおいて、この参照システムは、各キャラクターの再撮影や再ブリーフィングを行うことなく、一貫性のある名前付きのキャストを提供します。シーンを説明し、キャラクターに名前を付けるだけで、Happy Horse 1.1 がアンサンブルを組み立てます。

Happy Horse 1.1 を使って、テキスト、画像、または参照から作成する

Tagshop AI の Happy Horse 1.1 で生成する 3 つの方法と、7 つの言語でのネイティブリップシンク

テキストからビデオへ

シーン、登場人物、セリフ、アクション、カメラワークについて説明してください。プロンプトには、リップシンク用の言語を含めてください。プロンプトは最大2,500文字まで対応しています。このスペースを使って、音響の詳細(環境音、音楽スタイル、効果音)と視覚的な詳細を説明してください。

画像から動画へ

静止画像を最初のフレームとしてアップロードすると、Happy Horse 1.1 がそれを同期音声付きの 1080p 動画にアニメーション化し、画像の元の照明とディテールを保持します。

ビデオへの参照

キャラクターごとに1枚ずつ、最大9枚の参考画像をアップロードしてください。プロンプトでは、提供した順番に合わせて、キャラクター1、キャラクター2などとそれぞれ参照してください。シーンとアクションを説明してください。Happy Horse 1.1では、各キャラクターが常に同じ位置に配置されます。

リップシンク言語

英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語。正確な音声同期のために、プロンプトで言語を指定してください。

テキストからビデオへ画像から動画へビデオへの参照リップシンク言語

ハッピーホース1.1のすぐに使えるプロンプト集

プロンプトをTagshop AIに直接コピーして、音声が同期したビデオを生成します。

🗣️ 多言語対話

Prompt: 「パリのカフェのテーブルでフランス語を話しながら笑っている二人の友人、手持ちカメラ、温かい午後の光、カフェの環境音、顔のクローズアップ、9:16」

🥂 複数キャラクターのアンサンブル

Prompt: 「夕暮れ時、屋上ディナーテーブルを囲んで3人の同僚が乾杯。グラスがカチンと鳴り、笑い声と会話が響き、温かい黄金色の光が降り注ぐ。参照画像から文字1、文字2、文字3を使用。16:9」

📺 ニュースキャスター

Prompt: 「ニュースキャスターがスタジオのデスクで夕方のヘッドラインを読み上げる。スタジオ音声は同期済み、プロ仕様の照明、クリアで説得力のある映像、16:9」

👟 音声付き商品紹介

Prompt: 「光沢のある床の上でスニーカーが回転し、ヒップホップのビートが回転に合わせてシンクロする。マクロレンズ、高コントラストのスタジオ照明、1:1」

🎻 パフォーマンスクリップ

Prompt: 「夕暮れ時の屋上でチェロ奏者が演奏する。壮大なオーケストラの楽曲が生成・同期され、カメラがゆっくりと引いて街のスカイラインが映し出される。21:9」

🌏 多言語広告のローカライズ

Prompt: 「ブランドの広報担当者が自信満々に中国語でカメラに向かって話す。スタジオの背景は清潔で、衣装はプロフェッショナルな仕上がり。口の動きも同期しており、参考画像から文字1を使用。9分16秒」

🍳 アンサンブルシーン

Prompt: 「4人の友人がキッチンカウンターを囲んで一緒に料理をし、英語で自然な会話が交わされる。温かい家庭的な照明、ドキュメンタリー風のスタイル、登場人物1~4は参考資料から引用、16:9」

🏔️ ウルトラワイドシネマティック

Prompt: 「夜明けに一人のハイカーが山稜にたどり着く。風の音と鳥のさえずりが聞こえる。ゆっくりとした映画のようなカメラワーク、超ワイドフォーマット、21:9」

簡単なプロセス⚡

Tagshop AIのHappy Horse 1.1を使ってAI動画を作成する方法

プロンプト、画像、または参考資料から、音声が同期された完成ビデオまで。

Happy Horse 1.1を無料でお試しください →
ユースケース ✨

Happy Horse 1.1で作成できるもの

多言語キャンペーンから多キャラクターのブランドフィルムまで、Happy Horse 1.1はあらゆるオーディオ・ビデオ複合フォーマットに対応します。

多言語グローバルキャンペーン

多言語グローバルキャンペーン

ネイティブの発音に合わせたリップシンクで、英語、フランス語、ドイツ語、日本語、北京語、広東語、韓国語の7つの言語で同じシーンを生成。モデルは1人、市場は7つ。
複数キャラクターが登場するブランドフィルム

複数キャラクターが登場するブランドフィルム

最大9人の一貫したキャラクターからなるアンサンブルキャスト。参照画像からカットを跨いで同じキャラクターが起用され、再キャストやキャラクターごとの再説明は行われない。
パフォーマンスおよびミュージックビデオコンテンツ

パフォーマンスおよびミュージックビデオコンテンツ

音声と映像の同時生成とは、音楽と映像が同時に制作され、ビートと映像が最初のフレームから同期することを意味します。
商業広告制作

商業広告制作

リファレンスに基づいたキャラクターの一貫性とネイティブオーディオにより、Happy Horse 1.1はプラットフォーム上で最も完成度の高いシングルパス広告制作ツールとなっています。
対話主導型ソーシャルコンテンツ

対話主導型ソーシャルコンテンツ

登場人物は7つの言語のいずれかで自然な話し方をし、発音に忠実な口の動きをするため、後処理の音声作業なしで有料ソーシャルメディアにすぐに利用できます。
マルチフォーマットキャンペーン配信

マルチフォーマットキャンペーン配信

1つの短い動画から、ウルトラワイドの映画のような映像、縦型のソーシャルコンテンツ、正方形のフィード、そしてその間のあらゆるフォーマットまで、9つのアスペクト比を1つの世代で実現。

Happy Horse 1.1とTagshop AI上の他のAIビデオモデルとの比較

Happy Horse 1.1とKling AI 3.0、Seedance 2.0、Vidu Q3の比較:クリエイティブなニーズに最適なモデルを選びましょう

Feature
ハッピーホース 1.1ハッピーホース 1.1
Blade AI 3.0Blade AI 3.0
シードダンス2.0シードダンス2.0
Vidu Q3Vidu Q3
開発者
アリババ
快手
ByteDance
盛舒科技
音声・映像統合(1パス)
はい、すべてのオーディオタイプ
限定
はい(ネイティブ音声)
はい(音声同期済み)
リップシンク言語
7、音韻的に一致する
限定
限定
限定
参照文字
最大9人
1
画像参照
1(スタイル)
アスペクト比
9(21:9ウルトラワイドを含む)
16:9、9:16、1:1
21:9、16:9、4:3、1:1、3:4、9:16、アダプティブ
16:9、9:16、1:1
動画再生時間(ネイティブ)
最大15秒
10秒
15秒
8~16秒
解決
720p / 1080p
4K
4K
1080p
キャラクターの一貫性
はい、顔/服装/声
ベスト、アバター重視
適度
はい、参照ベース
カメラ制御
限定
限定
限定
はい、スマートカメラ
多言語ローカライズ
はい、7ヶ国語を母語としています
限定
限定
限定
最適
多言語、複数文字、共同音声
UGCアバター、リップシンク広告
Eコマースマルチショット
映画用カメラ、スタイル参照

Tagshop AI のその他の AI モデル

最先端のAIビデオモデルがすべて1つのプラットフォームに集約され、いつでもモデルを切り替えることができます。

Blade AI 3.0

Blade AI 3.0ビデオ

キャラクター設定に忠実で、正確なリップシンクを備えたAIスポークスパーソンにより、コンバージョン率の高いUGC動画広告を実現します。

シードダンス2.0

シードダンス2.0ビデオ

商品画像から洗練された動画まで、ネイティブ音声と調整可能なモーションコントロールを備えたマルチショットのECサイト広告。

Vidu Q3 Pro

Vidu Q3 Proビデオ

ネイティブ音声・映像をワンパスで処理、フレーム単位で正確なカメラ制御、複数話者による対話。

g2-icon
星4.9。レビュー数143件以上rating

Tagshop AIにおけるHappy Horse 1.1について、各ブランドが語る内容

g2-badges

Happy Horse 1.1に関するよくある質問

Tagshop AI の Happy Horse 1.1 について知っておくべきことすべて。

background
Tagshop AIでHappy Horse 1.1を使って創作を始めましょう

音声と映像を一度に処理。7つの言語。9つの文字。9つのフォーマット。