ハッピーホース 1.1 AIビデオジェネレーター

Happy Horse 1.1は、アリババのAIビデオモデルで、ビデオと同期オーディオを1回の処理で同時に生成します。オーディオ処理を別途行う必要も、手動で同期する必要もありません。7言語に対応したネイティブリップシンク、音声的に一致する口の形、シーンごとに最大9つの参照文字、そして21:9の超ワイドを含む9つのアスペクト比に対応しています。Tagshop AI上で最も高性能なオーディオビジュアル生成モデルです。

Happy Horse 1.1 が何を生み出すか見てみましょう

このギャラリーにあるすべての動画は、Tagshop AIのHappy Horse 1.1を使用して生成され、音声は一度の処理で同期されています。

Happy Horse 1.1とは何ですか?

Happy Horse 1.1 is Alibaba's AI video generation model that generates video and synchronized audio together in a single pass, dialogue, sound effects, ambience, and music all in sync with the motion from one generation. It offers native lip-sync across seven languages, English, Mandarin, Cantonese, Japanese, Korean, German, and French, with mouth shapes phonetically matched to each spoken language. Up to nine reference images can be used per generation, with each character called by index in the prompt, enabling consistent multi-character and ensemble scenes. It outputs 720p or 1080p video in clips of 3 to 15 seconds across nine aspect ratios, from vertical 9:16 to ultrawide cinematic 21:9, making it the most versatile audio-visual generation model on Tagshop AI. Available from $19/month with full commercial licensing on all paid plans.

ハッピーホース1.1:技術仕様

Tagshop AIにおけるHappy Horse 1.1生成の正確なパラメータ

開発者

アリババ

世代時間

10~15分

動画再生時間(ネイティブ)

3~15秒(デフォルトは5秒)

動画の長さ(ビデオエージェント)

最大1分

解決

720p(ドラフト)、1080p(配信)

ネイティブオーディオ

はい、音声と映像を一度に生成します

オーディオの種類

会話、効果音、雰囲気、音楽

リップシンク言語

7: 英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語

リップシンク法

言語ごとに音声的に一致する口の形

参考画像

最大9文字まで、文字1~文字9としてインデックス付けされます。

アスペクト比

16:9、9:16、1:1、4:3、3:4、21:9、9:21、5:4、4:5

入力モード

テキストから動画へ、画像から動画へ、参照から動画へ

キャラクターの一貫性

顔、服装、声はどのカットでも一貫している

プロンプトの最大文字数

2,500文字

商用ライセンス

有料プランすべてで商用利用が可能です。

透かし

有料プランはすべて透かしなし

ハッピーホース1.1の理由

Happy Horse 1.1をTagshop AI上で最も優れたオーディオビジュアル生成モデルたらしめる4つの機能

音声と映像の共同制作 ハッピーホース 1.1

音声と映像。ワンパスで、常に同期。

Tagshop AIの他のAIビデオモデルはすべて、まずビデオを生成してからオーディオを生成するか、あるいはオーディオ生成を別途行う必要があります。Happy Horse 1.1は、ビデオとオーディオを一度に生成します。セリフ、効果音、環境音、音楽はすべてビデオと同時に生成されるため、手動で位置合わせをする必要なく、最初のフレームから同期が取れています。口の動きと発話が一致する必要のある会話シーン、動きがビートに合わせる必要のあるパフォーマンスビデオ、オーディオが映像と同じくらいブランド価値を高める製品広告など、この同時生成により、他のすべてのモデルが必要とするワークフロー手順が不要になります。プロンプト1つ、生成1回、オーディオが同期された完成クリップ1つ。
多言語ネイティブリップシンク ハッピーホース 1.1

7つの言語。発音に完璧な口の形。

Happy Horse 1.1は、英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語の7言語でネイティブリップシンクをサポートし、各言語の特定の音に合わせて口の形を音声的に調整します。これは、翻訳された音声に単一言語のリップシンクシステムを適用するものではありません。各言語には独自の音声モデルがあるため、フランス語の会話シーンでは、フランス語の音声に英語の口の形を適用するのではなく、正確なフランス語の口の形が生成されます。多言語キャンペーンを展開するグローバルブランド、複数の市場で同じシーンをローカライズするコンテンツチーム、そして視聴者の母国語で登場人物が説得力のある話し方をする必要があるあらゆる制作において、この多言語対応の正確さこそが、Happy Horse 1.1を最適な選択肢にする理由です。
9つの参照キャラクター ハッピーホース 1.1

最大9人のキャラクター。名前で呼ばれます。すべてのショットで一貫性があります。

Happy Horse 1.1 は、1 世代につき最大 9 枚の参照画像を受け付け、各キャラクターにはインデックス (character1 ~ character9) が割り当てられ、プロンプトで名前を指定して呼び出します。モデルは各キャラクターの顔、衣装、声をすべてのカットに引き継ぐため、複数のキャラクターが共演するアンサンブルシーンは、複数の個別のキャラクタークリップから組み立てるのではなく、単一の世代で処理されます。繰り返し登場するキャストのブランドキャンペーン、複数のキャラクターが登場する対話シーン、アンサンブルストーリーテリングにおいて、この参照システムは、各キャラクターの再撮影や再ブリーフィングを行うことなく、一貫性のある名前付きのキャストを提供します。シーンを説明し、キャラクターに名前を付けるだけで、Happy Horse 1.1 がアンサンブルを組み立てます。

Happy Horse 1.1 を使って、テキスト、画像、または参照から作成する

Tagshop AI の Happy Horse 1.1 で生成する 3 つの方法と、7 つの言語でのネイティブリップシンク

テキストからビデオへ

シーン、登場人物、セリフ、アクション、カメラワークについて説明してください。プロンプトには、リップシンク用の言語を含めてください。プロンプトは最大2,500文字まで対応しています。このスペースを使って、音響の詳細(環境音、音楽スタイル、効果音)と視覚的な詳細を説明してください。

画像から動画へ

静止画像を最初のフレームとしてアップロードすると、Happy Horse 1.1 がそれを同期音声付きの 1080p 動画にアニメーション化し、画像の元の照明とディテールを保持します。

ビデオへの参照

キャラクターごとに1枚ずつ、最大9枚の参考画像をアップロードしてください。プロンプトでは、提供した順番に合わせて、キャラクター1、キャラクター2などとそれぞれ参照してください。シーンとアクションを説明してください。Happy Horse 1.1では、各キャラクターが常に同じ位置に配置されます。

リップシンク言語

英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語。正確な音声同期のために、プロンプトで言語を指定してください。

テキストからビデオへ画像から動画へビデオへの参照リップシンク言語

ハッピーホース1.1のすぐに使えるプロンプト集

プロンプトをTagshop AIに直接コピーして、音声が同期したビデオを生成します。

🗣️ 多言語対話

Prompt: 「パリのカフェのテーブルでフランス語を話しながら笑っている二人の友人、手持ちカメラ、温かい午後の光、カフェの環境音、顔のクローズアップ、9:16」

🥂 複数キャラクターのアンサンブル

Prompt: 「夕暮れ時、屋上ディナーテーブルを囲んで3人の同僚が乾杯。グラスがカチンと鳴り、笑い声と会話が響き、温かい黄金色の光が降り注ぐ。参照画像から文字1、文字2、文字3を使用。16:9」

📺 ニュースキャスター

Prompt: 「ニュースキャスターがスタジオのデスクで夕方のヘッドラインを読み上げる。スタジオ音声は同期済み、プロ仕様の照明、クリアで説得力のある映像、16:9」

👟 音声付き商品紹介

Prompt: 「光沢のある床の上でスニーカーが回転し、ヒップホップのビートが回転に合わせてシンクロする。マクロレンズ、高コントラストのスタジオ照明、1:1」

🎻 パフォーマンスクリップ

Prompt: 「夕暮れ時の屋上でチェロ奏者が演奏する。壮大なオーケストラの楽曲が生成・同期され、カメラがゆっくりと引いて街のスカイラインが映し出される。21:9」

🌏 多言語広告のローカライズ

Prompt: 「ブランドの広報担当者が自信満々に中国語でカメラに向かって話す。スタジオの背景は清潔で、衣装はプロフェッショナルな仕上がり。口の動きも同期しており、参考画像から文字1を使用。9分16秒」

🍳 アンサンブルシーン

Prompt: 「4人の友人がキッチンカウンターを囲んで一緒に料理をし、英語で自然な会話が交わされる。温かい家庭的な照明、ドキュメンタリー風のスタイル、登場人物1~4は参考資料から引用、16:9」

🏔️ ウルトラワイドシネマティック

Prompt: 「夜明けに一人のハイカーが山稜にたどり着く。風の音と鳥のさえずりが聞こえる。ゆっくりとした映画のようなカメラワーク、超ワイドフォーマット、21:9」

簡単なプロセス⚡

Tagshop AIのHappy Horse 1.1を使ってAI動画を作成する方法

プロンプト、画像、または参考資料から、音声が同期された完成ビデオまで。

Tagshop AIを開き、Happy Horse 1.1を選択します。
Step 01

Open Tagshop AI

tagshop.ai → Asset Generator → Choose Model にアクセスしてください。モデルリストから Happy Horse 1.1 を選択します。

入力モードを選択し、Happy Horse 1.1 のプロンプトを記述してください。
Step 02

入力モードを選択してください

テキストから動画、画像から動画、または参照から動画のいずれかを選択してください。シーンの説明、参照を使用する場合はインデックスによるキャラクターの動作、リップシンクの言語、音声スタイル、カメラの方向などを含め、最大2,500文字のプロンプトを記述してください。アスペクト比と解像度(720pのドラフトまたは1080pの最終版)を選択してください。

Happy Horse 1.1で生成およびエクスポートする
Step 03

生成およびエクスポート

生成ボタンを押すと、10~15分で準備完了です。Tagshop AIビデオエージェントを使用すれば、最大1分まで延長できます。ウォーターマークなしで、商用利用ライセンス付きの動画をダウンロードできます。

ユースケース ✨

Happy Horse 1.1で作成できるもの

多言語キャンペーンから多キャラクターのブランドフィルムまで、Happy Horse 1.1はあらゆるオーディオ・ビデオ複合フォーマットに対応します。

多言語グローバルキャンペーン

多言語グローバルキャンペーン

ネイティブの発音に合わせたリップシンクで、英語、フランス語、ドイツ語、日本語、北京語、広東語、韓国語の7つの言語で同じシーンを生成。モデルは1人、市場は7つ。

複数キャラクターが登場するブランドフィルム

複数キャラクターが登場するブランドフィルム

最大9人の一貫したキャラクターからなるアンサンブルキャスト。参照画像からカットを跨いで同じキャラクターが起用され、再キャストやキャラクターごとの再説明は行われない。

パフォーマンスおよびミュージックビデオコンテンツ

パフォーマンスおよびミュージックビデオコンテンツ

音声と映像の同時生成とは、音楽と映像が同時に制作され、ビートと映像が最初のフレームから同期することを意味します。

商業広告制作

商業広告制作

リファレンスに基づいたキャラクターの一貫性とネイティブオーディオにより、Happy Horse 1.1はプラットフォーム上で最も完成度の高いシングルパス広告制作ツールとなっています。

対話主導型ソーシャルコンテンツ

対話主導型ソーシャルコンテンツ

登場人物は7つの言語のいずれかで自然な話し方をし、発音に忠実な口の動きをするため、後処理の音声作業なしで有料ソーシャルメディアにすぐに利用できます。

マルチフォーマットキャンペーン配信

マルチフォーマットキャンペーン配信

1つの短い動画から、ウルトラワイドの映画のような映像、縦型のソーシャルコンテンツ、正方形のフィード、そしてその間のあらゆるフォーマットまで、9つのアスペクト比を1つの世代で実現。

Happy Horse 1.1とTagshop AI上の他のAIビデオモデルとの比較

Happy Horse 1.1とKling AI 3.0、Seedance 2.0、Vidu Q3の比較:クリエイティブなニーズに最適なモデルを選びましょう

Feature
ハッピーホース 1.1 ハッピーホース 1.1
Blade AI 3.0 Blade AI 3.0
シードダンス2.0 シードダンス2.0
Vidu Q3 Vidu Q3
開発者
アリババ
快手
ByteDance
盛舒科技
音声・映像統合(1パス)
はい、すべてのオーディオタイプ
限定
はい(ネイティブ音声)
はい(音声同期済み)
リップシンク言語
7、音韻的に一致する
限定
限定
限定
参照文字
最大9人
1
画像参照
1(スタイル)
アスペクト比
9(21:9ウルトラワイドを含む)
16:9、9:16、1:1
21:9、16:9、4:3、1:1、3:4、9:16、アダプティブ
16:9、9:16、1:1
動画再生時間(ネイティブ)
最大15秒
10秒
15秒
8~16秒
解決
720p / 1080p
4K
4K
1080p
キャラクターの一貫性
はい、顔/服装/声
ベスト、アバター重視
適度
はい、参照ベース
カメラ制御
限定
限定
限定
はい、スマートカメラ
多言語ローカライズ
はい、7ヶ国語を母語としています
限定
限定
限定
最適
多言語、複数文字、共同音声
UGCアバター、リップシンク広告
Eコマースマルチショット
映画用カメラ、スタイル参照

Tagshop AI のその他の AI モデル

最先端のAIビデオモデルがすべて1つのプラットフォームに集約され、いつでもモデルを切り替えることができます。

Blade AI 3.0

Blade AI 3.0 ビデオ

キャラクター設定に忠実で、正確なリップシンクを備えたAIスポークスパーソンにより、コンバージョン率の高いUGC動画広告を実現します。

シードダンス2.0

シードダンス2.0 ビデオ

商品画像から洗練された動画まで、ネイティブ音声と調整可能なモーションコントロールを備えたマルチショットのECサイト広告。

Vidu Q3 Pro

Vidu Q3 Pro ビデオ

ネイティブ音声・映像をワンパスで処理、フレーム単位で正確なカメラ制御、複数話者による対話。

g2-icon
星4.9。レビュー数143件以上 rating

Tagshop AIにおけるHappy Horse 1.1について、各ブランドが語る内容

g2-badges
エスマ・E.
エスマ・E.

あなたが制作してくれたビデオは、私たちの期待をはるかに超える素晴らしい出来栄えでした!

"どのフレームも魅力的であるだけでなく、美しく作り込まれており、制作に注ぎ込まれた高い創造性と努力が明確に伝わってきました。クリック率(CTR)は2%を超え、クリック単価はわずか0.20ドルでした。貴社の作品の効果は疑いようがありません。"

エスマ・E.

インフルエンサーマーケティング

シヴァン・ミカエリ=ロイミ
シヴァン・ミカエリ=ロイミ

シームレスなAIユーザー生成コンテンツ(UGC)動画・画像生成ツール

"私はAPIセキュリティの分野で働いていますが、画像、動画、クリエイティブコンテンツの生成など、さまざまなAIツールに興味を持ってきました。UGC(ユーザー生成コンテンツ)は今やあらゆるブランドにとって必要不可欠なものであり、私は多くのAI動画ツールを試してきました。Tagshop AIの気に入っている点は、そのシンプルさです。使いやすく、複雑ではなく、AIの知識がない人でもすぐに使い始めることができます。そのため、非常にユーザーフレンドリーなAI UGC動画ツールと言えるでしょう。"

シヴァン・ミカエリ=ロイミ

Pyntのマーケティング担当副社長 | Heyou.ioの創業者

アロン・ミカエリ
アロン・ミカエリ

私にとって最適な商品画像保持動画ジェネレーター

"2日前にTagshop AIを使ってみました。このツールで、動画付きのAI UGC商品を作成しました。ツール自体は非常に使いやすく、複雑な機能は一切ありませんでした。独自の画像生成モデルを採用しており、まず商品画像を生成またはアップロードし、その後、同じ商品の動画を作成することができます。このアイデアは素晴らしいと思いますが、どのように彼らのプランに移行できるか検討してみましょう。"

アロン・ミカエリ

DealHubの収益AI責任者

ユリア・コロミエツ
ユリア・コロミエツ

アバターがリアルに見える。高品質なAIユーザー生成コンテンツ動画の生成に役立つ。

"Tagshop AIをAIを使ったUGC動画生成ツールとして1ヶ月間使用していますが、とても満足しています。アバターライブラリの豊富なアバターの種類が気に入っています。このツールで一番気に入っているのはエディターです。シンプルで洗練されたデザインで、操作も簡単です。おかげで、動画編集のためにタブを切り替える必要がなくなりました。"

ユリア・コロミエツ

マーケティング担当副社長

アニルード
アニルード

このツールの多言語機能は本当に素晴らしい。

"私のターゲット層はアメリカ、ドイツ、イタリアなので、多言語対応機能は非常に役立ちます。様々な言語で複数のアバター動画を作成できるからです。このように幅広い視聴者をターゲットにする場合、多言語対応は大きなメリットとなります。"

アニルード

デジタルマーケティング責任者

スティーブン・マシュー
スティーブン・マシュー

時間を節約できるお手頃価格のツール

"このツールはAIを使ったUGC動画の作成が非常に速いです。ツール内のエディターが気に入っています。別のタブに切り替える必要がないのが良いですね。"

スティーブン・マシュー

マーケティングマネージャー

カジ・マイヌディン
カジ・マイヌディン

Tagshop AIを使えば、AIインフルエンサーを簡単に作成できます。

"Tagshop AIを使って、クライアント向けにAIアバター動画を作成しました。AIアバターを最速で作成する方法を見つけられたので、とても満足しています。このツールは素早く簡単に使えます。初心者にも優しく、AIに詳しくない人でも操作できます。"

カジ・マイヌディン

コンテンツマーケター

アルパン・シャー
アルパン・シャー

Tagshop AIを導入したことで、撮影時間の短縮に成功しました。

"Tagshop AIのおかげで、商品撮影時間を大幅に短縮できました。デジタルツイン/AIツイン機能を使えば、毎回照明やカメラ、背景をセットアップすることなく、洗練された商品画像を作成できます。数枚の画像をアップロードするだけで、広告やソーシャルメディアにすぐに使える高品質な画像が生成されます。私たちのような小規模なマーケティングチームにとって、これは毎週何時間もの時間を節約でき、コンテンツ制作が格段に楽になります。"

アルパン・シャー

取締役社長

Aygul M.
Aygul M.

Tagshop AIのダッシュボードは非常によく整理されており、私のような動画制作初心者でも扱いやすいです。

"Tagshop AIのおかげで、動画制作の編集経験があまりない私でも、動画作成の全工程がとても楽になりました。ダッシュボードはすっきりしていて非常によく整理されているため、ワークフローをすぐに理解することができました。コンテンツの生成、動画編集、さまざまな機能間の移動が、迷うことなくシンプルに行える点が特に気に入っています。このプラットフォームは時間を節約し、全体のプロセスをスムーズかつ効率的にしてくれます。総合的に見て、初心者にも優しく、それでいて最小限の労力でプロ並みの仕上がりを実現できるツールです。"

Aygul M.

デジタルPR戦略担当

Arina K.
Arina K.

私たちにとって、Tagshop AIは高いコンバージョンを生むUGC動画広告を作る最速の方法です

"現在、Tagshop AIはUGCスタイルの動画広告を素早く制作するのに大いに役立っています。商品リンクをアップロードするだけで、AIがスクリプト、アバター、動画全体を自動生成してくれるため、驚くほどの時間を節約できます。リアルなアバターと音声クローニングは自然な仕上がりで、多言語機能のおかげで国際的なキャンペーンも簡単に展開できます。撮影もクリエイターも編集も必要とせず、現在では1日90本以上の動画をA/Bテスト用のバリエーションとともに制作しています。"

Arina K.

最高マーケティング責任者

Bhavik B.
Bhavik B.

AI動画エージェントのワークフローによって、UGCスタイルの動画広告制作が簡単になります。

"これまでの時間をかけて、私たちも広告プラットフォーム向けにAI UGC動画を生成する手法を開発してきました。最近ではAI動画エージェントを通じて動画を生成する新機能を試しており、このスマートなAIエージェントがわずか数分でスクリプト、ビジュアル、動画を生成してくれます。つまり、エージェントとチャットするだけで、動画制作にかかる時間と動画生成の手間を大幅に削減できているということです。エージェントによって、従来の典型的なプロセスの多くをすでに省けていると感じています。"

Bhavik B.

共同創業者

Source: G2 & Trustpilot

Happy Horse 1.1に関するよくある質問

Tagshop AI の Happy Horse 1.1 について知っておくべきことすべて。

Happy Horse 1.1とは何ですか?
Happy Horse 1.1は、アリババが開発したAI動画生成モデルで、動画と同期音声を1回の処理で同時に生成します。セリフ、効果音、環境音、音楽など、すべてが動きに合わせて同期されます。7言語に対応したネイティブリップシンク機能、シーンごとに最大9文字の参照文字のサポート、9種類のアスペクト比での出力に対応しています。
Happy Horse 1.1は、Tagshop AIの他のビデオモデルとどのように違うのですか?
このモデルを際立たせる3つの特長は、音声と映像を1回の処理で同時に生成できること(音声処理を別途行う必要がない)、7言語に対応したネイティブリップシンク機能(音声的に正確な口の形を再現)、そしてシーンごとに最大9文字の参照文字をサポートできることです。Tagshop AIの他のモデルには、これら3つの特長をすべて兼ね備えたものはありません。音声同期、多言語出力、複数文字の一貫性が求められる場合に最適な選択肢です。
Happy Horse 1.1は、リップシンク機能でどの言語をサポートしていますか?
対応言語は英語、北京語、広東語、日本語、韓国語、ドイツ語、フランス語の7言語です。各言語には独自の音声モデルがあり、口の形は各言語固有の音に合わせて調整されます。翻訳された音声に単一言語モデルを適用することはありません。プロンプトで言語を指定すると、適切な音声リップシンクが有効になります。
動画参照はどのように機能するのですか?
キャラクターごとに1枚ずつ、最大9枚の参考画像をアップロードしてください。各画像にはアップロード順にインデックスが割り当てられます(character1、character2など)。プロンプトでは、各キャラクターをそのインデックスで呼び、シーン内での行動を説明してください。Happy Horse 1.1では、各キャラクターの顔、衣装、声がカットごとに一貫して表示されます。
Happy Horse 1.1で生成される動画の長さはどれくらいですか?
Happy Horse 1.1は、標準機能として3秒から15秒のクリップを生成し、デフォルトは5秒です。Tagshop AIでは、Tagshop AI Video Agentが複数のクリップを連結することで、生成したクリップの長さを最大1分まで延長できます。
利用可能なアスペクト比は?
9種類の画面比率:16:9(横長/YouTube)、9:16(縦長/TikTok/Reels)、1:1(正方形フィード)、4:3、3:4、21:9(ウルトラワイドシネマティック)、9:21(ウルトラワイド縦長)、5:4、4:5。1つのブリーフから複数の比率で同じシーンを生成し、あらゆるプラットフォームフォーマットに対応します。
Happy Horse 1.1は、セリフだけでなく、音楽や効果音も生成しますか?
はい。音声と映像の同時生成機能は、対話、効果音、環境音、音楽など、あらゆる種類の音声を網羅しており、すべて映像と同期して一度の処理で生成されます。プロンプトに音声スタイル(ヒップホップのビート、オーケストラのスコア、カフェの環境音など)を記述するだけで、Happy Horse 1.1が映像と同時に音声を生成します。
Happy Horse 1.1はKling AI 3.0とどう違うのですか?
Kling AI 3.0は、UGCスタイルのトークヘッドアバターコンテンツに最適化されており、プレゼンターが1人の広告向けにリップシンクを最適化しています。Happy Horse 1.1は、複数のキャラクターが登場するアンサンブル、多言語キャンペーン、および共同音声生成向けに設計されています。Kling 3.0はUGCスポークスパーソンコンテンツを担当し、Happy Horse 1.1は多言語制作、アンサンブルシーン、およびあらゆる音声タイプにおける音声と映像の同期を担当します。
Happy Horse 1.1の出力を商用広告に使用できますか?
はい。有料プランはすべて商用利用が可能で、ウォーターマークも表示されません。有料ソーシャル広告、ブランドフィルム、キャンペーンスポット、多言語対応のローカライズコンテンツなどに最適です。
background
Tagshop AIでHappy Horse 1.1を使って創作を始めましょう

音声と映像を一度に処理。7つの言語。9つの文字。9つのフォーマット。