Wan 3.0 AI動画ジェネレーター

Wan 3.0なら、テキストプロンプト、画像、または参照素材から、最大30秒のシネマティックな1080p動画を1回のパスで生成できます。映像と同時にネイティブ音声とリップシンクも生成されます。

Wan 3.0とは?

Wan 3.0は、Wan 2.7をはじめとする従来のリリースと同じWanモデルファミリーに属する、アリババの最新世代AI動画モデルです。短いクリップをつなぎ合わせるのではなく、最大30秒の1080p動画を1回の連続したパスで生成し、音声、セリフ、環境音、画面上のサウンドも映像と同じパスで生成され、リップの動きと同期します。後から吹き替えを追加する必要はありません。

Wan 3.0では、生成を開始する方法として、テキストプロンプト、元画像、または参照素材の3種類を利用できます。参照素材は画像最大10枚、動画クリップ最大5本、音声トラック最大5本を1つのリクエストにまとめて組み合わせられるため、実在するキャラクター、製品、ロケーションを起点にシーンを構成でき、テキストのみで説明する必要はありません。オプションのシンキングモードを有効にすると、フレームをレンダリングする前にモデルが構図や動きについて推論し、ドキュメントやウェブページも追加の参照素材として利用できるようになります。より高精細な作業向けにPrimeバリアントも用意されており、標準モデルに比べてディテール表現が強化され、モーション品質が向上し、被写体のアイデンティティもより安定します。

Tagshop AIでは、Wan 3.0を選択可能なAI動画生成モデルとして提供予定です。ツールを切り替えることなく、商品URLやプロンプトから完成した広告動画を生成できるようになります。

Wan 3.0:技術仕様

アリババが提供するWan 3.0の主要スペック:Tagshop AIで利用可能

開発元

アリババ

入力タイプ

テキストプロンプト・画像アップロード・参照素材(画像最大10枚、動画クリップ最大5本、音声トラック最大5本、シンキングモード時はドキュメントやウェブページも追加可能)

最大解像度

1080p

ネイティブ音声

対応、動画と同じパスで生成(セリフ、環境音、画面上のサウンド)、リクエストごとにオン・オフ切り替え可能

セリフ生成

対応、リップシンク付き

アスペクト比

16:9から9:16まで、指定した比率でネイティブ生成、またはモデルによる自動選択

最大動画長

1回の連続したパスで最大30秒(2〜30秒、未設定の場合は自動で長さを決定)

モーション処理

素早くダイナミックな全身の動きをテイク全体を通して破綻なく維持するよう設計

画像から動画

対応、最終フレームのコントロールもオプションで可能

参照から動画

対応、画像最大10枚、動画クリップ最大5本、音声トラック最大5本を1つのリクエストにまとめて組み合わせ、プロンプト内で位置指定して参照可能

モデルティア

スタンダードとPrime(Prime:ディテール表現が強化され、モーション品質が向上し、被写体のアイデンティティもより安定)

Tagshop AIでのステータス

現在利用可能

ブランドがWan 3.0を選ぶ理由

Tagshop AIでWan 3.0を際立たせる3つの機能

Wan 3.0による参照から動画への生成

プロンプトだけでなく参照素材も活用

Wan 3.0の参照から動画への生成モードでは、画像最大10枚、動画クリップ最大5本、音声トラック最大5本を同時に条件として設定できるため、実在する製品、キャラクター、ロケーションを起点にシーンを固定でき、純粋にテキストだけで説明する必要はありません。プロンプト内でそれぞれを位置指定して参照し、どれがキャラクターでどれが背景かを指定できます。
Wan 3.0による全身モーション

スピード感のある全身の動き

Wan 3.0は、複雑なモーションで破綻することなく、素早くダイナミックな動きをテイク全体を通して破綻なく維持するよう設計されています。手足の動き、重心、地面との接地感がずっと自然に読み取れます。オプションのシンキングモードを有効にすると、フレームをレンダリングする前にモデルが構図や動きについて推論します。
Wan 3.0による1080pネイティブ音声とリップシンク

1080p、ネイティブ音声とリップシンク付き

映像と音声は後から吹き替えるのではなく、同じパスで同時に生成されます。セリフ、環境音、画面上のアクションがリップの動きと同期しながら一体化し、16:9から9:16まであらゆるアスペクト比で1080p出力されます。

Wan 3.0で生成する3つの方法

テキスト、画像、参照素材、Wan 3.0はこの3種類すべてに対応

テキストから動画

シーン、被写体、カメラワーク、動きを言葉で説明するだけ。Wan 3.0は、ネイティブ音声付きで最大30秒のシネマティックな動画を1回のパスで生成します。

画像から動画

元画像をアップロードすると、Wan 3.0が被写体、構図、アイデンティティ、ビジュアルスタイルを保ったまま動画にアニメーション化します。最終フレームのコントロールもオプションで可能です。

参照から動画

画像最大10枚、動画クリップ最大5本、音声トラック最大5本を1つのリクエストにまとめて組み合わせ、シンキングモードではドキュメントや公開ウェブページも追加可能。プロンプト内で位置指定して参照し、どれがキャラクターでどれがロケーションかを指定できます。

テキストから動画画像から動画参照から動画

Wan 3.0で使えるすぐに使えるプロンプト集

任意のプロンプトをコピーしてTagshop AIに直接貼り付け

🎤 ブランドスポークスパーソン

Prompt: 「モダンなオフィス空間で、自信に満ちたプレゼンターが新商品発売についてカメラに向かって語りかける。クリアな照明、プロフェッショナルな背景、9:16。」

🍾 シネマティックな製品リビール

Prompt: 「高級ボトルが反射する台の上でゆっくり回転する。ドラマチックなスポットライト、盛り上がるシネマティックなスコア、ラベルにシャープにフォーカスが合う、16:9。」

🛍️ プレミアムなECサイト広告

Prompt: 「手が商品をテーブルに置くクローズアップ、温かみのある午後の光、なめらかな動き、アンビエントミュージック、9:16。」

🚶 ライフスタイルキャンペーン

Prompt: 「陽光が差す街中を歩く人物、スローモーション、シネマティックなカラーグレーディング、街のアンビエントサウンド、16:9。」

💬 体験談広告

Prompt: 「カジュアルな服装の人物が、製品の使用体験についてカメラに向かって語る。自然な自宅の空間、温かみのある照明、9:16。」

📱 テックプロダクトCM

Prompt: 「ミニマルなデスクの上でスリムなデバイスがスローモーションで開き、画面が光る。アンビエントなエレクトロニックミュージック、ソフトなブルーの照明、16:9。」

👗 ファッションブランドフィルム

Prompt: 「20代後半の女性が、黄金の時間帯に狭い街路をカメラに向かって歩いてくる。ロングのキャメルコートが風になびき、濡れた石畳をブーツで歩く。縦構図、手持ちカメラ、フレーム全体に低いフレアが入る逆光、9:16。」

🎬 マルチリファレンス・ブランドフィルム

Prompt: 「参照から動画:画像1を製品として、動画1を動きとカメラワークのスタイルとして、音声1をサウンドトラックとして使用。一貫した製品配置を保ったまま、1本の連続したシネマティックなシーンにまとめる、16:9。」

簡単なプロセス ⚡

Tagshop AIでWan 3.0を使ってAI動画を作成する方法

プロンプト、画像、参照クリップから、完成したAI動画広告まで

Tagshop AIを開いてWan 3.0を選択
Step 01

Tagshop AIを開く

tagshop.aiにアクセスし、Asset Generator、Choose Modelへ進む。モデル一覧からWan 3.0を選択。

Wan 3.0への入力を追加
Step 02

入力を追加

プロンプトを入力するか、元画像をアップロードするか、参照画像・動画クリップ・音声トラックを組み合わせます(1つのリクエストにつき画像最大10枚、動画クリップ最大5本、音声トラック最大5本)。

Wan 3.0で生成してエクスポート
Step 03

生成してエクスポート

16:9から9:16の間でアスペクト比を選び、最大30秒までの長さを設定して生成。有料広告にそのまま使える形でダウンロードできます。

活用事例 ✨

Wan 3.0で作れるもの

プロンプト、画像、実際の参照素材から作る、ネイティブ音声付きのシネマティックな動画

ブランドキャンペーンとヒーロームービー

ブランドキャンペーンとヒーロームービー

ネイティブ音声付きで最大30秒の連続したテイク。個別のクリップをつなぎ合わせるのではなく、シネマティックな動きとサウンドを1回のパスで実現するブランドフィルム向け。

参照条件付きの製品広告

参照条件付きの製品広告

製品画像、動きとスタイルのためのブランド動画クリップ、サウンドトラックのための音声トラックを1回の生成にまとめて組み合わせ。各要素を個別に調達・同期する手間が不要です。

ソーシャルメディア広告

ソーシャルメディア広告

16:9から9:16まで、あらゆるアスペクト比でネイティブに生成。横長フレームを切り抜くのではなく、本当の縦型出力も可能です。

トーキングキャラクターと体験談広告

トーキングキャラクターと体験談広告

動画と同じパスでリップシンク付きのセリフを生成、スポークスパーソン形式や体験談コンテンツに最適です。

モーション主体のコンテンツ

モーション主体のコンテンツ

ダンス、スポーツ、アクションなど、全身を使った素早い動きのシーンをテイク全体を通して破綻なく維持。多くのAI動画モデルが苦手とする難しいケースです。

ECサイト向け製品広告

ECサイト向け製品広告

製品画像から直接生成する製品紹介動画。参照動画や音声をオプションで追加し、キャンペーン全体で一貫したスタイルを保てます。

Wan 3.0 と他のAI動画モデルの比較

Wan 3.0はWan 2.7およびSeedance 2.5とどう違うのか

Feature
Wan 3.0 Wan 3.0
Wan 2.7 Wan 2.7
Seedance 2.5 Seedance 2.5
入力タイプ
テキスト、画像、または参照(画像最大10枚、動画クリップ最大5本、音声トラック最大5本)
テキスト、画像、音声、参照クリップ
マルチリファレンス、画像から動画、テキストから動画
ネイティブ音声
対応、同じパスで生成、オン・オフ切り替え可能
対応、シーンに応じた音声
対応、自動生成
セリフ生成
対応、リップシンク付き
対応、話すキャラクター
対応
マルチリファレンス/マルチショット
対応、画像最大10枚、動画クリップ最大5本、音声トラック最大5本を組み合わせ
限定的
対応、ネイティブ、最大50アセットを組み合わせ
モーション処理
全身の素早い動きを重視
専用のモーションコントロールなし
対応、調整可能
最大動画長
最大30秒、連続した1回のパス
最大15秒(ネイティブ)、Tagshop AI Video Agentで最大1分
30秒、単一セグメント
解像度
1080p
480p、720p、1080p
480p、720p、1080p
開発元
アリババ
アリババ
ByteDance

Tagshop AIのその他のAIモデル

個別の契約なしで、あらゆる最先端のAI動画・画像モデルを1つのプラットフォームで利用可能

Wan 2.7

Wan 2.7 VIDEO

テキスト、画像、音声、参照クリップから動画を生成、4通りの開始方法。

Veo 3

Veo 3 VIDEO

Google DeepMindによるシネマティックなAIモデル。ネイティブなセリフ、クリアな音声、プレミアムな映像品質。

Seedance 2.5

Seedance 2.5 VIDEO

最大50個の参照アセットを結合できる、ネイティブ30秒・単一セグメントのAI UGC動画広告。

g2-icon
4.9つ星・143件以上のレビュー rating

世界中5,000以上のブランドに信頼されています

g2-badges
エスマ・E.
エスマ・E.

あなたが制作してくれたビデオは、私たちの期待をはるかに超える素晴らしい出来栄えでした!

"どのフレームも魅力的であるだけでなく、美しく作り込まれており、制作に注ぎ込まれた高い創造性と努力が明確に伝わってきました。クリック率(CTR)は2%を超え、クリック単価はわずか0.20ドルでした。貴社の作品の効果は疑いようがありません。"

エスマ・E.

インフルエンサーマーケティング

シヴァン・ミカエリ=ロイミ
シヴァン・ミカエリ=ロイミ

シームレスなAIユーザー生成コンテンツ(UGC)動画・画像生成ツール

"私はAPIセキュリティの分野で働いていますが、画像、動画、クリエイティブコンテンツの生成など、さまざまなAIツールに興味を持ってきました。UGC(ユーザー生成コンテンツ)は今やあらゆるブランドにとって必要不可欠なものであり、私は多くのAI動画ツールを試してきました。Tagshop AIの気に入っている点は、そのシンプルさです。使いやすく、複雑ではなく、AIの知識がない人でもすぐに使い始めることができます。そのため、非常にユーザーフレンドリーなAI UGC動画ツールと言えるでしょう。"

シヴァン・ミカエリ=ロイミ

Pyntのマーケティング担当副社長 | Heyou.ioの創業者

アロン・ミカエリ
アロン・ミカエリ

私にとって最適な商品画像保持動画ジェネレーター

"2日前にTagshop AIを使ってみました。このツールで、動画付きのAI UGC商品を作成しました。ツール自体は非常に使いやすく、複雑な機能は一切ありませんでした。独自の画像生成モデルを採用しており、まず商品画像を生成またはアップロードし、その後、同じ商品の動画を作成することができます。このアイデアは素晴らしいと思いますが、どのように彼らのプランに移行できるか検討してみましょう。"

アロン・ミカエリ

DealHubの収益AI責任者

ユリア・コロミエツ
ユリア・コロミエツ

アバターがリアルに見える。高品質なAIユーザー生成コンテンツ動画の生成に役立つ。

"Tagshop AIをAIを使ったUGC動画生成ツールとして1ヶ月間使用していますが、とても満足しています。アバターライブラリの豊富なアバターの種類が気に入っています。このツールで一番気に入っているのはエディターです。シンプルで洗練されたデザインで、操作も簡単です。おかげで、動画編集のためにタブを切り替える必要がなくなりました。"

ユリア・コロミエツ

マーケティング担当副社長

アニルード
アニルード

このツールの多言語機能は本当に素晴らしい。

"私のターゲット層はアメリカ、ドイツ、イタリアなので、多言語対応機能は非常に役立ちます。様々な言語で複数のアバター動画を作成できるからです。このように幅広い視聴者をターゲットにする場合、多言語対応は大きなメリットとなります。"

アニルード

デジタルマーケティング責任者

スティーブン・マシュー
スティーブン・マシュー

時間を節約できるお手頃価格のツール

"このツールはAIを使ったUGC動画の作成が非常に速いです。ツール内のエディターが気に入っています。別のタブに切り替える必要がないのが良いですね。"

スティーブン・マシュー

マーケティングマネージャー

カジ・マイヌディン
カジ・マイヌディン

Tagshop AIを使えば、AIインフルエンサーを簡単に作成できます。

"Tagshop AIを使って、クライアント向けにAIアバター動画を作成しました。AIアバターを最速で作成する方法を見つけられたので、とても満足しています。このツールは素早く簡単に使えます。初心者にも優しく、AIに詳しくない人でも操作できます。"

カジ・マイヌディン

コンテンツマーケター

アルパン・シャー
アルパン・シャー

Tagshop AIを導入したことで、撮影時間の短縮に成功しました。

"Tagshop AIのおかげで、商品撮影時間を大幅に短縮できました。デジタルツイン/AIツイン機能を使えば、毎回照明やカメラ、背景をセットアップすることなく、洗練された商品画像を作成できます。数枚の画像をアップロードするだけで、広告やソーシャルメディアにすぐに使える高品質な画像が生成されます。私たちのような小規模なマーケティングチームにとって、これは毎週何時間もの時間を節約でき、コンテンツ制作が格段に楽になります。"

アルパン・シャー

取締役社長

Aygul M.
Aygul M.

Tagshop AIのダッシュボードは非常によく整理されており、私のような動画制作初心者でも扱いやすいです。

"Tagshop AIのおかげで、動画制作の編集経験があまりない私でも、動画作成の全工程がとても楽になりました。ダッシュボードはすっきりしていて非常によく整理されているため、ワークフローをすぐに理解することができました。コンテンツの生成、動画編集、さまざまな機能間の移動が、迷うことなくシンプルに行える点が特に気に入っています。このプラットフォームは時間を節約し、全体のプロセスをスムーズかつ効率的にしてくれます。総合的に見て、初心者にも優しく、それでいて最小限の労力でプロ並みの仕上がりを実現できるツールです。"

Aygul M.

デジタルPR戦略担当

Arina K.
Arina K.

私たちにとって、Tagshop AIは高いコンバージョンを生むUGC動画広告を作る最速の方法です

"現在、Tagshop AIはUGCスタイルの動画広告を素早く制作するのに大いに役立っています。商品リンクをアップロードするだけで、AIがスクリプト、アバター、動画全体を自動生成してくれるため、驚くほどの時間を節約できます。リアルなアバターと音声クローニングは自然な仕上がりで、多言語機能のおかげで国際的なキャンペーンも簡単に展開できます。撮影もクリエイターも編集も必要とせず、現在では1日90本以上の動画をA/Bテスト用のバリエーションとともに制作しています。"

Arina K.

最高マーケティング責任者

Bhavik B.
Bhavik B.

AI動画エージェントのワークフローによって、UGCスタイルの動画広告制作が簡単になります。

"これまでの時間をかけて、私たちも広告プラットフォーム向けにAI UGC動画を生成する手法を開発してきました。最近ではAI動画エージェントを通じて動画を生成する新機能を試しており、このスマートなAIエージェントがわずか数分でスクリプト、ビジュアル、動画を生成してくれます。つまり、エージェントとチャットするだけで、動画制作にかかる時間と動画生成の手間を大幅に削減できているということです。エージェントによって、従来の典型的なプロセスの多くをすでに省けていると感じています。"

Bhavik B.

共同創業者

Source: G2 & Trustpilot

Wan 3.0に関するよくある質問

Tagshop AIでWan 3.0を使ってAI動画を生成するために知っておきたいこと

Wan 3.0とは何ですか?誰が開発したのですか?
Wan 3.0は、Wanモデルファミリーに属するアリババの最新世代AI動画モデルです。テキストプロンプト、画像、または参照素材から、ネイティブ音声とリップシンク付きで、最大30秒の1080p動画を1回の連続したパスで生成します。
Wan 3.0はWan 2.7と何が違いますか?
Wan 3.0は、動画と同じパスでのネイティブ音声生成、リップシンク、1080pでの最大30秒の単一パス生成、そして画像・動画クリップ・音声を1つのリクエストで組み合わせる参照から動画へのモードを追加しており、以前のWan 2.7リリースよりも幅広い機能を確認済みです。
Wan 3.0は音声入力から動画を生成できますか?
はい、音声トラック(1リクエストあたり最大5本)は、画像や動画クリップと並んで参照から動画への生成時の参照素材として含めることができ、プロンプト内で位置指定して参照できます。
Tagshop AIでWan 3.0が動画を生成するまでどのくらい時間がかかりますか?
ほとんどのWan 3.0の動画は、Tagshop AI上で数分程度で生成されます。長さや参照素材の有無によって多少変動します。
Wan 3.0はどのような動画品質・フォーマットで出力されますか?
1080p、16:9から9:16までの任意のアスペクト比に対応し、切り抜きではなく指定した比率でネイティブに生成されます。
Wan 3.0は今すぐTagshop AIで利用できますか?
はい、Wan 3.0はTagshop AIで既に利用可能です。Asset Generatorのモデル一覧から選択して、すぐに制作を始められます。
Wan 3.0はどのアスペクト比に対応していますか?
16:9から9:16までの任意の比率に対応し、指定した比率でネイティブに生成できるほか、モデルがショットに合わせて自動選択することもできます。
Wan 3.0で生成した動画を有料広告に使用できますか?
はい、Tagshop AI上でのWan 3.0の出力は商用利用が許可されており、有料広告クリエイティブやブランドビジュアルにもご利用いただけます。
Wan 3.0はVeo 3やSeedance 2.5と何が違いますか?
Wan 3.0の参照から動画へのモードは、画像・動画クリップ・音声トラックを1つのリクエストで組み合わせ、画像最大10枚、動画クリップ最大5本、音声トラック最大5本をプロンプト内で位置指定して参照できます。Seedance 2.5も同様に複数の参照素材(最大50アセット)を組み合わせられ、30秒の単一パスという近い長さに対応しているため、この2つのモデルは互いに近い存在と言えます。一方Veo 3は、単一の画像やテキストプロンプトを中心に、ネイティブなセリフ生成を主な差別化要因としている点で異なります。
background
Tagshop AIでWan 3.0を使った制作を始めましょう

プロンプト、画像、参照素材から、ネイティブ音声とリップシンク付きで最大30秒のシネマティックな1080p動画を。