Wan 3.0 AI動画ジェネレーター

Wan 3.0なら、テキストプロンプト、画像、または参照素材から、最大30秒のシネマティックな1080p動画を1回のパスで生成できます。映像と同時にネイティブ音声とリップシンクも生成されます。

Wan 3.0とは?

Wan 3.0は、Wan 2.7をはじめとする従来のリリースと同じWanモデルファミリーに属する、アリババの最新世代AI動画モデルです。短いクリップをつなぎ合わせるのではなく、最大30秒の1080p動画を1回の連続したパスで生成し、音声、セリフ、環境音、画面上のサウンドも映像と同じパスで生成され、リップの動きと同期します。後から吹き替えを追加する必要はありません。

Wan 3.0では、生成を開始する方法として、テキストプロンプト、元画像、または参照素材の3種類を利用できます。参照素材は画像最大10枚、動画クリップ最大5本、音声トラック最大5本を1つのリクエストにまとめて組み合わせられるため、実在するキャラクター、製品、ロケーションを起点にシーンを構成でき、テキストのみで説明する必要はありません。オプションのシンキングモードを有効にすると、フレームをレンダリングする前にモデルが構図や動きについて推論し、ドキュメントやウェブページも追加の参照素材として利用できるようになります。より高精細な作業向けにPrimeバリアントも用意されており、標準モデルに比べてディテール表現が強化され、モーション品質が向上し、被写体のアイデンティティもより安定します。

Tagshop AIでは、Wan 3.0を選択可能なAI動画生成モデルとして提供予定です。ツールを切り替えることなく、商品URLやプロンプトから完成した広告動画を生成できるようになります。

Wan 3.0:技術仕様

アリババが提供するWan 3.0の主要スペック:Tagshop AIで利用可能

開発元

アリババ

入力タイプ

テキストプロンプト・画像アップロード・参照素材(画像最大10枚、動画クリップ最大5本、音声トラック最大5本、シンキングモード時はドキュメントやウェブページも追加可能)

最大解像度

1080p

ネイティブ音声

対応、動画と同じパスで生成(セリフ、環境音、画面上のサウンド)、リクエストごとにオン・オフ切り替え可能

セリフ生成

対応、リップシンク付き

アスペクト比

16:9から9:16まで、指定した比率でネイティブ生成、またはモデルによる自動選択

最大動画長

1回の連続したパスで最大30秒(2〜30秒、未設定の場合は自動で長さを決定)

モーション処理

素早くダイナミックな全身の動きをテイク全体を通して破綻なく維持するよう設計

画像から動画

対応、最終フレームのコントロールもオプションで可能

参照から動画

対応、画像最大10枚、動画クリップ最大5本、音声トラック最大5本を1つのリクエストにまとめて組み合わせ、プロンプト内で位置指定して参照可能

モデルティア

スタンダードとPrime(Prime:ディテール表現が強化され、モーション品質が向上し、被写体のアイデンティティもより安定)

Tagshop AIでのステータス

現在利用可能

ブランドがWan 3.0を選ぶ理由

Tagshop AIでWan 3.0を際立たせる3つの機能

Wan 3.0による参照から動画への生成

プロンプトだけでなく参照素材も活用

Wan 3.0の参照から動画への生成モードでは、画像最大10枚、動画クリップ最大5本、音声トラック最大5本を同時に条件として設定できるため、実在する製品、キャラクター、ロケーションを起点にシーンを固定でき、純粋にテキストだけで説明する必要はありません。プロンプト内でそれぞれを位置指定して参照し、どれがキャラクターでどれが背景かを指定できます。
Wan 3.0による全身モーション

スピード感のある全身の動き

Wan 3.0は、複雑なモーションで破綻することなく、素早くダイナミックな動きをテイク全体を通して破綻なく維持するよう設計されています。手足の動き、重心、地面との接地感がずっと自然に読み取れます。オプションのシンキングモードを有効にすると、フレームをレンダリングする前にモデルが構図や動きについて推論します。
Wan 3.0による1080pネイティブ音声とリップシンク

1080p、ネイティブ音声とリップシンク付き

映像と音声は後から吹き替えるのではなく、同じパスで同時に生成されます。セリフ、環境音、画面上のアクションがリップの動きと同期しながら一体化し、16:9から9:16まであらゆるアスペクト比で1080p出力されます。

Wan 3.0で生成する3つの方法

テキスト、画像、参照素材、Wan 3.0はこの3種類すべてに対応

テキストから動画

シーン、被写体、カメラワーク、動きを言葉で説明するだけ。Wan 3.0は、ネイティブ音声付きで最大30秒のシネマティックな動画を1回のパスで生成します。

画像から動画

元画像をアップロードすると、Wan 3.0が被写体、構図、アイデンティティ、ビジュアルスタイルを保ったまま動画にアニメーション化します。最終フレームのコントロールもオプションで可能です。

参照から動画

画像最大10枚、動画クリップ最大5本、音声トラック最大5本を1つのリクエストにまとめて組み合わせ、シンキングモードではドキュメントや公開ウェブページも追加可能。プロンプト内で位置指定して参照し、どれがキャラクターでどれがロケーションかを指定できます。

テキストから動画画像から動画参照から動画

Wan 3.0で使えるすぐに使えるプロンプト集

任意のプロンプトをコピーしてTagshop AIに直接貼り付け

🎤 ブランドスポークスパーソン

Prompt: 「モダンなオフィス空間で、自信に満ちたプレゼンターが新商品発売についてカメラに向かって語りかける。クリアな照明、プロフェッショナルな背景、9:16。」

🍾 シネマティックな製品リビール

Prompt: 「高級ボトルが反射する台の上でゆっくり回転する。ドラマチックなスポットライト、盛り上がるシネマティックなスコア、ラベルにシャープにフォーカスが合う、16:9。」

🛍️ プレミアムなECサイト広告

Prompt: 「手が商品をテーブルに置くクローズアップ、温かみのある午後の光、なめらかな動き、アンビエントミュージック、9:16。」

🚶 ライフスタイルキャンペーン

Prompt: 「陽光が差す街中を歩く人物、スローモーション、シネマティックなカラーグレーディング、街のアンビエントサウンド、16:9。」

💬 体験談広告

Prompt: 「カジュアルな服装の人物が、製品の使用体験についてカメラに向かって語る。自然な自宅の空間、温かみのある照明、9:16。」

📱 テックプロダクトCM

Prompt: 「ミニマルなデスクの上でスリムなデバイスがスローモーションで開き、画面が光る。アンビエントなエレクトロニックミュージック、ソフトなブルーの照明、16:9。」

👗 ファッションブランドフィルム

Prompt: 「20代後半の女性が、黄金の時間帯に狭い街路をカメラに向かって歩いてくる。ロングのキャメルコートが風になびき、濡れた石畳をブーツで歩く。縦構図、手持ちカメラ、フレーム全体に低いフレアが入る逆光、9:16。」

🎬 マルチリファレンス・ブランドフィルム

Prompt: 「参照から動画:画像1を製品として、動画1を動きとカメラワークのスタイルとして、音声1をサウンドトラックとして使用。一貫した製品配置を保ったまま、1本の連続したシネマティックなシーンにまとめる、16:9。」

簡単なプロセス ⚡

Tagshop AIでWan 3.0を使ってAI動画を作成する方法

プロンプト、画像、参照クリップから、完成したAI動画広告まで

今すぐ試す
活用事例 ✨

Wan 3.0で作れるもの

プロンプト、画像、実際の参照素材から作る、ネイティブ音声付きのシネマティックな動画

ブランドキャンペーンとヒーロームービー

ブランドキャンペーンとヒーロームービー

ネイティブ音声付きで最大30秒の連続したテイク。個別のクリップをつなぎ合わせるのではなく、シネマティックな動きとサウンドを1回のパスで実現するブランドフィルム向け。
参照条件付きの製品広告

参照条件付きの製品広告

製品画像、動きとスタイルのためのブランド動画クリップ、サウンドトラックのための音声トラックを1回の生成にまとめて組み合わせ。各要素を個別に調達・同期する手間が不要です。
ソーシャルメディア広告

ソーシャルメディア広告

16:9から9:16まで、あらゆるアスペクト比でネイティブに生成。横長フレームを切り抜くのではなく、本当の縦型出力も可能です。
トーキングキャラクターと体験談広告

トーキングキャラクターと体験談広告

動画と同じパスでリップシンク付きのセリフを生成、スポークスパーソン形式や体験談コンテンツに最適です。
モーション主体のコンテンツ

モーション主体のコンテンツ

ダンス、スポーツ、アクションなど、全身を使った素早い動きのシーンをテイク全体を通して破綻なく維持。多くのAI動画モデルが苦手とする難しいケースです。
ECサイト向け製品広告

ECサイト向け製品広告

製品画像から直接生成する製品紹介動画。参照動画や音声をオプションで追加し、キャンペーン全体で一貫したスタイルを保てます。

Wan 3.0 と他のAI動画モデルの比較

Wan 3.0はWan 2.7およびSeedance 2.5とどう違うのか

Feature
Wan 3.0Wan 3.0
Wan 2.7Wan 2.7
Seedance 2.5Seedance 2.5
入力タイプ
テキスト、画像、または参照(画像最大10枚、動画クリップ最大5本、音声トラック最大5本)
テキスト、画像、音声、参照クリップ
マルチリファレンス、画像から動画、テキストから動画
ネイティブ音声
対応、同じパスで生成、オン・オフ切り替え可能
対応、シーンに応じた音声
対応、自動生成
セリフ生成
対応、リップシンク付き
対応、話すキャラクター
対応
マルチリファレンス/マルチショット
対応、画像最大10枚、動画クリップ最大5本、音声トラック最大5本を組み合わせ
限定的
対応、ネイティブ、最大50アセットを組み合わせ
モーション処理
全身の素早い動きを重視
専用のモーションコントロールなし
対応、調整可能
最大動画長
最大30秒、連続した1回のパス
最大15秒(ネイティブ)、Tagshop AI Video Agentで最大1分
30秒、単一セグメント
解像度
1080p
480p、720p、1080p
480p、720p、1080p
開発元
アリババ
アリババ
ByteDance

Tagshop AIのその他のAIモデル

個別の契約なしで、あらゆる最先端のAI動画・画像モデルを1つのプラットフォームで利用可能

Wan 2.7

Wan 2.7VIDEO

テキスト、画像、音声、参照クリップから動画を生成、4通りの開始方法。

Veo 3

Veo 3VIDEO

Google DeepMindによるシネマティックなAIモデル。ネイティブなセリフ、クリアな音声、プレミアムな映像品質。

Seedance 2.5

Seedance 2.5VIDEO

最大50個の参照アセットを結合できる、ネイティブ30秒・単一セグメントのAI UGC動画広告。

g2-icon
4.9つ星・143件以上のレビューrating

世界中5,000以上のブランドに信頼されています

g2-badges

Wan 3.0に関するよくある質問

Tagshop AIでWan 3.0を使ってAI動画を生成するために知っておきたいこと

background
Tagshop AIでWan 3.0を使った制作を始めましょう

プロンプト、画像、参照素材から、ネイティブ音声とリップシンク付きで最大30秒のシネマティックな1080p動画を。