Wan 3.0 Prime API の使い方:Omni Reference統合ガイド(2026)
NamiFusion で Wan 3.0 Prime API を呼び出す方法:パラメータ、料金、そのまま実行できるコード例、Playground で試用可能。
Wan 3.0 Prime は Alibaba のOmni Referenceモデルです:複数画像・動画・音声などのマルチモーダルな参照入力に対応し、豊かな動きと音声・映像の高い同期性を備えた動画を生成します。参照素材の被写体の外観、動きの特徴、ビジュアルスタイルを忠実に維持し、複数の参照素材を柔軟に組み合わせたコンテンツ制作やショット制御にも対応します。NamiFusion では Playground で試してから(送信前に見積もり表示)、統一 REST API で呼び出せます(1 回あたり約 $1.25)。
TL;DR
· タスク種別:Omni Reference(提供:Alibaba)
· 料金:1 回あたり約 $1.25($1 = 100 クレジット)、従量課金
· 始め方:Playground で試用(送信前に見積もり)→ API キー作成 → POST 一発で統合
· 調整可能パラメータ:12 個(下表参照)
· プラットフォーム透かしなし。商用利用可(利用規約に従う)
Wan 3.0 Prime で何が作れる?
コンテンツ制作の自動化:このモデルをワークフローに組み込み、統一 API で従量課金呼び出し。
この API はどう呼び出す?
1. NamiFusion に登録し、API Keys ページでキーを作成(登録特典クレジットは指定モデルのみ対象)。
2. 下記の cURL 例でタスクを送信。Bearer トークンにキーを指定。
3. 返された task_uuid でステータスをポーリングし、完了後に出力 URL を取得。
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-3.0-prime/video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"resolution": "1080P",
"aspect_ratio": "adaptive",
"duration": 5,
"generate_audio": true,
"enable_thinking": false
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"どんなパラメータがある?
prompt(プロンプト):任意
images(参照画像):任意
audios(参照音声):任意
first_frame(先頭フレーム):任意
last_frame(末尾フレーム):任意
resolution(解像度):任意、デフォルト "1080P"
aspect_ratio(アスペクト比):任意、デフォルト "adaptive"
duration(生成時間(秒)):任意、デフォルト 5
generate_audio(音声を生成):任意、デフォルト true
enable_thinking(深い思考モード):任意、デフォルト false
file(参照ドキュメント):任意
link(参照Webページ):任意
Wan 3.0 Prime のプロンプトの書き方は?
1. 主体を先に:主役と動作を先に書き、環境・光・スタイルを後から足す(「雨のネオン街を走る宇宙飛行士、シネマティック、浅い被写界深度」)。
2. 形容詞の羅列より具体名詞:「85mm ポートレートレンズ、夕暮れの逆光」は「とても綺麗、超高品質」より遥かに効く。
3. 1 回の反復で変えるのは 1 変数だけ:seed を固定して再現し、語句を 1 つずつ調整する。
4. 否定は肯定で書く:「ぼかさない」ではなく「シャープなフォーカス、精細なディテール」と指定。
料金はいくら?
従量課金(クレジット制)。1 回あたり約 $1.25($1 = 100 クレジット)。解像度や長さなどで変動し、Playground では送信前に正確な見積もりが表示されます。
Wan 3.0 Prime
テキスト・画像・動画・音声・ドキュメントをひとつのモデルで扱い、1回で最大30秒の動画を生成します。
Wan 3.0 Video は、生成時間・全能参照・リアリティを同時に引き上げたオールインワンの動画生成モデルです。1回のリクエストで最大30秒の連続した映像を生成でき、語りのテンポに余裕が生まれ、連続的なカメラワークやワンカット撮影といった複雑な映像表現も十分に成立します。テキスト・画像・音声・動画に加え、シリーズで初めてドキュメント(doc、xls、ppt、pdf、md など)の入力に対応し、オフィス素材をそのまま動画化できます。
🚀 主な特長
- ネイティブ30秒生成:1カットではなく、ひとつの物語として構成できます。スマート長さ機能により、プロンプトから最適な長さをモデルが提案します。
- 6モダリティの全能参照:参照画像・動画・音声・ドキュメント・Webページを1回のリクエストで組み合わせ、プロンプトで統括的に制御します。
- ドキュメントを素材に:doc、xls、ppt、pdf、txt、key、pages、numbers、md から、教材、製品デモ、アニメーショングラフ、業務レポートを生成できます。
- 超写実的な世界レンダラー:肌や顔立ちのディテールを忠実に描写し、感情表現は自然かつ抑制的。画一的な顔ではなく一人ひとり異なり、群衆シーンでも破綻しません。
- ピクセルレベルの一貫性:キャラクター、小道具、声、空間関係を参照素材に忠実に揃えます。「似ている」ではなく「再現」です。
- 厳密な先頭/末尾フレームモード:開始と終了のフレームを厳密に指定し、制御されたトランジションを実現します。
- 音声付き出力:生成された動画は音声トラックを含みます。オン・オフによる価格差はありません。
- アスペクト比の自動選択:意図と入力メディアからモデルが最適な比率を選択。5種類のプリセットからの指定も可能です。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデルアーキテクチャ | オールインワン全能参照型 動画生成モデル |
| タスクタイプ | 動画生成(テキスト / 画像 / 動画 / 音声 / ドキュメントから動画) |
| プロンプト | 中国語・英語、最大5000文字。プロンプトまたは参照素材のいずれかが必須 |
| 出力形式 | 音声付き動画 |
| 解像度 | 480P、720P、1080P(デフォルト 1080P) |
| 生成時間 | 2〜30秒(デフォルト 5)。-1 でスマート長さ。動画入力がある場合、入力と出力の合計は30秒以内 |
| アスペクト比 | adaptive(デフォルト)、16:9、4:3、1:1、3:4、9:16 |
| 参照画像 | 最大10枚。JPEG、JPG、PNG(透過非対応)、BMP、WEBP。1枚20MB以下、各辺240〜8000px、比率8:1以内 |
| 参照動画 | 最大5本、1本1〜15秒・合計15秒以内。mp4、mov。1本100MB未満、各辺240〜4096px |
| 参照音声 | 最大5本、1本1〜15秒・合計15秒以内。wav、mp3。1本15MB未満 |
| ドキュメント | 1件、100MB以下、50ページ以内。docx、doc、xlsx、xls、pptx、ppt、pdf、txt、key、pages、numbers、md。思考モードが必要 |
| Webページ | ログイン不要の公開URLを1件。思考モードが必要。ドキュメントとは併用不可 |
| 先頭 / 末尾フレーム | 各1枚。全能参照の入力とは併用不可 |
| 思考モード | デフォルトはオフ。ドキュメント、Webページ、複雑な画像理解に必要 |
| シード値 | 任意指定。0〜2147483647 で再現性を確保 |
| 音声スイッチ | デフォルトはオン。オン・オフによる価格差なし |
| レイテンシ | コールドスタートなし |
サンプルプロンプト
動画1が画像3を抱え、画像4の椅子で穏やかなカントリーバラードを弾きながら「今日は良い天気ですね」と言う。画像1が画像2を手に持って動画1の前を通り、画像2を動画1の隣のテーブルに置いて「素敵な演奏ですね、もう一度お願いできますか」と言う。雨上がりのネオン街を夜に進む、30秒のシネマティックなワンカット。カメラは看板と路面の反射を通り過ぎながら前進し、遠くの交通音を含む環境音を伴う。添付の製品資料をアニメーション解説動画に変換。主要な数値をオンスクリーンのグラフとして強調し、ブランドカラーを維持し、落ち着いたナレーションのテンポで。
💰 価格
動画の秒数で課金され、入力動画と出力動画の両方が対象です。
課金対象時間 = 入力動画の長さ + 出力動画の長さ
| 解像度 | 1秒あたりの価格 |
|---|---|
| 480P | $0.0625 |
| 720P | $0.125 |
| 1080P | $0.25 |
料金例
| シナリオ | 課金対象時間 | 480P | 720P | 1080P |
|---|---|---|---|---|
| 出力 10 秒、参照動画なし | 10 秒 | $0.625 | $1.25 | $2.50 |
| 出力 15 秒 + 参照動画 5 秒 | 20 秒 | $1.25 | $2.50 | $5.00 |
| 出力 30 秒、参照動画なし | 30 秒 | $1.875 | $3.75 | $7.50 |
課金ルール
- 入力動画と出力動画の両方が課金対象で、動画の秒数に基づきます。
- 入力動画は実際の入力秒数、出力動画は正常に生成された秒数が課金対象です。
- 参照画像と参照音声は時間による課金の対象外です。
- 音声トラックのオン・オフによる価格差はありません。
- 失敗したタスクは課金されず、全額返金されます。
- スマート長さ(
-1)は30秒上限で事前課金し、完了後に実際の生成時間で精算されます。
FAQ
無料で試せますか?+
登録特典クレジットは指定モデルでのみ利用でき、対象範囲は随時更新されます。Playground では送信前に正確な見積もりを確認できます。
生成物は商用利用できますか?ウォーターマークは?+
商用利用できます。NamiFusion はプラットフォームのウォーターマークを付けません。利用規約と適用法に従ってください。
コンテンツポリシーは?+
NamiFusion は無検閲エンジンで恣意的な制限はなく NSFW にも対応しますが、違法コンテンツと本人の同意のない実在人物素材は禁止です。詳細は利用規約へ。
Wan 3.0 Prime のタスクはどれくらいかかる?+
パラメータ次第で、画像は数秒〜数十秒、動画は数十秒〜数分。API は task_uuid を返すのでポーリングできます。
解像度・長さの上限は?+
上のパラメータ表を参照してください。各モデルの解像度・長さの選択肢はパラメータ説明と Playground に記載されています。