alibaba/wan-2.7/text-to-image-pro テキストから画像 Pro
alibaba/wan-2.7/text-to-image-pro
WAN 2.7 Text-to-Image Pro は、テキストプロンプトから最大 4K の高品質な画像を生成し、思考モードによってさらに画質を向上できます。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成に使用するポジティブプロンプトです。 |
| sizeサイズ | text | 1024*1024 | ≤ 500 chars | 生成される画像のピクセルサイズ(幅×高さ)です。各辺の範囲は 512〜8192。総ピクセル数は 768×768 から 4096×4096 の間である必要があります。アスペクト比は 1:8 から 8:1 の間である必要があります。 |
| thinking_mode思考モード | boolean | true | — | 思考モードを有効にすると、推論能力が強化され、より高品質な画像を生成できます。生成時間は長くなります。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image-pro" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": true
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image-pro",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": True
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image-pro", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": true
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
alibaba/wan-2.7/text-to-image-pro
高精細 4K 生成、優れたプロンプト理解、そしてコールドスタートなしのプロ向け文生画像モデルです。
alibaba/wan-2.7/text-to-image-pro は、プロンプトから高品質な画像を生成するプロフェッショナル向けの文生画像モデルです。最大 4K(4096×4096)の出力に対応し、思考モードによるプロンプト理解の強化と柔軟なサイズ指定により、品質重視の制作ワークフローに適しています。
🚀 主な特長
- 最大 4K 出力対応:最大 4096×4096 の高解像度画像を生成でき、印刷物、大型ディスプレイ、高 DPI 用途に適しています。
- 思考モードで品質向上:生成前にプロンプト意図をより深く解釈し、構図の一貫性やプロンプト追従性を高めます。
- 柔軟なサイズ指定:幅と高さを直接指定でき、正方形、横向き、縦向き、ワイドスクリーン、ウルトラワイドなどに対応します。
- コールドスタートなし:待機時間を抑えやすく、継続的な生成が必要な本番運用にも適しています。
- プロ品質を手頃な価格で提供:高画質と制御性のバランスに優れ、商用クリエイティブ制作にも導入しやすい構成です。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデルアーキテクチャ | プロ向け文生画像モデル |
| 入力 | プロンプト |
| 出力 | 画像 |
| デフォルト解像度 | 1024×1024 |
| 最大有効出力解像度 | 4096×4096(4K クラス) |
| サイズ範囲 | 幅・高さともに 512〜8192 ピクセル |
| 総ピクセル制約 | 768×768〜4096×4096 の総ピクセル範囲内 |
| アスペクト比制約 | 1:8〜8:1 |
| 思考モード | デフォルトで有効。品質向上に有効ですが、生成時間は長くなります |
| レイテンシ | 固定ではありません。高解像度や思考モード有効時は長くなる傾向があります |
| 出力形式 | 高品質な単一画像 |
サンプルプロンプト
A modern tea shop interior, warm afternoon light, minimalist wood design, cinematic photographyA luxury skincare product on reflective glass, soft studio lighting, premium commercial photography, ultra detailedA futuristic city skyline at sunrise, atmospheric haze, intricate architecture, highly detailed concept art
💰 価格
| 項目 | 価格 |
|---|---|
| 画像 1 枚あたり | $0.075 |
💡 主な活用シーン
- 印刷・大型クリエイティブ制作:ポスター、雑誌、サイネージ、販促物向けの高解像度ビジュアル制作。
- EC・商品ビジュアライゼーション:質感やディテールを重視した商品画像や提案資料用ビジュアルの生成。
- マーケティング・広告制作:キャンペーン用キービジュアル、SNS クリエイティブ、ブランド訴求素材の作成。
- コンセプトアート制作:環境、ライティング、マテリアル、構図検討を高精細に進めたい場面に適しています。
🔗 関連モデル
- Wan 2.7 Text-to-Image:日常的な生成向けの、より低コストな標準版です。
- Wan 2.6 Text-to-Image:前世代の Wan 文生画像モデルです。
- Seedream V4 Text-to-Image:ポスターやブランドビジュアルなど、スタイル一貫性を重視する用途に適しています。
- FLUX.2 Dev Text-to-Image:高いプロンプト追従性と細部表現を重視する制作向けモデルです。
関連モデル
xAI Grok Imagine Image v2.0 テキストから画像生成
xAI Grok Imagine Image V2.0 Text-to-Image は、テキストプロンプトから高品質な画像を生成できます。アスペクト比、解像度、品質を設定でき、クリエイティブ制作、SNS コンテンツ、マーケティング素材、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格で利用できます。
Qwen Image 3.0 Pro テキストから画像生成
Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
OpenAI GPT Image 2 テキストから画像生成
OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
OpenAI GPT Image 2 Edit 画像編集
OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Nami Z-Image T2I Spicy
テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。
Nano Banana テキストから画像
Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。