alibaba/wan-2.7/text-to-image テキストから画像生成
alibaba/wan-2.7/text-to-image
WAN 2.7 Text-to-Image は、テキストのプロンプトから高品質な画像を生成し、思考モードによってさらに画質を向上できます。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格で利用できます。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成に使用するポジティブプロンプトです。 |
| sizeサイズ | text | 1024*1024 | ≤ 500 chars | 生成される画像のピクセルサイズ(幅*高さ)です。各辺の範囲は 512〜4096。総ピクセル数は 768*768〜2048*2048 の範囲内である必要があります。アスペクト比は 1:8〜8:1 である必要があります。 |
| thinking_mode思考モード | boolean | true | — | 思考モードを有効にすると、推論能力が強化され、より高品質な画像を生成できます。生成時間は長くなります。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": true
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": True
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": true
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
alibaba/wan-2.7/text-to-image
思考モードを備えた高品質なテキストから画像生成。柔軟なサイズ指定と安定した高速利用に対応。
alibaba/wan-2.7/text-to-image は、自然言語の説明から高品質でディテール豊かな画像を生成できる、本番利用向けのテキストから画像生成モデルです。柔軟な解像度設定、幅広いアスペクト比対応、デフォルトで有効な思考モードにより、品質・運用性・コスト効率のバランスに優れています。
🚀 主な特長
- 高品質な画像生成:自然なライティング、整った構図、豊かな質感を備えた画像を生成できます。
- 思考モードによる理解力向上:内蔵の thinking mode により、プロンプトの意図をより深く解釈し、整合性の高い出力を実現します。
- 柔軟な解像度指定:出力サイズを 512~4096 ピクセルの範囲で指定でき、さまざまな制作フォーマットに対応します。
- 幅広いアスペクト比対応:1:8 から 8:1 まで対応し、正方形、縦向き、横向き、ワイド構図まで幅広くカバーします。
- コールドスタートなし:安定した立ち上がりで、継続的な生成ワークフローにも適しています。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデル名 | alibaba/wan-2.7/text-to-image |
| モデル種別 | テキストから画像生成 |
| アーキテクチャ | Wan 2.7 系テキストから画像生成アーキテクチャ |
| 入力 | テキストプロンプト |
| 出力 | 画像 |
| デフォルト解像度 | 1024×1024 |
| 解像度範囲 | 幅・高さともに 512~4096 ピクセル |
| 総ピクセル制約 | 総ピクセル数は 768×768 ~ 2048×2048 の範囲 |
| アスペクト比 | 1:8 ~ 8:1 |
| 思考モード | 対応、デフォルトで有効。品質向上と引き換えに生成時間は増加 |
| レイテンシ | 通常生成の方が高速。思考モード有効時はレイテンシ増加 |
| 出力形式 | 生成画像 |
サンプルプロンプト
A modern tea shop interior, warm afternoon light, minimalist wood design, cinematic photographyA cinematic ocean wave at sunrise, highly detailed, dramatic lighting, ultra realisticA futuristic fashion portrait, neon city background, editorial style, sharp focus
💰 価格
| 項目 | 価格 |
|---|---|
| 画像 1 枚あたり | $0.03 |
💡 主なユースケース
- ソーシャルメディア向け制作:正方形、縦長、横向きなど各種フォーマットに最適化したビジュアル制作に適しています。
- マーケティング・広告:キャンペーン用ビジュアル、広告クリエイティブ、ブランド訴求素材を迅速に作成できます。
- コンセプトアート・絵コンテ:シーン、キャラクター、背景設定の初期可視化を効率化できます。
- Eコマース向け画像制作:商品ライフスタイル画像や販促用ビジュアルの作成に有効です。
🔗 関連モデル
- Wan 2.7 Text-to-Image Pro:より高解像度かつ本格的な制作ワークフロー向けの上位版です。
- Wan 2.6 Text-to-Image:Wan 系列の前世代モデルです。
- Seedream V4 Text-to-Image:ポスター、キャンペーン、ブランド向けのスタイル一貫性を重視する用途に適しています。
- FLUX.2 Dev Text-to-Image:プロンプト追従性と細部表現に優れ、制作・検証の両方に適しています。
関連モデル
xAI Grok Imagine Image v2.0 テキストから画像生成
xAI Grok Imagine Image V2.0 Text-to-Image は、テキストプロンプトから高品質な画像を生成できます。アスペクト比、解像度、品質を設定でき、クリエイティブ制作、SNS コンテンツ、マーケティング素材、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格で利用できます。
Qwen Image 3.0 Pro テキストから画像生成
Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
OpenAI GPT Image 2 テキストから画像生成
OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
OpenAI GPT Image 2 Edit 画像編集
OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Nami Z-Image T2I Spicy
テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。
Nano Banana テキストから画像
Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。