alibaba/wan-2.7/text-to-image 文生图
alibaba/wan-2.7/text-to-image
WAN 2.7 Text-to-Image 可根据文本提示词生成高质量图片,并提供思考模式以进一步提升画面质量。提供开箱即用的 REST 推理 API,性能出色,无冷启动,价格实惠。
示例
参数
| 名称 | 类型 | 默认 | 约束 | 说明 |
|---|---|---|---|---|
| prompt *提示词 | textarea | — | ≤ 5000 chars | 用于生成的正向提示词。 |
| size尺寸 | text | 1024*1024 | ≤ 500 chars | 生成图片的像素尺寸(宽度*高度)。每个维度范围为 512-4096。总像素必须在 768*768 到 2048*2048 之间。宽高比必须在 1:8 到 8:1 之间。 |
| thinking_mode思考模式 | boolean | true | — | 启用思考模式以增强推理能力并提升图片质量,但会增加生成时间。 |
API
通过统一 REST API 调用本模型;在 API Keys 页获取密钥。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": true
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": True
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.7/text-to-image", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
"size": "1024*1024",
"thinking_mode": true
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);文档
alibaba/wan-2.7/text-to-image
高质量文本生成图片模型,内置思考模式,兼顾画质、灵活尺寸与稳定交付。
alibaba/wan-2.7/text-to-image 是一款面向生产场景的文本生成图片模型,可根据自然语言描述生成高质量、细节丰富的图片。该模型支持自定义分辨率、广泛的宽高比范围,并提供默认开启的思考模式,以提升提示词理解、构图一致性与整体画面质量,同时具备无冷启动与高性价比优势。
🚀 核心特性
- 高质量图片生成:能够根据自然语言描述生成细节丰富、光影自然、构图连贯的图片。
- 思考模式增强理解:内置 thinking mode,可在生成前更充分理解提示词意图,提升提示词遵循度与画面一致性。
- 灵活分辨率控制:支持自定义输出尺寸,单边范围为 512–4096 像素,适合封面图、海报、横屏视觉与竖屏内容。
- 广泛宽高比支持:支持从 1:8 到 8:1 的宽高比,覆盖 正方形、横屏、竖屏、宽屏等多种发布场景。
- 无冷启动、即开即用:适合需要稳定响应与持续生成的业务场景,减少等待时间并提升工作流效率。
🛠️ 技术规格
| 项目 | 说明 |
|---|---|
| 模型名称 | alibaba/wan-2.7/text-to-image |
| 模型类型 | 文本生成图片模型 |
| 模型架构 | Wan 2.7 系列文本到图片生成架构 |
| 输入 | 文本提示词 |
| 输出 | 图片 |
| 默认分辨率 | 1024×1024 |
| 分辨率范围 | 宽度与高度均支持 512–4096 像素 |
| 总像素限制 | 总像素需介于 768×768 与 2048×2048 之间 |
| 宽高比范围 | 1:8 至 8:1 |
| 思考模式 | 支持,默认开启;可提升质量,但会增加生成时间 |
| 延迟特征 | 常规模式响应更快;开启思考模式时延迟更高但质量更优 |
| 输出形式 | 单张生成图片 |
示例提示词
A modern tea shop interior, warm afternoon light, minimalist wood design, cinematic photographyA cinematic ocean wave at sunrise, highly detailed, dramatic lighting, ultra realisticA futuristic fashion portrait, neon city background, editorial style, sharp focus
💰 价格
| 计费项 | 价格 |
|---|---|
| 每生成 1 张图片 | $0.03 |
💡 最佳应用场景
- 社交媒体内容制作:快速生成适配不同平台宽高比的视觉素材,如封面图、帖子配图与短视频封面。
- 营销与广告创意:用于活动海报、品牌宣传图、广告概念图等内容的快速产出。
- 概念设计与分镜预览:帮助创作者快速可视化角色、场景、环境与镜头氛围。
- 电商与商品展示:生成商品场景图、生活方式图与营销展示图,降低拍摄与后期成本。
🔗 相关模型
- Wan 2.7 Text-to-Image Pro:更适合高分辨率与生产级工作流,支持更高规格输出。
- Wan 2.6 Text-to-Image:上一代版本,适合对旧版能力或兼容性有需求的场景。
- Seedream V4 Text-to-Image:适合海报、品牌视觉与风格一致性较强的批量生成任务。
- FLUX.2 Dev Text-to-Image:强调提示词遵循与细节表现,适合创意与生产混合工作流。
相关模型
xAI Grok Imagine Image v2.0 文生图
xAI Grok Imagine Image V2.0 文生图可根据文本提示词生成高质量图片,并支持配置宽高比、分辨率和质量,适用于创意视觉、社交内容、营销素材和生产工作流。提供开箱即用的 REST 推理 API,性能出色,无冷启动,价格实惠。
Qwen Image 3.0 Pro 文生图
Qwen Image 3.0 Pro 是一款专业级文生图模型,具备卓越画质和先进的提示词理解能力。最高支持 2k。提供开箱即用的 REST inference API,性能出色,无冷启动,价格实惠。
OpenAI GPT Image 2 文本生成图片
OpenAI 的 GPT Image 2 文本生成图片模型可根据自然语言提示词生成高质量图片。提供即用型 REST 推理 API,性能最佳,无冷启动,价格实惠。
OpenAI GPT Image 2 Edit 图像编辑
OpenAI 的 GPT Image 2 Edit 可通过自然语言指令结合一张或多张参考图片进行图像编辑。提供即用型 REST 推理 API,性能最佳,无冷启动,价格实惠。
Nami Z-Image T2I Spicy
根据文本提示词生成图片,支持自定义宽高、提示词优化和随机种子。
Nano Banana 文生图
Gemini 2.5 Flash 标准版。轻量极速。兼顾速度与成本,是批量生成与快速原型设计的最佳选择。
Nano Banana Pro 文生图
Gemini 3.0 Pro 旗舰版。专为 4K 原生画质打造,支持图像内多语言文字渲染与专业摄影参数控制。
Nano Banana Pro 文生图
Gemini 3.0 Pro 旗舰版。专为 4K 原生画质打造,支持图像内多语言文字渲染与专业摄影参数控制。