alibaba/wan-2.2-spicy/image-to-video
alibaba/wan-2.2-spicy/image-to-video
使用首帧与可选末帧生成连贯动态视频,支持 5/8 秒、480p/720p 输出与提示词智能扩写。
示例
参数
| 名称 | 类型 | 默认 | 约束 | 说明 |
|---|---|---|---|---|
| image *首帧图片 | image_upload | — | image/* · 0–1 items | 作为本次请求视觉输入的图片 URL。 |
| last_image末帧图片 | image_upload | — | image/* · 0–1 items | 用于约束视频结束画面的可选末帧图片 URL。 |
| prompt *提示词 | textarea | — | ≤ 5000 chars | 描述期望的主体、动作、构图、镜头运动、光线与风格。 |
| duration时长 | select | 5 | 5 | 8 | 选择输出视频的时长,单位为秒。 |
| resolution分辨率 | select | 480p | 480p | 720p | 选择输出分辨率或供应商生成模式;较高设置可能需要更长处理时间。 |
| prompt_extend提示词智能扩写 | boolean | true | — | 在生成前自动为较短的提示词补充视觉细节。 |
| seed随机种子 | number | — | ≥ 0 · step 1 | 用于复现结果的可选随机种子;留空时使用随机值。 |
输出字段
| 字段 | 类型 | 说明 |
|---|---|---|
| videos | array<string> |
API
通过统一 REST API 调用本模型;在 API Keys 页获取密钥。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.2-spicy/image-to-video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"image": [
"https://assets-public.namifusion.com/marketplace/images/2026-06-12/638e1ee18ac7.jpeg"
],
"prompt": "Animate the subject with natural motion, a slow cinematic camera push-in, soft wind, stable anatomy, and consistent lighting.",
"duration": 5,
"resolution": "480p",
"prompt_extend": true
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.2-spicy/image-to-video",
headers=HEADERS,
json={
"input": {
"image": [
"https://assets-public.namifusion.com/marketplace/images/2026-06-12/638e1ee18ac7.jpeg"
],
"prompt": "Animate the subject with natural motion, a slow cinematic camera push-in, soft wind, stable anatomy, and consistent lighting.",
"duration": 5,
"resolution": "480p",
"prompt_extend": True
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/alibaba/wan-2.2-spicy/image-to-video", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"image": [
"https://assets-public.namifusion.com/marketplace/images/2026-06-12/638e1ee18ac7.jpeg"
],
"prompt": "Animate the subject with natural motion, a slow cinematic camera push-in, soft wind, stable anatomy, and consistent lighting.",
"duration": 5,
"resolution": "480p",
"prompt_extend": true
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);文档
alibaba/wan-2.2-spicy/image-to-video
将静态图片生成可控的 5 秒或 8 秒视频,并支持可选末帧引导。
Wan 2.2 Spicy 图片转视频模型以输入图片和提示词为基础,在尽量保持主体身份、构图与整体视觉风格的同时补充人物动作、镜头运动和环境变化。模型提供两档常用分辨率、可选末帧控制、提示词扩写与随机种子,既适合快速预览,也适合制作完整的内容素材。
核心特性
- 以图片为视觉锚点:围绕输入图片生成连贯动作,减少主体与场景在时间维度上的漂移。
- 可选末帧引导:通过
last_image指定结束画面,让视频逐步过渡到目标构图。 - 两种视频时长:支持生成 5 秒或 8 秒片段。
- 480p 与 720p 输出:可根据交付质量、生成速度和积分消耗选择合适档位。
- 提示词自动扩写:开启
prompt_extend后,可在生成前补充简短描述中的视觉细节。 - 随机种子控制:指定相同种子,可获得更便于对比的生成变体。
技术规格
| 项目 | 说明 |
|---|---|
| 任务类型 | 图片转视频 |
| 必填输入 | image、prompt |
| 可选输入 | last_image、seed |
| 分辨率 | 480p(默认)、720p |
| 时长 | 5 秒(默认)、8 秒 |
| 提示词扩写 | 支持,默认开启 |
| 输出 | 生成视频 URL |
示例提示词
人物保持自然呼吸并轻微转头,镜头缓慢推进,微风吹动头发,动作连贯,暖色傍晚光线。商品始终位于画面中央,镜头轻柔环绕,表面反光自然移动,高级棚拍灯光。角色身后的云层缓慢移动,衣料随微风摆动,浅景深,电影感且时间一致。
计费
| 分辨率 | 5 秒 | 8 秒 |
|---|---|---|
| 480p | 10 积分 | 16 积分 |
| 720p | 20 积分 | 32 积分 |
开启提示词扩写时,每次请求额外增加 0.1 积分。以上内容原样反映现有 Marketplace 计费配置,本次文档修复不会修改价格。
最佳应用场景
- 将人像、插画或活动主视觉制作成社交媒体短视频。
- 为广告、电商详情页和演示材料生成商品动态镜头。
- 将分镜图和概念图快速转换为可评审的动画片段。
- 使用首末帧约束制作具有明确目标画面的转场视频。
使用建议
优先选择清晰、主体明确且构图稳定的输入图片。提示词中分别描述主体动作、镜头方式、光线和氛围,避免一次要求过多互相冲突的运动。使用末帧时,应确保首末图片中的主体、视角和风格具有合理的连续关系。
相关模型
xAI Grok Imagine Video v1.5 图片转视频
使用文本提示词将单张输入图片生成 1-15 秒视频,支持 480p 和 720p。
vidu/q3/image-to-video-spicy 图片转视频
Vidu Q3 Image-to-Video Spicy 可从图片生成不限量的高质量视频,动画流畅、运动表现丰富,并针对大规模内容生成进行了优化。提供开箱即用的 REST 推理 API,性能出色,无冷启动,价格实惠。
Vidu Q3 图片转视频
Vidu Q3 图片转视频将文本提示词转化为高质量视频,具有卓越的视觉保真度和多样的运动。即用型 REST 推理 API,最佳性能,无冷启动,价格实惠。

MiniMax H3 Spicy 图片转视频
通过首帧图片生成视频,支持可选提示词和末帧引导。可选 480p、540p、768p、1080p 分辨率,时长为 3–15 秒。
MiniMax H3 图片转视频
MiniMax H3 图片转视频可将首帧图片动画化为连贯的 2K 视频,支持自然语言运动指令,并可选用末帧控制,以实现一致的运动、场景连贯性和电影感视频生成。提供开箱即用的 REST 推理 API,性能出色,无冷启动,价格实惠。
ltx-2.5/image-to-video 图片转视频
LTX 2.5 图片转视频可将首帧图片动画化,生成高保真、音视频同步的内容,并支持可选的末帧引导以及 720P / 1080P / 2K / 4K 输出,适用于电影感视频、社交内容、广告和制作流程。提供开箱即用的 REST 推理 API,性能出色,无冷启动,价格实惠。
ai/ltx-2.3-spicy/image-to-video-lora 图片转视频
LTX 2.3 Spicy LoRA 图片转视频 API 可将参考图片和提示词转换为富有表现力的 AI 视频,并支持选择 LoRA 预设、可选的 LoRA 强度覆盖、时长和分辨率控制。在 MaaS 上可快速进行 REST 推理,无冷启动,价格实惠。
ai/ltx-2.3-spicy/image-to-video 图片转视频
LTX 2.3 Spicy Image-to-Video API 可根据参考图片和提示词生成富有表现力的 AI 视频。可选择风格预设、时长和分辨率,依托 MaaS 提供快速 REST 推理、无冷启动和实惠价格。