seedance-2-0 text-to-video
doubao/seedance-2-0/text-to-video
Seedance 2.0 为创意而生。本接口提供高性能的视频生成能力,支持文本驱动、多种比例自定义及 AI 同步音频生成,通过精准的参数控制,助您轻松打造电影级视觉效果。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | — | 生成のためのポジティブプロンプト。 |
| generate_audioオーディオ生成 | boolean | true | — | 生成ビデオに画面同期音声を含める設定 |
| resolution解像度 | select | 720p | 480p | 720p | 1080p | 動画解像度 |
| ratioアスペクト比 | select | adaptive | adaptive | 16:9 | 4:3 | 1:1 | 3:4 | 9:16 | 21:9 | 生成動画の画面比率 |
| duration *再生時間 (秒) | select | 5 | -1 | 4 | 5 | 6 | 7 | 8 | 9 | 10 | … | 生成動画の長さ(単位:秒、整数のみ) |
| return_last_frame生成された動画の最後のフレーム画像を返します | boolean | — | — | 生成された動画の最後のフレームを返す必要があるでしょうか? |
| watermark透かしを追加 | boolean | false | — | 生成動画におけるウォーターマークの有無。 |
| seedシード値 | number | -1 | -1 ~ 4294967295 | シード整数は、生成されるコンテンツのランダム性を制御するために使用されます。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/doubao/seedance-2-0/text-to-video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A serene landscape with a futuristic city in the background, glowing with neon lights under a starry night sky.",
"generate_audio": true,
"resolution": "720p",
"ratio": "16:9",
"duration": 6,
"watermark": false,
"seed": -1
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/doubao/seedance-2-0/text-to-video",
headers=HEADERS,
json={
"input": {
"prompt": "A serene landscape with a futuristic city in the background, glowing with neon lights under a starry night sky.",
"generate_audio": True,
"resolution": "720p",
"ratio": "16:9",
"duration": 6,
"watermark": False,
"seed": -1
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/doubao/seedance-2-0/text-to-video", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A serene landscape with a futuristic city in the background, glowing with neon lights under a starry night sky.",
"generate_audio": true,
"resolution": "720p",
"ratio": "16:9",
"duration": 6,
"watermark": false,
"seed": -1
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Doubao-Seedance 2.0
「プロダクションを一つのモデルに」:マルチモーダル融合による精密なビデオ制作。
Seedance 2.0は、ByteDanceが提供する次世代AI動画生成モデルです。「一人映画制作」を現実にするため、革新的なマルチモーダル・レファレンス・システムを搭載。最大12個の素材(画像、動画、音声、テキスト)を組み合わせることで、キャラクターの一貫性、カメラワーク、リズムをピクセル単位で正確に制御できます。
🚀 主な特徴
- マルチモーダル融合制御: 画像9枚+動画3本+音声3本(最大12素材)を同時入力可能。キャラクターの固定や複雑な動作の指定が容易です。
- ネイティブ2K画質: 1080Pおよび2K解像度に対応。映画レベルのライティングと質感を実現し、AI特有の違和感を排除。
- ネイティブ音画同期: リップシンク(口パク)とリズム解析を内蔵。BGMのビートに合わせて動画の動きを自動調整します。
- 卓越した物理演算: 流体、重力、複雑な人間動作をリアルにシミュレート。生成成功率は驚異の**99.5%**を誇ります。
- プロ級のカメラ制御: 自然言語で「ドリーイン」「パン」「ズーム」などの高度なカメラワークや照明の変化を指定可能。
🛠️ 技術仕様
| 項目 | 詳細 |
|---|---|
| アーキテクチャ | Multi-modal Diffusion-Transformer (DiT) |
| 最大解像度 | 2K (標準 1080P) |
| 動画の長さ | 4 - 15 秒 |
| アスペクト比 | 16:9, 9:16, 4:3, 3:4, 21:9, 1:1 |
| 入力モード | テキスト、画像 (最大9)、動画 (最大3)、音声 (最大3) |
| 生成速度 | 1クリップあたり約30〜90秒 |
サンプルプロンプト
- シネマティック: 「雨の夜の街、ネオンが揺れる。黒いコートの男が赤い傘を差して歩く。顔のアップまでゆっくりとズーム。憂鬱な映画風、冷たい色調。」
- 精密制御: 「@Image1 をキャラクターに、@Video1 のカメラワークを参考に、@Audio1 のリズムに合わせて生成。」
💰 料金プラン (火山エンジン API)
| サービスタイプ | 解像度 | 価格 | 概算コスト |
|---|---|---|---|
| 動画生成 (T2V/I2V) | 480p/720p | $7 / 1M トークン | ~1秒あたり $0.15 |
| 動画生成 (V2V) | 480p/720p | $4.3 / 1M トークン | ~1秒あたり $0.09 |
| 動画生成 (T2V/I2V) | 1080p | $7.7 / 1M トークン | ~1秒あたり $0.16 |
| 動画生成 (V2V) | 1080p | $4.7 / 1M トークン | ~1秒あたり $0.1 |
💡 最適な活用シーン
- EC・広告制作: 高品質な商品デモやプロモーション動画を短時間で作成。
- ミュージックビデオ (MV): 曲のテンポに合わせて視覚効果やシーン転換を自動同期。
- SNSコンテンツ: TikTokやReels向けのプロフェッショナルな動画を、高価な機材なしで量産。
関連モデル
xAI Grok Imagine Video v1.5 テキストから動画生成
テキストプロンプトから1-15秒の動画を生成します。480p、720p、1080pに対応しています。
MiniMax H3 テキストから動画生成
MiniMax H3 テキストから動画生成は、プロンプトから一貫性のある 2K 動画を生成できます。4〜15秒の柔軟な長さと、6種類のアスペクト比に対応し、シネマティックなシーン、クリエイティブ動画、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格で利用できます。
Kling Omni Video O3 標準版テキストから動画生成
Kling Omni Video O3 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishouの高度な統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトを基に主体の一貫性、自然な物理シミュレーション、正確な意味理解を備えた映画品質の動画を生成します。音声生成にも対応。すぐに使えるREST API、最高のパフォーマンス、冷スタートなし、手頃な価格。
Kling Omni Video O1 テキストから動画生成
Kling Omni Video O1 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishou初の統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトに基づいて映画品質の動画を生成し、主体の一貫性、自然な物理シミュレーション、正確な意味理解を実現します。すぐに使えるREST API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling 3.0 標準版
Kling 3.0 標準版は、高品質なテキストから動画生成を提供します。滑らかな動き、映画のような映像、正確なプロンプトの適合性、そして共有可能なクリップ用のネイティブ音声を備えています。即時利用可能な REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling V2.6 テキストから動画生成 API
Kling 2.6 は、滑らかなモーション、映画のようなビジュアル、強力なプロンプト適合性、そしてネイティブオーディオを備えた、トップクラスのテキストから動画生成を提供します。共有可能なクリップを即座に生成可能。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Gemini Omni Flash テキストから動画生成 API
Gemini Omni Flash Text to Video は、テキストのプロンプトから音声同期付きの短い AI 動画を生成し、映像生成と音声出力を組み合わせて高速なマルチモーダル動画作成を実現します。すぐに使える REST 推論 API で、高性能、コールドスタートなし、手頃な価格です。
Seedance 2.0 Mini テキストから動画生成
Seedance 2.0 Mini Text to Video は、ByteDance による高速かつ低コストなテキストから動画生成モデルで、シネマティックなマルチショット動画に適しています。テキストのプロンプトから物語性のあるシーケンスを生成し、AI カメラ制御、シーン間で一貫したキャラクター、480P / 720P / 1080P / 4K 出力、4〜15 秒の長さ、柔軟なアスペクト比に対応しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格が特長です。