Seedream V4 Sequential 画像生成モデル
doubao/seedream-4.0/text-to-image-sequential
Seedream 4.0は、4K画像の生成、編集、キャラクター/オブジェクトの一貫性、連続した複数画像生成をサポートします。すぐに使えるREST API、最高のパフォーマンス、コールドスタートなし、手頃な価格を提供。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成に使用するポジティブプロンプト。 |
| sizeサイズ | text | 2048x2048 | ≤ 500 chars | 生成されるメディアのサイズで、画像の場合は最大4K解像度に対応しています。既存の画像サイズに合わせる必要がある場合は、幅と高さを明示的に指定してください。画像に合わせた自動リサイズはサポートされていません。 |
| max_images最大生成枚数 | slider | 1 | 1 ~ 15 · step 1 | 生成可能な画像の最大枚数(最大15枚)。この値は、上記のプロンプトで指定された画像枚数と一致する必要があります。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/doubao/seedream-4.0/text-to-image-sequential" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A serene landscape featuring a crystal-clear lake surrounded by snow-capped mountains under a vibrant sunset sky, with realistic reflections on the water. Please generate a set of 5 images.",
"size": "3840x2160",
"max_images": 5
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/doubao/seedream-4.0/text-to-image-sequential",
headers=HEADERS,
json={
"input": {
"prompt": "A serene landscape featuring a crystal-clear lake surrounded by snow-capped mountains under a vibrant sunset sky, with realistic reflections on the water. Please generate a set of 5 images.",
"size": "3840x2160",
"max_images": 5
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/doubao/seedream-4.0/text-to-image-sequential", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A serene landscape featuring a crystal-clear lake surrounded by snow-capped mountains under a vibrant sunset sky, with realistic reflections on the water. Please generate a set of 5 images.",
"size": "3840x2160",
"max_images": 5
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Seedream V4 Sequential
最先端のテキストから画像生成モデル、シーケンス一貫性と超高解像度を実現。
Seedream V4 Sequential は、Bytedance によって開発された最先端のテキストから画像生成モデルで、高品質な 4K 画像を生成し、シーケンス内の複数画像セット間で優れたキャラクターやオブジェクトの一貫性を維持します。このモデルは、迅速な反復、正確な編集、画像間の一貫性を最適化しており、商業デザイン、エンターテインメント、クリエイティブ業界に最適です。超高速の推論時間とコールドスタートなしの設計により、Seedream V4 Sequential はシームレスな性能を手頃な価格で提供します。
🚀 主な特徴
- シーケンス一貫性:複数画像セット間でキャラクター、パレット、レイアウトの一貫性を維持し、統一感のある結果を提供。
- 超高解像度:最大 4K の画像生成をサポートし、卓越したディテールと鮮明さを実現。
- 正確な編集:属性変更、オブジェクトの追加/削除、顔の入れ替えやテクスチャ変更などの構造的編集を可能に。
- 高速推論:2K 画像を約 1.8 秒で生成し、迅速な納品を実現。
- マルチモーダル対応:テキストから画像生成、編集、シーケンス生成タスクを単一のパイプラインで処理。
- 手頃な価格:1枚あたり $0.03 の競争力のある価格で、さまざまな用途に対応。
🛠️ 技術仕様
| パラメータ | タイプ | デフォルト値 | 範囲 | 説明 |
|---|---|---|---|---|
| プロンプト | 文字列 | - | - | 生成のためのポジティブプロンプト。 |
| サイズ | 文字列 | 2048×2048 | 512×512 ~ 8192×8192 | 最大 4K 解像度をサポート。カスタムサイズには明確な寸法指定が必要。 |
| 生成枚数 | 整数 | 1 | 1 ~ 15 | 生成可能な最大画像枚数。 |
| Base64 出力を有効化 | ブール値 | False | - | 有効化すると、出力が BASE64 文字列としてエンコードされます。 |
| 同期モードを有効化 | ブール値 | False | - | 結果生成後に応答を返す同期モードを有効化。 |
プロンプト例
- 指示編集: [A] を [B] に置き換える;[照明/スタイル] を保持;[ロゴ/アイデンティティ] を維持。
- テキストから画像生成の一貫性: [シーン/時間/天候] の中の [対象]、[カメラ/レンズ]、[照明]、[スタイル];主要な小道具 [X];構図 [フレーミング]。
- シーケンスセット: [対象/ブランド] の [シナリオ] における [N] 枚の画像を生成;[パレット/ロゴ/アイデンティティ] を一貫して保持;[ポーズ/角度/背景] を変化。
💰 価格
| 解像度 | 画像1枚あたりの価格 |
|---|---|
| 最大 4K | $0.03 |
総価格 = 生成枚数 × $0.03
💡 主な利用ケース
- 商業デザイン:ポスター、アパレルデザイン、パッケージビジュアル、Eコマース素材をブランド安全な編集で作成。
- エンターテインメント IP:スタイル一貫性のあるアニメや映画キャラクター、キービジュアル、ポーズを生成。
- アート制作:高解像度イラストやスタイル探索を美的一貫性を保ちながら制作。
- 建築デザイン:コンセプトレンダリング、ファサード研究、セット全体の素材/照明バリエーションを開発。
🔗 関連モデル
- Seedream V4 Edit Sequential:高度な編集機能に特化。
- Seedream V4.5:追加機能と高性能を備えた拡張版。
関連モデル
xAI Grok Imagine Image v2.0 テキストから画像生成
xAI Grok Imagine Image V2.0 Text-to-Image は、テキストプロンプトから高品質な画像を生成できます。アスペクト比、解像度、品質を設定でき、クリエイティブ制作、SNS コンテンツ、マーケティング素材、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格で利用できます。
Qwen Image 3.0 Pro テキストから画像生成
Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
OpenAI GPT Image 2 テキストから画像生成
OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
OpenAI GPT Image 2 Edit 画像編集
OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Nami Z-Image T2I Spicy
テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。
Nano Banana テキストから画像
Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。