Seedream V5.0 Pro テキストから画像生成 API
doubao/seedream-v5.0-pro/text-to-image
ByteDance の Seedream V5.0 Pro テキストから画像生成モデルは、テキストプロンプトから高品質な画像を生成できます。アスペクト比の選択、優れたプロンプト追従性、1K / 2K の出力階層に対応し、柔軟な画像作成が可能です。すぐに使える REST 推論 API で、高性能、コールドスタートなし、手頃な価格を実現しています。
サンプル



パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成に使用するポジティブプロンプトです。 |
| resolution *解像度 | select | 1k | 1k | 2k | 課金に使用される出力解像度の階層です。1k は低コストの階層、2k は高コストの階層です。 |
| aspect_ratioアスペクト比 | select | 1:1 | 1:1 | 1:2 | 2:1 | 1:3 | 3:1 | 2:3 | 3:2 | 3:4 | … | 生成される画像のアスペクト比です。 |
| output_format出力形式 | select | — | jpeg | png | 出力画像の形式。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/doubao/seedream-v5.0-pro/text-to-image" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic portrait of a young astronaut standing in a lush bioluminescent forest at dusk, soft blue and purple lighting, intricate space suit details, floating particles in the air, ultra-realistic, highly detailed, atmospheric depth, sharp focus",
"resolution": "2k",
"aspect_ratio": "4:5",
"output_format": "png"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/doubao/seedream-v5.0-pro/text-to-image",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic portrait of a young astronaut standing in a lush bioluminescent forest at dusk, soft blue and purple lighting, intricate space suit details, floating particles in the air, ultra-realistic, highly detailed, atmospheric depth, sharp focus",
"resolution": "2k",
"aspect_ratio": "4:5",
"output_format": "png"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/doubao/seedream-v5.0-pro/text-to-image", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic portrait of a young astronaut standing in a lush bioluminescent forest at dusk, soft blue and purple lighting, intricate space suit details, floating particles in the air, ultra-realistic, highly detailed, atmospheric depth, sharp focus",
"resolution": "2k",
"aspect_ratio": "4:5",
"output_format": "png"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Seedream V5.0 Pro Text to Image API
高品質な画像生成、優れたプロンプト追従性、柔軟なアスペクト比、そしてコールドスタートなしの安定運用。
Seedream V5.0 Pro は、ByteDance が提供する高度なテキストから画像生成モデルです。高いプロンプト追従性、柔軟なアスペクト比設定、1K/2K の出力階層、そしてコールドスタートなしの応答性を備えており、クリエイティブ制作、マーケティング、実運用ワークフローに適したバランスの良いモデルです。
🚀 主な特長
- 高品質な画像生成:高精細で完成度の高いビジュアル生成に最適化されており、商用・制作用途にも適しています。
- 優れたプロンプト追従性:被写体、シーン、スタイル、ライティング、構図などの指示を的確に反映しやすい設計です。
- 柔軟なアスペクト比:正方形、縦向き、横向き、縦長、ワイドスクリーン、ウルトラワイドまで幅広く対応します。
- シンプルな解像度階層:1k は低コストな試行向け、2k は高解像度の最終出力向けに使い分けできます。
- 標準的な出力形式:jpeg と png に対応し、一般的な制作フローへ組み込みやすくなっています。
- コールドスタートなし:安定したレスポンスが求められる本番環境や継続的な生成ワークロードに適しています。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデル名 | Seedream V5.0 Pro |
| モデル ID | bytedance/seedream-v5.0-pro |
| タスク種別 | テキストから画像生成 |
| モデルアーキテクチャ | ByteDance の高度なテキストから画像生成モデル |
| 入力 | テキストのプロンプト |
| 出力 | 単一の画像 |
| 出力形式 | jpeg、png |
| アスペクト比 | 1:1、1:2、2:1、1:3、3:1、2:3、3:2、3:4、4:3、4:5、5:4、9:16、16:9、9:21、21:9 |
| 解像度 | 1k、2k |
| デフォルトのアスペクト比 | 1:1 |
| デフォルトの解像度 | 1k |
| デフォルトの出力形式 | jpeg |
| レイテンシ特性 | コールドスタートなし、応答性の高い生成向け |
| 典型的なワークフロー | プロンプトを作成 → アスペクト比を選択 → 解像度を選択 → 出力形式を選択 → 画像を生成 |
サンプルプロンプト
高級スキンケア商品の広告ビジュアル、ガラスボトルを大理石の上に配置、柔らかなサイドライト、ミニマルな背景、プレミアムな商業写真、シャープなディテール雨上がりの未来都市の夜景、路面にネオンが反射、シネマティックな広角構図、青紫のカラーパレット、超高精細オリジナルのアニメ風キャラクターデザインシート、全身正面、クリーンな背景、衣装ディテール豊富、鮮やかなイラストスタイル
💰 価格
| 解像度 | 価格 |
|---|---|
| 1k | $0.045 |
| 2k | $0.090 |
💡 最適なユースケース
- マーケティング用ビジュアル制作:広告クリエイティブ、SNS 用画像、販促素材、ブランドビジュアルの生成に適しています。
- クリエイティブコンセプト開発:キャラクター、背景、商品、ビジュアルスタイルの初期検討を効率化できます。
- EC・ブランド向け制作:掲載面に合わせた商品画像、バナー、プロモーション素材を柔軟に生成できます。
- 本番向け画像ワークフロー:1k で低コストに反復し、2k で高解像度の最終成果物を出力する運用に適しています。
🔗 関連モデル
- Seedream V5.0 Pro Edit:既存画像に対するテキスト指示ベースの編集向けモデルです。
- Seedream V5.0 Lite:効率性やコスト重視の用途に適した軽量版モデルです。
関連モデル
xAI Grok Imagine Image v2.0 テキストから画像生成
xAI Grok Imagine Image V2.0 Text-to-Image は、テキストプロンプトから高品質な画像を生成できます。アスペクト比、解像度、品質を設定でき、クリエイティブ制作、SNS コンテンツ、マーケティング素材、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格で利用できます。
Qwen Image 3.0 Pro テキストから画像生成
Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
OpenAI GPT Image 2 テキストから画像生成
OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
OpenAI GPT Image 2 Edit 画像編集
OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Nami Z-Image T2I Spicy
テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。
Nano Banana テキストから画像
Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。