xAI Grok Imagine Image v2.0 テキストから画像生成
x-ai/grok-imagine-image-v2.0/text-to-image
xAI Grok Imagine Image V2.0 Text-to-Image は、テキストプロンプトから高品質な画像を生成できます。アスペクト比、解像度、品質を設定でき、クリエイティブ制作、SNS コンテンツ、マーケティング素材、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格で利用できます。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成する画像のテキスト説明。 |
| aspect_ratioアスペクト比 | select | 1:1 | 1:1 | 16:9 | 9:16 | 4:3 | 3:4 | 3:2 | 2:3 | 2:1 | … | 生成される画像のアスペクト比。 |
| resolution解像度 | select | 2k | 1k | 2k | 出力画像の解像度レベル。 |
| quality品質 | select | medium | low | medium | 生成品質のレベル。 |
| n画像数 | slider | 1 | 1 ~ 10 | 生成する画像の数(1-10)。各画像は個別に課金されます。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/x-ai/grok-imagine-image-v2.0/text-to-image" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic futuristic city skyline at sunset, viewed from a rooftop garden, with glowing neon signs, flying vehicles, reflective glass towers, and soft golden light breaking through dramatic clouds; ultra-detailed, photorealistic, vibrant colors, sharp focus",
"aspect_ratio": "16:9",
"resolution": "2k",
"quality": "medium",
"n": 3
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/x-ai/grok-imagine-image-v2.0/text-to-image",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic futuristic city skyline at sunset, viewed from a rooftop garden, with glowing neon signs, flying vehicles, reflective glass towers, and soft golden light breaking through dramatic clouds; ultra-detailed, photorealistic, vibrant colors, sharp focus",
"aspect_ratio": "16:9",
"resolution": "2k",
"quality": "medium",
"n": 3
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 600s server-side.
deadline = time.time() + 660
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/x-ai/grok-imagine-image-v2.0/text-to-image", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic futuristic city skyline at sunset, viewed from a rooftop garden, with glowing neon signs, flying vehicles, reflective glass towers, and soft golden light breaking through dramatic clouds; ultra-detailed, photorealistic, vibrant colors, sharp focus",
"aspect_ratio": "16:9",
"resolution": "2k",
"quality": "medium",
"n": 3
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 600s server-side.
const deadline = Date.now() + 660 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
xAI Grok Imagine Image v2.0 テキストから画像生成
コールドスタートなしで高品質な画像を生成し、迅速な制作と本番ワークフローに適したモデルです。
xAI Grok Imagine Image V2.0 Text-to-Image は、自然言語のプロンプトから高品質なビジュアルを生成します。アスペクト比・解像度・品質を設定でき、安定したレイテンシと予測しやすいコストで、アイデア出しから本番納品まで幅広く利用できます。
🚀 主な特徴
- 高品質な画像生成:自然言語プロンプトから、細部まで描き込まれた画像を生成します。
- 柔軟なアスペクト比:SNS・EC・コンテンツ配信に適した 13 種類の比率に対応します。
- 1k / 2k 解像度:1k で高速に試し、2k で仕上げの素材を出力できます。
- 調整可能な品質ランク:
lowとmediumにより、速度・コスト・仕上がりのバランスを取れます。 - バッチ生成:1 リクエストで最大 10 枚まで生成でき、検討と選定を高速化します。
- コールドスタートなし:高頻度の呼び出しや安定運用が必要な本番環境に適しています。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデル構成 | テキストから画像生成するモデル |
| タスク種別 | テキストから画像生成 |
| 入力 | テキストプロンプト |
| 出力 | 画像 |
| 1 リクエストの生成枚数 | 1〜10 枚(n、既定値 1) |
| アスペクト比 | 1:1、16:9、9:16、4:3、3:4、3:2、2:3、2:1、1:2、19.5:9、9:19.5、20:9、9:20 |
| 既定のアスペクト比 | 1:1 |
| 解像度 | 1k、2k(既定値:2k) |
| 品質 | low、medium(既定値:medium) |
| レイテンシ | 公表値なし。コールドスタートのない安定した推論に対応 |
| 想定ワークフロー | クリエイティブ生成、ビジュアル検討、マーケティング素材、本番向け画像出力 |
プロンプト例
- 映画のような海の日の出。うねる大波、金色の朝日、高精細、写実的な写真表現
- ミニマルな高級スキンケア製品の商品写真。清潔感のある背景、柔らかいスタジオ照明、広告品質
- 近未来都市の夜景コンセプトアート。ネオンの反射、雨上がりの路面、広角レンズ、サイバーパンク
💰 Pricing
| 品質 | 解像度 | 1 枚あたりの価格 |
|---|---|---|
| low | 1k | $0.04 |
| low | 2k | $0.06 |
| medium | 1k | $0.06 |
| medium | 2k(デフォルト) | $0.08 |
課金に関する注意
- 品質ランク × 解像度 で価格が決まり、4 つの組み合わせはすべて異なります。
- 合計金額 = 1 枚あたりの価格 ×
n(生成枚数)。 - アスペクト比は価格に影響しません。
- 品質・解像度を指定しない場合は、既定値の
medium+2kで課金されます。
💡 主なユースケース
- マーケティング・SNS ビジュアル:広告クリエイティブ、キャンペーンポスター、SNS 用画像、ブランドコンテンツ。
- アイデア出しとコンセプト設計:コンセプトアート、シーン検討、キャラクターの方向性、ビジュアル提案。
- EC・商品ビジュアル:商品シーン、ブランド素材、販促ビジュアル。
- コンテンツ制作ワークフロー:安定した出力、頻繁な反復、コスト管理が求められる工程。
🔗 関連モデル
- xAI Grok Imagine Image v2.0 画像編集:テキスト指示で既存画像を編集します。参照画像は最大 5 枚です。
- xAI Grok Imagine Video v1.5 テキストから動画生成:同シリーズの動画生成モデルです。
関連モデル
Qwen Image 3.0 Pro テキストから画像生成
Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
OpenAI GPT Image 2 テキストから画像生成
OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
OpenAI GPT Image 2 Edit 画像編集
OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Nami Z-Image T2I Spicy
テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。
Nano Banana テキストから画像
Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Google Nano Banana Lite テキストから画像生成 API
Google Nano Banana 2 Lite Text to Image は、テキストのプロンプトから高品質な画像を低レイテンシで生成できます。柔軟なアスペクト比に対応し、クリエイティブ制作や実運用のワークフローで素早く画像を作成できます。すぐに使える REST 推論 API、優れたパフォーマンス、コールドスタートなし、手頃な価格。