Nano Banana Pro テキストから画像
google/nano-banana-pro/text-to-image
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
サンプル



パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成したい画像を説明してください。被写体、スタイル、色、構図について具体的に記述してください。 |
| aspect_ratioアスペクト比 | select | 16:9 | 1:1 | 3:2 | 2:3 | 3:4 | 4:3 | 4:5 | 5:4 | 9:16 | … | 生成する画像のアスペクト比を選択してください。 |
| resolution解像度 | select | 1k | 1k | 2k | 4k | 出力画像の解像度を選択してください。 |
出力フィールド
| フィールド | 型 | 説明 |
|---|---|---|
| images | array<string> | Generated image URLs |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/google/nano-banana-pro/text-to-image" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic, photorealistic wide shot of a futuristic coffee shop interior with floor-to-ceiling glass windows overlooking a rainy cyberpunk city skyline. A glowing neon sign on the wall explicitly reads '\''NANO BANANA'\''. 85mm lens, f/1.8 depth of field, volumetric lighting, ray tracing, hyper-detailed textures, 8k resolution.",
"aspect_ratio": "21:9",
"resolution": "4k"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/google/nano-banana-pro/text-to-image",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic, photorealistic wide shot of a futuristic coffee shop interior with floor-to-ceiling glass windows overlooking a rainy cyberpunk city skyline. A glowing neon sign on the wall explicitly reads 'NANO BANANA'. 85mm lens, f/1.8 depth of field, volumetric lighting, ray tracing, hyper-detailed textures, 8k resolution.",
"aspect_ratio": "21:9",
"resolution": "4k"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/google/nano-banana-pro/text-to-image", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic, photorealistic wide shot of a futuristic coffee shop interior with floor-to-ceiling glass windows overlooking a rainy cyberpunk city skyline. A glowing neon sign on the wall explicitly reads 'NANO BANANA'. 85mm lens, f/1.8 depth of field, volumetric lighting, ray tracing, hyper-detailed textures, 8k resolution.",
"aspect_ratio": "21:9",
"resolution": "4k"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Google Nano Banana Pro (Gemini 3.0 Pro Image)
Gemini 3.0 を搭載した最先端の 4K 画像生成 AI —— 高速かつ高精細。
Google Nano Banana Pro は、軽量かつ強力な AI 画像生成モデルです。コールドスタートなしで即座に推論が可能で、最大 4K の高解像度画像を生成します。シンプルなテキストプロンプトから、鮮明で表現力豊かなビジュアルを数秒で作り出すことができ、クリエイターや開発者のワークフローを革新します。
🚀 主な機能
- 超高解像度 (4K): モバイルや Web に最適化された、ネイティブ 4K 画像生成をサポート。
- 画像内テキスト生成: 複数言語に対応したテキストを画像内に生成・編集可能。フォントの明瞭さとレイアウトが自動的に最適化されます。
- コンテキスト認識型編集: 自然言語による指示で画像を修正できます。シーンの構造やオブジェクト間の関係を理解し、違和感のない編集を実現します。
- カメラコントロール: アングル、フォーカス、被写界深度、カラーグレーディングなどの撮影パラメータを指定し、写真のような仕上がりを追求できます。
- 一貫性の維持: キャラクターのアイデンティティやブランドスタイルを維持したまま、複数のバリエーションを生成可能です。
- 柔軟なアスペクト比: 1:1 から 9:16、21:9 まで、SNS フィードやバナー、印刷物などあらゆる用途に対応します。
🛠️ 技術仕様
| パラメータ | 詳細 |
|---|---|
| モデルアーキテクチャ | Gemini 3.0 Pro Image |
| 入力 | テキストプロンプト、自然言語による指示 |
| 出力 | 高品質 JPEG / PNG |
| レイテンシ | 即時推論 (コールドスタートなし) |
プロンプト例:
“夕暮れのひまわり畑で遊ぶゴールデンレトリバー” “濡れた路面にネオンが反射する近未来都市のスカイライン” “窓際にあるコーヒーとクロワッサンのエレガントな静物写真”
💰 料金プラン
| 解像度 | 画像あたりのコスト |
|---|---|
| 1k (標準) | $0.14 |
| 2k (高解像度) | $0.14 |
| 4k (超高解像度) | $0.24 |
💡 ユースケース
- SNS & マーケティング: ブランドイメージに合ったビジュアルを瞬時に作成。
- Eコマース & 広告: 商品撮影なしで高品質な製品イメージを生成。
- コンセプトアート: 企画書やムードボードのためのアイデア出しを効率化。
- 教育 & プレゼンテーション: 複雑なアイデアを視覚化し、わかりやすく伝達。
📊 モデル比較
他社モデルとの比較:
- vs. FLUX.1 [dev]: Nano Banana Pro は、手動マスキング不要のレイアウト認識編集と意味理解に優れています。一方、FLUX.1 は細部の解像度制御に特化しています。
- vs. GPT-Image-1 (OpenAI): GPT-Image-1 は汎用的な生成に優れていますが、Nano Banana Pro はデザインワークフロー(レイアウト制御や多言語テキスト)において強力なパフォーマンスを発揮します。
- vs. 初代 Nano Banana: Pro 版は、推論能力、テキストの鮮明さ、カメラ制御機能が大幅に向上しており、より高品質な出力を求めるユーザーに適しています。
注記: プロンプトは Google の安全ガイドラインに準拠している必要があります。制限されたコンテンツが含まれる場合、エラーが発生する可能性があります。
関連モデル
xAI Grok Imagine Image v2.0 テキストから画像生成
xAI Grok Imagine Image V2.0 Text-to-Image は、テキストプロンプトから高品質な画像を生成できます。アスペクト比、解像度、品質を設定でき、クリエイティブ制作、SNS コンテンツ、マーケティング素材、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格で利用できます。
Qwen Image 3.0 Pro テキストから画像生成
Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。
OpenAI GPT Image 2 テキストから画像生成
OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
OpenAI GPT Image 2 Edit 画像編集
OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Nami Z-Image T2I Spicy
テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。
Nano Banana テキストから画像
Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。
Nano Banana Pro テキストから画像
Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。
Google Nano Banana Lite テキストから画像生成 API
Google Nano Banana 2 Lite Text to Image は、テキストのプロンプトから高品質な画像を低レイテンシで生成できます。柔軟なアスペクト比に対応し、クリエイティブ制作や実運用のワークフローで素早く画像を作成できます。すぐに使える REST 推論 API、優れたパフォーマンス、コールドスタートなし、手頃な価格。