Qwen Image 3.0 テキストから画像生成

alibaba/qwen-image-3.0/text-to-image

Qwen Image 3.0 は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2K に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。

サンプル

Qwen Image 3.0 テキストから画像生成 example 1

パラメータ

名前既定制約説明
prompt *プロンプトtextarea≤ 5000 chars生成したい画像を説明するテキストプロンプトです。中国語と英語に対応
sizeサイズtext≤ 16 chars幅*高さの形式。512*512〜2048*2048(例:1024*1024、1280*720)。未指定の場合はモデルが自動的に解像度を選択します。
n生成枚数number11 ~ 6 · step 11回で1〜6枚の画像を生成
negative_promptネガティブプロンプトtextarea画像に含めたくない内容を記述
prompt_extendプロンプト拡張booleantrueプロンプトを自動的に拡張・最適化します。公式推奨。短いプロンプトに効果的。
seedシード値number0 ~ 2147483647 · step 1結果を再現するためのシード値(0-2147483647)。未指定の場合はランダム。

API

統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。

cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/alibaba/qwen-image-3.0/text-to-image" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "input": {
    "prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
    "n": 1,
    "prompt_extend": true
  }
}'

# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
  -H "Authorization: Bearer YOUR_API_KEY"
Python
import time, requests

API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}

# 1) Submit
resp = requests.post(
    "https://www.namifusion.com/api/v1/marketplace/run/alibaba/qwen-image-3.0/text-to-image",
    headers=HEADERS,
    json={
        "input": {
            "prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
            "n": 1,
            "prompt_extend": True
        }
    },
)
resp.raise_for_status()  # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()

# 2) Poll until a terminal state (completed / failed / cancelled).
#    This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
    if time.time() > deadline:
        raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
    time.sleep(3)
    poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
    poll.raise_for_status()
    task = poll.json()

print(task["status"], task.get("output"))
JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };

// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/alibaba/qwen-image-3.0/text-to-image", {
  method: "POST",
  headers: { ...HEADERS, "Content-Type": "application/json" },
  body: JSON.stringify({
    "input": {
      "prompt": "A cinematic portrait, dramatic rim light, shallow depth of field",
      "n": 1,
      "prompt_extend": true
    }
  }),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();

// 2) Poll until a terminal state (completed / failed / cancelled).
//    This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
  if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
  await new Promise((r) => setTimeout(r, 3000));
  const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
  if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
  task = await poll.json();
}

console.log(task.status, task.output);

ドキュメント

Qwen Image 3.0 テキストから画像生成

高品質・高度なプロンプト理解・安定運用を兼ね備えたプロ向け文生画像モデルです。

Qwen Image 3.0 Text to Image は、自然言語から高品質な画像を生成するために設計された、プロフェッショナル向けの文生画像モデルです。中国語と英語のプロンプトに対応し、最大 2K の出力、コールドスタートなしの安定した推論性能、そして導入しやすい価格帯を備えており、品質と運用性の両方を重視する用途に適しています。

🚀 主な特長

  • プロ品質の画像生成:商用クリエイティブやビジュアル制作に適した高精細な画像を生成できます。
  • 高度なプロンプト理解:複雑な記述や細かな条件をより正確に解釈し、意図に沿った出力を実現します。
  • 最大 2K 出力:最大 2048×2048 の高精細な画像生成に対応します。
  • バッチ生成:1 回のリクエストで最大 6 枚まで生成でき、アイデア出しと選定を効率化します。
  • スマート解像度:サイズ未指定の場合、プロンプトに応じてモデルが最適な解像度を自動選択します。
  • 中国語・英語のプロンプト対応:多言語環境でも柔軟に利用しやすく、制作フローを統一できます。
  • コールドスタートなし:待機時間を抑えた安定した推論性能により、継続的な利用に適しています。
  • 優れたコスト効率:品質・安定性・価格のバランスに優れ、スケール利用にも向いています。

🛠️ 技術仕様

項目内容
モデルアーキテクチャプロフェッショナル向け文生画像モデル
タスクタイプテキストから画像生成
入力テキストプロンプト
出力形式画像
プロンプト中国語・英語に対応
プロンプト自動最適化標準で有効(自動拡張・最適化)
解像度512×512〜2048×2048。未指定の場合はモデルが自動選択
サイズ指定幅*高さ 形式で指定(例:10241024、1280720)
生成枚数1 リクエストあたり 1〜6 枚
シード値任意指定。0〜2147483647 で再現性を確保、未指定の場合はランダム
品質特性プロ向けの高忠実度画像生成
レイテンシコールドスタートなしの応答性を重視して最適化

サンプルプロンプト

  • 中国語:一张电影感十足的未来城市夜景,霓虹灯反射在雨后的街道上,超高细节,真实光影
  • 中国語:极简风产品摄影,一只白色陶瓷杯置于浅灰背景中央,柔和棚拍光,干净构图
  • English: A cinematic portrait of a traveler standing in a desert at sunset, dramatic lighting, ultra-detailed, realistic style

💰 価格

項目価格
生成画像(全解像度共通)$0.03 / 枚

生成枚数に応じた課金です。1 回のリクエストで n 枚生成した場合、$0.03 × n が課金されます。サイズ未指定(スマート解像度)も同一料金です。

💡 主なユースケース

  • EC・広告クリエイティブ:商品ビジュアル、広告用コンセプト、ブランド素材の制作に適しています。
  • ソーシャルメディア向け制作:カバー画像、告知ビジュアル、キャンペーン素材を迅速に作成できます。
  • デザイン検討・コンセプト開発:初期段階でスタイルや構図の方向性を素早く比較・検証できます。
  • 多言語コンテンツ制作:中国語と英語の両方のプロンプトを扱うチームに適しています。

関連モデル

Qwen Image 3.0 Pro テキストから画像生成
Text to ImageQwen Image 3.0 Pro

Qwen Image 3.0 Pro テキストから画像生成

Qwen Image 3.0 Pro は、優れた画質と高度なプロンプト理解を備えたプロ向けのテキストから画像生成モデルです。最大 2k に対応。すぐに使える REST inference API を提供し、高性能・コールドスタートなし・手頃な価格を実現しています。

$0.080 / 1 回
OpenAI GPT Image 2 テキストから画像生成
Text to ImageOpenAI

OpenAI GPT Image 2 テキストから画像生成

OpenAI の GPT Image 2 テキストから画像生成モデルは、自然言語プロンプトから高品質な画像を生成します。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

$0.220 / 1 回
OpenAI GPT Image 2 Edit 画像編集
Text to ImageOpenAI

OpenAI GPT Image 2 Edit 画像編集

OpenAI の GPT Image 2 Edit は、自然言語の指示と1枚以上の参照画像を使用して画像編集を可能にします。すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

$0.220 / 1 回
Nami Z-Image T2I Spicy
Text to Image

Nami Z-Image T2I Spicy

テキストプロンプトから画像を生成します。幅、高さ、プロンプト最適化、シードを設定できます。

$0.020 / 1 回
Nano Banana テキストから画像
Text to ImageGoogle

Nano Banana テキストから画像

Gemini 2.5 Flash Image。軽量かつ高速。大量生成やプロトタイピングに最適な、最も手頃なモデル。

$0.040 / 1 回
Nano Banana Pro テキストから画像
Text to ImageGoogle

Nano Banana Pro テキストから画像

Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。

$0.140 / 1 回
Nano Banana Pro テキストから画像
Text to ImageGoogle

Nano Banana Pro テキストから画像

Gemini 3.0 Pro Image。4K 高画質、多言語テキスト描画、プロ仕様のカメラ制御に対応したハイエンドモデル。

$0.070 / 1 回
Google Nano Banana Lite テキストから画像生成 API
Text to ImageGoogle

Google Nano Banana Lite テキストから画像生成 API

Google Nano Banana 2 Lite Text to Image は、テキストのプロンプトから高品質な画像を低レイテンシで生成できます。柔軟なアスペクト比に対応し、クリエイティブ制作や実運用のワークフローで素早く画像を作成できます。すぐに使える REST 推論 API、優れたパフォーマンス、コールドスタートなし、手頃な価格。

$0.040 / 1 回