Kling 3.0 標準版
kwaivgi/kling-v3.0/text-to-video
Kling 3.0 標準版は、高品質なテキストから動画生成を提供します。滑らかな動き、映画のような映像、正確なプロンプトの適合性、そして共有可能なクリップ用のネイティブ音声を備えています。即時利用可能な REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| promptプロンプト | textarea | — | ≤ 5000 chars | 生成時に使用するポジティブプロンプト。 |
| negative_promptネガティブプロンプト | textarea | — | ≤ 5000 chars | 生成時に使用するネガティブプロンプト。 |
| duration長さ | select | 5 | 3 | 4 | 5 | 6 | 7 | 8 | 9 | 10 | … | 生成されたメディアの長さ(秒単位)。 |
| resolution生成モード | select | 720P | 720P | 1080P | 4K | |
| aspect_ratioアスペクト比 | select | 16:9 | 16:9 | 9:16 | 1:1 | 生成された動画のアスペクト比。 |
| cfg_scaleCFG スケール | slider | 0.5 | 0 ~ 1 · step 0.01 | 動画生成の柔軟性;値が高いほどモデルの柔軟性が低くなり、ユーザーのプロンプトとの関連性が強くなります。 |
| sound音声 | boolean | false | — | 動画生成時に音声を同時に生成するかどうか。 |
| element_list要素リスト | array<object> | — | 0–3 items | 要素参照リスト。 |
| ↳element_idElement Id | text | — | — | The prompt for this shot. |
| multi_shotマルチレンズスイッチ | boolean | — | — | マルチショット動画を生成するかどうか trueの場合:promptパラメータは無効です。 falseの場合:shot_typeおよびmulti_promptパラメータは無効です。 |
| shot_typeショットタイプ | select | — | customize | intelligence | 生成されるショットタイプ。 |
| multi_promptマルチプロンプト | array<object> | — | — | 生成のためのマルチプロンプト要素のリスト。 |
| ↳durationDuration | number | 5 | — | The duration of this shot in seconds. |
| ↳promptPrompt | text | — | — | The prompt for this shot. |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v3.0/text-to-video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A futuristic cityscape at sunset with flying cars and glowing skyscrapers.",
"negative_prompt": "Crowded streets, dull colors, and broken buildings.",
"duration": 10,
"resolution": "720P",
"aspect_ratio": "16:9",
"cfg_scale": 0.7,
"sound": true,
"shot_type": "intelligence"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v3.0/text-to-video",
headers=HEADERS,
json={
"input": {
"prompt": "A futuristic cityscape at sunset with flying cars and glowing skyscrapers.",
"negative_prompt": "Crowded streets, dull colors, and broken buildings.",
"duration": 10,
"resolution": "720P",
"aspect_ratio": "16:9",
"cfg_scale": 0.7,
"sound": True,
"shot_type": "intelligence"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v3.0/text-to-video", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A futuristic cityscape at sunset with flying cars and glowing skyscrapers.",
"negative_prompt": "Crowded streets, dull colors, and broken buildings.",
"duration": 10,
"resolution": "720P",
"aspect_ratio": "16:9",
"cfg_scale": 0.7,
"sound": true,
"shot_type": "intelligence"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Kling 3.0 Standard
高品質なテキストから動画生成、映画のようなビジュアルと同期音声対応
Kling 3.0 Standard は、コストパフォーマンスに優れたテキストから動画生成モデルで、滑らかな動き、映画のようなビジュアル、そして正確なプロンプトの適合性を実現します。柔軟な動画の長さ設定、複数のアスペクト比、オプションで同期音声を生成可能で、手頃な価格で即共有可能なクリップを提供します。このモデルは高性能で冷スタートがなく、REST 推論 API を通じてアクセス可能です。
🚀 主な特徴
- 映画のようなビジュアル:テキストプロンプトから滑らかで高品質な動画を生成。
- 柔軟な動画の長さ:3秒から15秒までのクリップを生成可能で、さまざまな制作ニーズに対応。
- 複数のアスペクト比:16:9(横向き)、9:16(縦向き)、1:1(正方形)に対応し、さまざまなプラットフォームに適応。
- 同期音声:動画と同期した音声をオプションで生成可能。
- 正確なプロンプト制御:ネガティブプロンプトやガイダンススケールを活用して、出力を微調整。
- マルチプロンプト対応:複数のプロンプトを連携させて、シーンの移行や一貫性のあるストーリーテリングを実現。
🛠️ 技術仕様
| パラメータ | 型 | デフォルト値 | 範囲/オプション | 説明 |
|---|---|---|---|---|
| プロンプト | 文字列 | - | - | シーン、動き、カメラスタイル、雰囲気のテキスト記述。 |
| ネガティブプロンプト | 文字列 | - | - | 動画から除外したい要素。 |
| 長さ | 整数 | 5 | 3~15秒 | 生成される動画の長さ。 |
| アスペクト比 | 文字列 | 16:9 | 16:9, 9:16, 1:1 | 動画の出力形式。 |
| ガイダンススケール | 数値 | 0.5 | 0.0~1.0 | プロンプトの適合性の強さ;値が高いほどプロンプトとの関連性が強くなる。 |
| 音声 | ブール値 | 無効 | 有効/無効 | 動画生成時に同期音声を生成するかどうか。 |
| カメラモーション | 文字列 | カスタマイズ | カスタマイズ, インテリジェント | 編集モード;カスタマイズは手動制御、インテリジェントは自動検出。 |
| マルチプロンプト | 配列 | - | - | シーンの移行や進行をガイドする追加プロンプトセグメント。 |
| 要素リスト | 配列 | - | - | 動画の一貫性を確保するための視覚要素の参照リスト。 |
💰 価格設定
| 解像度 | 属性 | 秒単価 (USD) |
|---|---|---|
| 720P | 音声なし | 0.0840 |
| 720P | 音声あり | 0.1260 |
| 1080P | 音声なし | 0.1120 |
| 1080P | 音声あり | 0.1680 |
| 4K | 音声なし | 0.1680 |
| 4K | 音声あり | 0.2800 |
💡 主な利用ケース
- ソーシャルメディアコンテンツ:TikTok、Reels、Shorts 用の縦向きまたは正方形動画を大量生成。
- コンセプトの可視化:テキスト記述から創造的なアイデアや雰囲気を迅速に具現化。
- マーケティングと広告:撮影チームなしでプロモーション動画を制作。
- プロトタイピング:Pro モデルを使用する前に、標準価格で視覚的アイデアやプロンプトのバリエーションをテスト。
🔗 関連モデル
- Kling V3.0 Pro テキストから動画生成:Pro レベルの最高品質を提供。
- Kling V3.0 Std 画像から動画生成:静止画像を標準価格でアニメーション化。
- Kling Video O3 Std テキストから動画生成:次世代 O3 標準テキストから動画生成モデル。
プロのヒント
- プロンプトが具体的であるほど効果が向上します—カメラアングル、照明スタイル、キャラクターの動作、雰囲気を含めてください。
- ネガティブプロンプトを使用して、ぼやけた顔や不要な動きなどの一般的なアーティファクトを回避。
- プラットフォームに合わせてアスペクト比を選択:YouTube には 16:9、TikTok には 9:16、Instagram には 1:1。
- 環境音、人混み、アクションがあるシーンでは音声を有効にして、より没入感のある結果を得る。
- 短い長さ(3~5秒)は迅速な反復に、長い長さ(10~15秒)は最終出力に適しています。
注意事項
- プロンプトのみが必須フィールドで、その他のパラメータはすべてオプションです。
- 長さの範囲:最短 3秒、最長 15秒。
- 音声生成を有効にすると料金が1.5倍になります。
- Kling Elements ツールを使用して視覚要素を生成し、その名前と ID をプロンプト内で自然に参照してください。
関連モデル
xAI Grok Imagine Video v1.5 テキストから動画生成
テキストプロンプトから1-15秒の動画を生成します。480p、720p、1080pに対応しています。
MiniMax H3 テキストから動画生成
MiniMax H3 テキストから動画生成は、プロンプトから一貫性のある 2K 動画を生成できます。4〜15秒の柔軟な長さと、6種類のアスペクト比に対応し、シネマティックなシーン、クリエイティブ動画、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格で利用できます。
Kling Omni Video O3 標準版テキストから動画生成
Kling Omni Video O3 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishouの高度な統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトを基に主体の一貫性、自然な物理シミュレーション、正確な意味理解を備えた映画品質の動画を生成します。音声生成にも対応。すぐに使えるREST API、最高のパフォーマンス、冷スタートなし、手頃な価格。
Kling Omni Video O1 テキストから動画生成
Kling Omni Video O1 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishou初の統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトに基づいて映画品質の動画を生成し、主体の一貫性、自然な物理シミュレーション、正確な意味理解を実現します。すぐに使えるREST API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling V2.6 テキストから動画生成 API
Kling 2.6 は、滑らかなモーション、映画のようなビジュアル、強力なプロンプト適合性、そしてネイティブオーディオを備えた、トップクラスのテキストから動画生成を提供します。共有可能なクリップを即座に生成可能。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Gemini Omni Flash テキストから動画生成 API
Gemini Omni Flash Text to Video は、テキストのプロンプトから音声同期付きの短い AI 動画を生成し、映像生成と音声出力を組み合わせて高速なマルチモーダル動画作成を実現します。すぐに使える REST 推論 API で、高性能、コールドスタートなし、手頃な価格です。
Seedance 2.0 Mini テキストから動画生成
Seedance 2.0 Mini Text to Video は、ByteDance による高速かつ低コストなテキストから動画生成モデルで、シネマティックなマルチショット動画に適しています。テキストのプロンプトから物語性のあるシーケンスを生成し、AI カメラ制御、シーン間で一貫したキャラクター、480P / 720P / 1080P / 4K 出力、4〜15 秒の長さ、柔軟なアスペクト比に対応しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格が特長です。
Seedance 2.5 テキストから動画生成
Seedance 2.5 は次世代の高品質動画生成モデルであり、テキストから動画生成、複数のアスペクト比、480p/720p/1080p 解像度、AI 同期音声生成に対応し、指示追従性・カメラ制御・モーション品質が向上しています。