Kling V2.6 テキストから動画生成 API
kwaivgi/kling-v2.6/text-to-video
Kling 2.6 は、滑らかなモーション、映画のようなビジュアル、強力なプロンプト適合性、そしてネイティブオーディオを備えた、トップクラスのテキストから動画生成を提供します。共有可能なクリップを即座に生成可能。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成のためのポジティブプロンプト。 |
| negative_promptネガティブプロンプト | textarea | — | ≤ 5000 chars | 生成のためのネガティブプロンプト。 |
| resolution生成モード | select | 720P | 720P | 1080P | |
| aspect_ratioアスペクト比 | select | 1:1 | 1:1 | 9:16 | 16:9 | 生成されるメディアのアスペクト比。 |
| duration長さ | slider | 5 | 3 ~ 15 · step 1 | 生成されるメディアの長さ(秒単位)。 |
| sound音声 | boolean | false | — | 動画を生成する際に音声を同時に生成するかどうか。音声を有効にする場合は 1080P 解像度をご使用ください(720P 標準モードでは音声は利用できません)。 |
| cfg_scaleCFG スケール | number | 0.5 | — | 動画生成の柔軟性。値が高いほどモデルの柔軟性が低くなり、ユーザーのプロンプトとの関連性が強くなります。 |
| multi_shotマルチレンズスイッチ | boolean | — | — | マルチショット動画を生成するかどうか trueの場合:promptパラメータは無効です。 falseの場合:shot_typeおよびmulti_promptパラメータは無効です。 |
| shot_typeショットタイプ | select | — | customize | intelligence | 生成されるショットタイプ。 |
| multi_promptマルチプロンプト | array<object> | — | — | 生成のためのマルチプロンプト要素のリスト。 |
| ↳durationDuration | number | 5 | — | The duration of this shot in seconds. |
| ↳promptPrompt | text | — | — | The prompt for this shot. |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2.6/text-to-video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A futuristic cityscape at sunset with flying cars and glowing neon signs, cinematic style",
"negative_prompt": "Blurry visuals, low-quality textures, unrealistic lighting",
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 10,
"sound": false,
"cfg_scale": 0.7,
"shot_type": "intelligence"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2.6/text-to-video",
headers=HEADERS,
json={
"input": {
"prompt": "A futuristic cityscape at sunset with flying cars and glowing neon signs, cinematic style",
"negative_prompt": "Blurry visuals, low-quality textures, unrealistic lighting",
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 10,
"sound": False,
"cfg_scale": 0.7,
"shot_type": "intelligence"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2.6/text-to-video", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A futuristic cityscape at sunset with flying cars and glowing neon signs, cinematic style",
"negative_prompt": "Blurry visuals, low-quality textures, unrealistic lighting",
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 10,
"sound": false,
"cfg_scale": 0.7,
"shot_type": "intelligence"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Kling V2.6 テキストから動画生成 API
シームレスなテキストから動画生成と音声統合
Kling V2.6 は、映画のようなビジュアル、滑らかな動き、そしてネイティブ音声生成を備えた最先端のテキストから動画生成モデルです。高いプロンプト適合性を持ち、コールドスタートなしで動作し、手頃な価格で高品質な出力を求める開発者に最適化されています。
🚀 主な特徴
- 音声と動画の統合生成:ビジュアルと音声を一度に同期生成し、統一感のある出力を実現。
- 映画的な動き:プロンプトに完全に一致する滑らかなカメラモーションとキャラクターの動き。
- シーン駆動の音響デザイン:記述されたシーンに合わせた環境音、効果音、ナレーションを生成。
- プロンプトの精度:
ガイダンススケールによる柔軟性調整が可能な高いプロンプト適合性。 - 即利用可能な API:コールドスタートなしで高速推論が可能、ワークフローへの簡単な統合。
🛠️ 技術仕様
| パラメータ | 型 | デフォルト値 | 範囲 | 説明 |
|---|---|---|---|---|
| プロンプト | string | - | - | シーン、キャラクター、音声の雰囲気を記述するポジティブプロンプト。 |
| ネガティブプロンプト | string | - | - | 除外する要素を指定(例:ウォーターマーク、ノイズ)。 |
| ガイダンススケール | number | 0.5 | 0.00 ~ 1.00 | ガイダンスの強度:値が高いほどプロンプトへの適合性が強くなる。 |
| 音声 | boolean | true | true/false | 音声(ナレーション、環境音、効果音)を生成するかどうか。 |
| アスペクト比 | string | 1:1 | 1:1, 9:16, 16:9 | 出力動画のアスペクト比。 |
| 長さ | integer | 5 | 5, 10 | 生成される動画の長さ(秒)。 |
💰 料金
| 属性 | 720P | 1080P |
|---|---|---|
| 音なし | 0.0420 | 0.0700 |
| 音あり | 0.1400 |
💡 主な利用ケース
- ソーシャルメディア広告:ナレーションと音響デザインを組み込んだ魅力的なプロモーション動画を作成。
- 映画のプリビジュアライゼーション:視覚と音声が同期したアニメーションや短いストーリーシーンを生成。
- 製品説明動画:製品の特徴や利点を明確に伝えるナレーション付き動画を提供。
- 映画的なショート動画:単一のプロンプトで高品質な音楽、環境音、動きを生成。
🔗 関連モデル
- Kling V2.6 Motion Control:カメラとキャラクターの動きを詳細に制御可能。
関連モデル
xAI Grok Imagine Video v1.5 テキストから動画生成
テキストプロンプトから1-15秒の動画を生成します。480p、720p、1080pに対応しています。
MiniMax H3 テキストから動画生成
MiniMax H3 テキストから動画生成は、プロンプトから一貫性のある 2K 動画を生成できます。4〜15秒の柔軟な長さと、6種類のアスペクト比に対応し、シネマティックなシーン、クリエイティブ動画、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格で利用できます。
Kling Omni Video O3 標準版テキストから動画生成
Kling Omni Video O3 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishouの高度な統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトを基に主体の一貫性、自然な物理シミュレーション、正確な意味理解を備えた映画品質の動画を生成します。音声生成にも対応。すぐに使えるREST API、最高のパフォーマンス、冷スタートなし、手頃な価格。
Kling Omni Video O1 テキストから動画生成
Kling Omni Video O1 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishou初の統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトに基づいて映画品質の動画を生成し、主体の一貫性、自然な物理シミュレーション、正確な意味理解を実現します。すぐに使えるREST API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling 3.0 標準版
Kling 3.0 標準版は、高品質なテキストから動画生成を提供します。滑らかな動き、映画のような映像、正確なプロンプトの適合性、そして共有可能なクリップ用のネイティブ音声を備えています。即時利用可能な REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Gemini Omni Flash テキストから動画生成 API
Gemini Omni Flash Text to Video は、テキストのプロンプトから音声同期付きの短い AI 動画を生成し、映像生成と音声出力を組み合わせて高速なマルチモーダル動画作成を実現します。すぐに使える REST 推論 API で、高性能、コールドスタートなし、手頃な価格です。
Seedance 2.0 Mini テキストから動画生成
Seedance 2.0 Mini Text to Video は、ByteDance による高速かつ低コストなテキストから動画生成モデルで、シネマティックなマルチショット動画に適しています。テキストのプロンプトから物語性のあるシーケンスを生成し、AI カメラ制御、シーン間で一貫したキャラクター、480P / 720P / 1080P / 4K 出力、4〜15 秒の長さ、柔軟なアスペクト比に対応しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格が特長です。
Seedance 2.5 テキストから動画生成
Seedance 2.5 は次世代の高品質動画生成モデルであり、テキストから動画生成、複数のアスペクト比、480p/720p/1080p 解像度、AI 同期音声生成に対応し、指示追従性・カメラ制御・モーション品質が向上しています。