Kling Omni Video O3 標準版テキストから動画生成
kwaivgi/kling-video-o3/text-to-video
Kling Omni Video O3 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishouの高度な統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトを基に主体の一貫性、自然な物理シミュレーション、正確な意味理解を備えた映画品質の動画を生成します。音声生成にも対応。すぐに使えるREST API、最高のパフォーマンス、冷スタートなし、手頃な価格。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成に使用するポジティブプロンプト。 |
| resolution生成モード | select | 720P | 720P | 1080P | 4K | |
| aspect_ratioアスペクト比 | select | 16:9 | 16:9 | 9:16 | 1:1 | 生成される動画のアスペクト比。 |
| duration長さ | select | 5 | 3 | 4 | 5 | 6 | 7 | 8 | 9 | 10 | … | 生成されるメディアの長さ(秒)(3~15)。 |
| sound音声 | boolean | false | — | 動画に音声を生成するかどうか。 |
| multi_shotマルチレンズスイッチ | boolean | — | — | マルチショット動画を生成するかどうか trueの場合:promptパラメータは無効です。 falseの場合:shot_typeおよびmulti_promptパラメータは無効です。 |
| shot_typeショットタイプ | select | — | customize | intelligence | 生成されるショットタイプ。 |
| multi_promptマルチプロンプト | array<object> | — | — | 生成のためのマルチプロンプト要素のリスト。 |
| ↳durationDuration | number | 5 | — | The duration of this shot in seconds. |
| ↳promptPrompt | text | — | — | The prompt for this shot. |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-video-o3/text-to-video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A serene mountain landscape at sunrise, with golden light reflecting off the peaks and a gentle river flowing through the valley.",
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 8,
"sound": true,
"shot_type": "intelligence"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-video-o3/text-to-video",
headers=HEADERS,
json={
"input": {
"prompt": "A serene mountain landscape at sunrise, with golden light reflecting off the peaks and a gentle river flowing through the valley.",
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 8,
"sound": True,
"shot_type": "intelligence"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-video-o3/text-to-video", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A serene mountain landscape at sunrise, with golden light reflecting off the peaks and a gentle river flowing through the valley.",
"resolution": "720P",
"aspect_ratio": "16:9",
"duration": 8,
"sound": true,
"shot_type": "intelligence"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Kling Omni Video O3 テキストから動画生成モデル
テキストから動画および音声を生成する高度なマルチモーダルモデル
Kling Omni Video O3(標準版)は、快手が提供する高度な統合型マルチモーダル動画生成モデルで、MVL(マルチモーダルビジュアル言語)技術を採用しています。テキストプロンプトを使用して映画品質の動画を生成し、テーマの一貫性、自然な物理シミュレーション、精密な意味理解を実現します。音声生成にも対応しており、即時利用可能なREST APIを通じてアクセス可能で、最高のパフォーマンス、冷スタートなし、手頃な価格を提供します。
🚀 主な特徴
- 映画品質の動画生成:テキストプロンプトから高品質な動画を生成し、複雑なシーンや動的な効果をサポート。
- 自然な物理シミュレーション:生成された映像にリアルな物理効果と動きの一貫性を実現。
- 複数のアスペクト比対応:16:9、9:16、1:1のアスペクト比で動画を生成し、さまざまなプラットフォームに対応。
- 音声生成オプション:動画と同期した音声を生成し、完全なマルチメディア体験を提供。
- マルチプロンプト対応:複数のプロンプトをチェーン化して、スムーズなシーン遷移とストーリーフローを実現。
- プロンプトエンハンサー:内蔵ツールで動画説明を自動的に改善し、生成品質を向上。
🛠️ 技術仕様
| パラメータ | 型 | デフォルト値 | 範囲 | 説明 |
|---|---|---|---|---|
| プロンプト(prompt) | 文字列 | 必須 | - | 動画のシーン、動き、スタイルのテキスト説明。 |
| アスペクト比(aspect_ratio) | 文字列 | 16:9 | 16:9, 9:16, 1:1 | 生成される動画のアスペクト比。 |
| 長さ(duration) | 整数 | 5秒 | 3~15秒 | 生成される動画の長さ(秒)。 |
| 音声(sound) | ブール値 | False | True, False | 動画と同期した音声を生成するかどうか。 |
| カメラモーション(shot_type) | 文字列 | customize | customize, intelligent | 動画生成のカメラモーションタイプ(手動または自動)。 |
| マルチプロンプト(multi_prompt) | 配列 | - | - | シーン遷移をガイドする追加プロンプト。 |
💰 価格
| タイプ | 720P | 1080P | 4K |
|---|---|---|---|
| 音なし | 0.0840 | 0.1120 | 0.4200 |
| 音あり | 0.1120 | 0.1400 | 0.4200 |
料金ルール:
- 基本料金:解像度に基づきます。
- 音声追加料金:音声ありの場合、約33.3%の割増料金が発生します。
- 対応秒数:3~15秒。
💡 最適な利用ケース
- プロフェッショナルコンテンツ制作:より手頃な価格で高品質な動画を生成。
- ソーシャルメディア:TikTok、Reels、Stories向けの魅力的な短編動画を作成。
- マーケティング動画:同期音声付きのプロモーションコンテンツを生成。
- コンセプトの可視化:テキスト説明から迅速にクリエイティブアイデアを具現化。
- 拡張シーン:最大15秒の動画生成で、ストーリーテリングやシーン展開に対応。
🔗 関連モデル
- Kling Video O3 画像から動画生成モデル:標準版価格で画像をアニメーション化。
- Kling V3.0 テキストから動画生成モデル:V3.0標準版で低コスト。
プロンプトを作成する際は、快手のコンテンツ利用ポリシーを遵守してください。
関連モデル
xAI Grok Imagine Video v1.5 テキストから動画生成
テキストプロンプトから1-15秒の動画を生成します。480p、720p、1080pに対応しています。
MiniMax H3 テキストから動画生成
MiniMax H3 テキストから動画生成は、プロンプトから一貫性のある 2K 動画を生成できます。4〜15秒の柔軟な長さと、6種類のアスペクト比に対応し、シネマティックなシーン、クリエイティブ動画、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格で利用できます。
Kling Omni Video O1 テキストから動画生成
Kling Omni Video O1 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishou初の統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトに基づいて映画品質の動画を生成し、主体の一貫性、自然な物理シミュレーション、正確な意味理解を実現します。すぐに使えるREST API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling 3.0 標準版
Kling 3.0 標準版は、高品質なテキストから動画生成を提供します。滑らかな動き、映画のような映像、正確なプロンプトの適合性、そして共有可能なクリップ用のネイティブ音声を備えています。即時利用可能な REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling V2.6 テキストから動画生成 API
Kling 2.6 は、滑らかなモーション、映画のようなビジュアル、強力なプロンプト適合性、そしてネイティブオーディオを備えた、トップクラスのテキストから動画生成を提供します。共有可能なクリップを即座に生成可能。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Gemini Omni Flash テキストから動画生成 API
Gemini Omni Flash Text to Video は、テキストのプロンプトから音声同期付きの短い AI 動画を生成し、映像生成と音声出力を組み合わせて高速なマルチモーダル動画作成を実現します。すぐに使える REST 推論 API で、高性能、コールドスタートなし、手頃な価格です。
Seedance 2.0 Mini テキストから動画生成
Seedance 2.0 Mini Text to Video は、ByteDance による高速かつ低コストなテキストから動画生成モデルで、シネマティックなマルチショット動画に適しています。テキストのプロンプトから物語性のあるシーケンスを生成し、AI カメラ制御、シーン間で一貫したキャラクター、480P / 720P / 1080P / 4K 出力、4〜15 秒の長さ、柔軟なアスペクト比に対応しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格が特長です。
Seedance 2.5 テキストから動画生成
Seedance 2.5 は次世代の高品質動画生成モデルであり、テキストから動画生成、複数のアスペクト比、480p/720p/1080p 解像度、AI 同期音声生成に対応し、指示追従性・カメラ制御・モーション品質が向上しています。