Avatar To VideoKling
kwaivgi/kling-v2-ai-avatar-pro AIアバター動画生成
kwaivgi/kling-v2-ai-avatar-pro
Kling V2 AI Avatar Pro は、高品質な AI アバター動画を生成します。ディテールは鮮明で、動きは安定し、人物の一貫性にも優れているため、プロフィール、イントロ、SNS コンテンツに最適です。すぐに使える REST inference API を提供し、高性能、コールドスタートなし、手頃な価格を実現しています。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| image *画像 | image_upload | — | image/* | 出力内容の生成に使用する画像。 |
| promptプロンプト | textarea | — | ≤ 5000 chars | 生成に使用するポジティブプロンプト。 |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2-ai-avatar-pro" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"image": "https://example.com/input.jpg"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2-ai-avatar-pro",
headers=HEADERS,
json={
"input": {
"image": "https://example.com/input.jpg"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2-ai-avatar-pro", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"image": "https://example.com/input.jpg"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
kwaivgi/kling-v2-ai-avatar-pro
1枚の人物画像と音声から、高品質なトーキングヘッド動画を生成。
kwaivgi/kling-v2-ai-avatar-pro は、AI アバター動画の生成に特化した画像生成動画モデルです。1枚の人物画像と音声をもとに、口パク同期の取れた自然なトーキングヘッド動画を生成し、細部の鮮明さ、安定した動き、強い本人性維持を実現します。コールドスタートなしで利用しやすく、コスト効率にも優れているため、プロフィール動画、イントロ動画、SNS 向けコンテンツに適しています。
🚀 主な特長
- 音声駆動のリップシンク:TTS ではなくアップロードした音声をそのまま使用し、話すタイミング、間、感情表現を維持します。
- 高い本人性維持:参照画像の顔立ちを保ちながら、顔、目線、頭部の動きを自然にアニメーション化します。
- 安定したトーキングヘッド表現:カメラ前で話しているような自然なアバター動画を、破綻の少ない安定したモーションで生成します。
- シンプルなワンショット生成:必要なのは 画像 と 音声 のみで、実写撮影やモーション収録は不要です。
- プロンプトによるスタイル制御:任意の プロンプト により、表情、雰囲気、照明感、軽い動きの方向性を補助できます。
- 縦向き SNS 向け出力:Reels、TikTok、Shorts、Stories などの縦向き配信フォーマットに適しています。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデル名 | kwaivgi/kling-v2-ai-avatar-pro |
| モデル種別 | 画像生成動画(AI アバター/トーキングヘッド生成) |
| 主な機能 | 1枚の人物 画像 と 音声 から、リップシンク付きのアバター 動画 を生成 |
| 入力 | 画像、音声、任意の プロンプト |
| 出力形式 | 動画 |
| 画像要件 | 鮮明な人物画像、正面または 3/4 角度、目が見えており、遮蔽物が少ないことが望ましい |
| 音声要件 | 背景ノイズの少ないクリアなモノラルまたはステレオ音声 |
| 長さ | 入力音声の長さから自動決定。最低課金時間は 5 秒 |
| 解像度 | HD の縦向き出力(元情報では具体的なピクセル数は未公開) |
| アスペクト比 | 縦向きの SNS 向けフォーマット |
| 駆動方式 | 音声による口パク、タイミング、表情の駆動 |
| スタイル制御 | プロンプト により表情、雰囲気、照明、軽微な動きの指示が可能 |
| レイテンシ | 固定値は未公開。プラットフォーム上ではコールドスタートなしを訴求 |
| 出力特性 | クリーンなディテール、安定したモーション、高い本人性維持 |
サンプルプロンプト
soft studio lighting, subtle head movement, gentle smileconfident presenter in a tech promo, subtle head nodsfriendly customer service tone, warm expression, clean professional framing
💰 料金
| 音声の長さ(秒) | 課金秒数 | 価格(USD) |
|---|---|---|
| 0–5 | 5 | 0.56 |
| 10 | 10 | 1.12 |
| 20 | 20 | 2.24 |
| 30 | 30 | 3.36 |
| 60 | 60 | 6.72 |
5 秒未満のクリップも 5 秒として課金されます。
💡 主なユースケース
- SNS 向けアバター動画:TikTok、Reels、Shorts 向けの短尺トーキングヘッド動画制作。
- プロフィール動画・ブランド紹介:自己紹介、ブランドスポークスパーソン、イントロ動画の作成。
- 教育・解説コンテンツ:チュートリアル、オンボーディング、研修向けのバーチャル講師動画。
- マーケティング・顧客対応:アバターによる販促動画、サポート説明、UGC 風クリエイティブ制作。
🔗 関連モデル
- infinitetalk:スクリプトまたは音声からリップシンク付きトーキングヘッド動画を生成し、バーチャルプレゼンターや解説動画に適しています。
- Infinitetalk-Multi:複数話者や複数セグメントに対応し、対話形式やバッチ生成に向いています。
- Omni-Human:高精細なデジタルヒューマン生成に強く、バーチャルホスト、ブランドアンバサダー、研修用アバターに適しています。