Avatar To VideoKling

kwaivgi/kling-v2-ai-avatar-pro AIアバター動画生成

kwaivgi/kling-v2-ai-avatar-pro

Kling V2 AI Avatar Pro は、高品質な AI アバター動画を生成します。ディテールは鮮明で、動きは安定し、人物の一貫性にも優れているため、プロフィール、イントロ、SNS コンテンツに最適です。すぐに使える REST inference API を提供し、高性能、コールドスタートなし、手頃な価格を実現しています。

サンプル

kwaivgi/kling-v2-ai-avatar-pro AIアバター動画生成 example 1

パラメータ

名前既定制約説明
image *画像image_uploadimage/*出力内容の生成に使用する画像。
promptプロンプトtextarea≤ 5000 chars生成に使用するポジティブプロンプト。

API

統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。

cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2-ai-avatar-pro" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "input": {
    "image": "https://example.com/input.jpg"
  }
}'

# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
  -H "Authorization: Bearer YOUR_API_KEY"
Python
import time, requests

API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}

# 1) Submit
resp = requests.post(
    "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2-ai-avatar-pro",
    headers=HEADERS,
    json={
        "input": {
            "image": "https://example.com/input.jpg"
        }
    },
)
resp.raise_for_status()  # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()

# 2) Poll until a terminal state (completed / failed / cancelled).
#    This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
    if time.time() > deadline:
        raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
    time.sleep(3)
    poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
    poll.raise_for_status()
    task = poll.json()

print(task["status"], task.get("output"))
JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };

// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-v2-ai-avatar-pro", {
  method: "POST",
  headers: { ...HEADERS, "Content-Type": "application/json" },
  body: JSON.stringify({
    "input": {
      "image": "https://example.com/input.jpg"
    }
  }),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();

// 2) Poll until a terminal state (completed / failed / cancelled).
//    This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
  if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
  await new Promise((r) => setTimeout(r, 3000));
  const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
  if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
  task = await poll.json();
}

console.log(task.status, task.output);

ドキュメント

kwaivgi/kling-v2-ai-avatar-pro

1枚の人物画像と音声から、高品質なトーキングヘッド動画を生成。

kwaivgi/kling-v2-ai-avatar-pro は、AI アバター動画の生成に特化した画像生成動画モデルです。1枚の人物画像と音声をもとに、口パク同期の取れた自然なトーキングヘッド動画を生成し、細部の鮮明さ、安定した動き、強い本人性維持を実現します。コールドスタートなしで利用しやすく、コスト効率にも優れているため、プロフィール動画、イントロ動画、SNS 向けコンテンツに適しています。

🚀 主な特長

  • 音声駆動のリップシンク:TTS ではなくアップロードした音声をそのまま使用し、話すタイミング、間、感情表現を維持します。
  • 高い本人性維持:参照画像の顔立ちを保ちながら、顔、目線、頭部の動きを自然にアニメーション化します。
  • 安定したトーキングヘッド表現:カメラ前で話しているような自然なアバター動画を、破綻の少ない安定したモーションで生成します。
  • シンプルなワンショット生成:必要なのは 画像音声 のみで、実写撮影やモーション収録は不要です。
  • プロンプトによるスタイル制御:任意の プロンプト により、表情、雰囲気、照明感、軽い動きの方向性を補助できます。
  • 縦向き SNS 向け出力:Reels、TikTok、Shorts、Stories などの縦向き配信フォーマットに適しています。

🛠️ 技術仕様

項目内容
モデル名kwaivgi/kling-v2-ai-avatar-pro
モデル種別画像生成動画(AI アバター/トーキングヘッド生成)
主な機能1枚の人物 画像音声 から、リップシンク付きのアバター 動画 を生成
入力画像音声、任意の プロンプト
出力形式動画
画像要件鮮明な人物画像、正面または 3/4 角度、目が見えており、遮蔽物が少ないことが望ましい
音声要件背景ノイズの少ないクリアなモノラルまたはステレオ音声
長さ入力音声の長さから自動決定。最低課金時間は 5 秒
解像度HD の縦向き出力(元情報では具体的なピクセル数は未公開)
アスペクト比縦向きの SNS 向けフォーマット
駆動方式音声による口パク、タイミング、表情の駆動
スタイル制御プロンプト により表情、雰囲気、照明、軽微な動きの指示が可能
レイテンシ固定値は未公開。プラットフォーム上ではコールドスタートなしを訴求
出力特性クリーンなディテール、安定したモーション、高い本人性維持

サンプルプロンプト

  • soft studio lighting, subtle head movement, gentle smile
  • confident presenter in a tech promo, subtle head nods
  • friendly customer service tone, warm expression, clean professional framing

💰 料金

音声の長さ(秒)課金秒数価格(USD)
0–550.56
10101.12
20202.24
30303.36
60606.72

5 秒未満のクリップも 5 秒として課金されます。

💡 主なユースケース

  • SNS 向けアバター動画:TikTok、Reels、Shorts 向けの短尺トーキングヘッド動画制作。
  • プロフィール動画・ブランド紹介:自己紹介、ブランドスポークスパーソン、イントロ動画の作成。
  • 教育・解説コンテンツ:チュートリアル、オンボーディング、研修向けのバーチャル講師動画。
  • マーケティング・顧客対応:アバターによる販促動画、サポート説明、UGC 風クリエイティブ制作。

🔗 関連モデル

  • infinitetalk:スクリプトまたは音声からリップシンク付きトーキングヘッド動画を生成し、バーチャルプレゼンターや解説動画に適しています。
  • Infinitetalk-Multi:複数話者や複数セグメントに対応し、対話形式やバッチ生成に向いています。
  • Omni-Human:高精細なデジタルヒューマン生成に強く、バーチャルホスト、ブランドアンバサダー、研修用アバターに適しています。