Video To AuidoKling

kwaivgi/kling-video-to-audio 動画から音声へ

kwaivgi/kling-video-to-audio

Kling Video-to-Audio は、KlingAI の音声生成モデルを使用して、動画から一致する効果音や音声トラックを自動生成または抽出します。すぐに使える REST API、優れたパフォーマンス、コールドスタートなし、手頃な価格で提供します。

サンプル

kwaivgi/kling-video-to-audio 動画から音声へ example 1

パラメータ

名前既定制約説明
video *動画video_uploadvideo/*出力生成に使用する動画です。長さは 20 秒を超えないようにしてください。
sound_effect_prompt効果音プロンプトtextarea≤ 200 chars効果音生成用のテキストプロンプトです。最大 200 文字
bgm_promptBGM プロンプトtextarea≤ 200 chars背景音楽生成用のテキストプロンプトです。最大 200 文字
asmr_modeASMR モードbooleanfalseASMR モードを有効にすると、細かな効果音が強化され、没入感のあるコンテンツに適しています

API

統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。

cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-video-to-audio" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "input": {
    "video": "https://example.com/input.mp4",
    "asmr_mode": false
  }
}'

# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
  -H "Authorization: Bearer YOUR_API_KEY"
Python
import time, requests

API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}

# 1) Submit
resp = requests.post(
    "https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-video-to-audio",
    headers=HEADERS,
    json={
        "input": {
            "video": "https://example.com/input.mp4",
            "asmr_mode": False
        }
    },
)
resp.raise_for_status()  # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()

# 2) Poll until a terminal state (completed / failed / cancelled).
#    This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
    if time.time() > deadline:
        raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
    time.sleep(3)
    poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
    poll.raise_for_status()
    task = poll.json()

print(task["status"], task.get("output"))
JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };

// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/kwaivgi/kling-video-to-audio", {
  method: "POST",
  headers: { ...HEADERS, "Content-Type": "application/json" },
  body: JSON.stringify({
    "input": {
      "video": "https://example.com/input.mp4",
      "asmr_mode": false
    }
  }),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();

// 2) Poll until a terminal state (completed / failed / cancelled).
//    This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
  if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
  await new Promise((r) => setTimeout(r, 3000));
  const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
  if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
  task = await poll.json();
}

console.log(task.status, task.output);

ドキュメント

kwaivgi/kling-video-to-audio

動画に合わせた効果音とBGMを高速生成。コールドスタートなしで、実運用しやすい価格設定。

kwaivgi/kling-video-to-audio は、入力した動画に合わせて効果音や音声トラックを自動生成または抽出する動画から音声への生成モデルです。SFX 用と BGM 用の短いプロンプトを使って、シーンのタイミング、動き、雰囲気に沿ったサウンドトラックを効率よく作成できます。

KlingAI の音声生成能力を活用しており、短納期、高い反復効率、安定した実行性能を重視する制作ワークフローに適しています。特に、予告編、ショート動画、商品映像、ムード重視の映像制作に有効です。

🚀 主な特長

  • 動画条件付きの音声生成:元動画の動き、テンポ、画面上のアクションに合わせて効果音とBGMを生成します。
  • 2系統のプロンプト制御:効果音用とBGM用のプロンプトを分けることで、フォーリー、環境音、音楽の方向性を細かく調整できます。
  • ASMR モード対応:微細な音のディテールや近接収音の質感を強調し、より没入感のある音作りが可能です。
  • 高速な試行錯誤:プロンプトを調整して再生成し、複数パターンを比較しながら音作りを進められます。
  • 幅広い映像ジャンルに対応:シネマティック映像、ドキュメンタリー、ゲームプレイ、商品紹介映像などに適しています。
  • コールドスタートなし・低コスト:応答性とコスト効率が重要な本番環境でも扱いやすい構成です。

🛠️ 技術仕様

項目内容
モデルkwaivgi/kling-video-to-audio
モデルアーキテクチャ動画から音声への生成モデル
中核機能入力動画に同期した効果音(SFX)とBGMを生成
入力形式動画、効果音プロンプト、BGMプロンプト、ASMR モード切替
出力形式音声
長さ入力動画は最大 20 秒
効果音プロンプト長最大 200 文字
BGMプロンプト長最大 200 文字
ASMR モード対応(デフォルト:false)
同期仕様出力音声は入力動画の長さに合わせて生成
推奨素材無音動画、またはサウンドデザイン追加が必要な映像
レイテンシプラットフォーム上で高速推論。実際の処理時間は内容と負荷に依存
コールドスタートなし

サンプルプロンプト

効果音プロンプト例

  • 雷雨、激しい雨、遠くで鳴る雷鳴、ガラスの振動、突風、岩に打ちつける波。
  • レザージャケットの擦れる音、濡れたコンクリートを歩く足音、エレベーターのチャイム、ネオンのハム音。

BGMプロンプト例

  • 重厚なオーケストラスコア、低音のストリングス、まばらなピアノのアクセント、サブベースが膨らむゆっくりした盛り上がり。
  • ミニマルな電子アンビエント、スローテンポ、柔らかなシンセパッド、徐々に高まる緊張感。

💰 価格

料金項目価格
基本料金(1ジョブあたり)$0.035

💡 主なユースケース

  • ショート動画・SNS コンテンツ:無音クリップに素早く音を追加し、視聴維持率や感情訴求を高めます。
  • EC・商品マーケティング:質感のある効果音や雰囲気に合ったBGMで、商品表現を強化します。
  • 予告編・ムード映像:企画提案、試作、コンセプト検証向けに、短時間でサウンド案を作成できます。
  • ゲーム・映像制作のプリプロダクション:絵コンテ動画、ラフカット、社内レビュー用の仮音声トラック作成に適しています。

🔗 関連モデル

本ページは kwaivgi/kling-video-to-audio を対象としており、動画入力から音声を生成する用途に最適化されています。Kling シリーズ全体を比較検討する場合は、動画生成、編集、高品位出力向けの関連モデルもあわせて確認すると、制作パイプラインに適した選定がしやすくなります。