ElevenLabs Multilingual V2 is a multilingual text-to-speech model
eleven_multilingual_v2
Our most life-like, emotionally rich mode in 29 languages. Best for voice overs, audiobooks, post-production, or any other content creation needs
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| voice_id *声音id | text | — | — | |
| language_codeISO 639-1语言code | text | — | — | |
| similarity_boostSimilarity Boost | slider | 0.75 | 0 ~ 1 · step 0.05 | |
| stabilityStability | slider | 0.5 | 0 ~ 1 · step 0.05 |
出力フィールド
| フィールド | 型 | 説明 |
|---|---|---|
| audio_url | string |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/eleven_multilingual_v2" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/eleven_multilingual_v2",
headers=HEADERS,
json={
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/eleven_multilingual_v2", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Multilingual V2
高速・高自然度・低コストを両立した多言語テキスト読み上げモデルです。
Multilingual V2 は、ElevenLabs が提供する多言語テキスト読み上げモデルです。書かれたテキストを自然で表現力のある音声に変換でき、無冷启动、安定した品質、そして文字数ベースの分かりやすい価格設定により、リアルタイム用途から本番運用まで幅広く適しています。
🚀 主な特長
- 高い自然さ:人間らしい抑揚、間、テンポで、聞き取りやすく自然な音声を生成します。
- 多言語対応:多言語音声合成向けに最適化されており、発音精度やアクセント処理に優れています。
- 音声表現の調整が可能:
similarityとstabilityにより、話者らしさと安定感のバランスを細かく調整できます。 - Speaker Boost:英語の数字、日付、単位などの読み上げ品質を改善し、業務用途でも使いやすい出力を実現します。
- コールドスタートなし:対話型アプリケーションや高頻度処理でも扱いやすい設計です。
- 導入しやすい価格:文字数単位の明確な課金体系で、試作から量産までコスト管理がしやすくなっています。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデルアーキテクチャ | 多言語テキスト読み上げ(TTS)モデル |
| モデル ID | elevenlabs/multilingual-v2 |
| 入力 | テキスト(string) |
| 出力 | 音声 |
| 最大入力長 | 10000 文字 |
| 課金単位 | 1 文字 = 1 token、実際の文字数に基づいて課金 |
| 音声選択 | voice_id、既定値 Alice、組み込み音声およびカスタム音声に対応 |
| 類似度調整 | similarity:0.0〜1.0、既定値 1 |
| 安定性調整 | stability:0.0〜1.0、既定値 0.5 |
| 英語正規化補助 | use_speaker_boost:boolean、既定値 true |
| ポーズ制御 | 単語間に <#x#> を入れることで間の長さを制御可能(0.01〜99.99 秒) |
| レイテンシ | 固定の公開値はありませんが、無冷启动・高速推論を訴求しています |
| 主な用途 | ナレーション、ボイスオーバー、学習コンテンツ、製品紹介動画、カスタマーサポート |
サンプルプロンプト
注:本モデルはテキスト読み上げモデルのため、以下は入力テキストの例です。
Welcome to our product demo. Today we will walk through the key features and benefits in under two minutes.Your order will arrive on Friday <#0.5#> between 2 PM and 5 PM. Thank you for shopping with us.The total balance is 1,245 dollars and 80 cents, due on September 15.
💰 価格
| 項目 | 価格 |
|---|---|
| 基本料金 | $0.1 / 1000 文字 |
💡 最適なユースケース
- マーケティング・ブランドコンテンツ:製品紹介、広告、SNS 向け動画のボイスオーバーに適しています。
- 教育・研修:講義音声、語学教材、社内研修コンテンツのナレーション生成に有効です。
- グローバル向けサービス:多言語アプリ、Web サービス、国際向けプロダクトの音声体験を強化できます。
- カスタマーサポート・自動案内:数字、日付、時刻、単位を多く含む英語音声案内や通知音声に適しています。
🔗 関連モデル
- Elevenlabs Multilingual V1:旧世代の多言語モデルで、出力傾向の比較や既存運用との整合確認に適しています。
- Elevenlabs Music:音声読み上げではなく、音楽関連生成向けの別モデルです。
関連モデル
Eleven v3
The most expressive model. Supports 70+ languages. Requires more prompt engineering than our previous models.
Eleven Turbo v2.5
Our high quality, low latency model in 32 languages. Best for developer use cases where speed matters and you need non-English languages.
Eleven Flash v2.5
Our ultra low latency model in 32 languages. Ideal for conversational use cases.