Eleven v3
eleven_v3
The most expressive model. Supports 70+ languages. Requires more prompt engineering than our previous models.
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| voice_id *声音id | text | — | — | |
| language_codeISO 639-1语言code | text | — | — | |
| similarity_boostSimilarity Boost | slider | 0.75 | 0 ~ 1 · step 0.05 | |
| stabilityStability | slider | 0.5 | 0 ~ 1 · step 0.05 |
出力フィールド
| フィールド | 型 | 説明 |
|---|---|---|
| audio_url | string |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/eleven_v3" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/eleven_v3",
headers=HEADERS,
json={
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/eleven_v3", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Eleven V3
高い自然さと表現力を備えた、無冷启动対応のテキスト読み上げモデル。
Eleven V3 は、書かれたテキストを自然で明瞭、かつ感情表現のある音声へ変換する ElevenLabs のテキスト読み上げモデルです。高品質な音声合成、無冷启动、扱いやすい従量課金を兼ね備えており、ナレーション、ポッドキャスト、各種デジタルコンテンツ制作に適しています。
🚀 主な特長
- 高い自然さ:人間らしい抑揚、間、発音により、聞き取りやすく自然な音声を生成します。
- 表現力の高い音声合成:明瞭さを保ちながら、ナレーションやブランド音声に適した豊かな表現を実現します。
- 音声特性の調整が可能:similarity と stability により、話者らしさと安定性のバランスを細かく調整できます。
- Speaker Boost 対応:英語の数値、時刻、単位表現などの読み上げ品質を向上させます。
- 多言語対応:複数言語のテキスト入力に対応し、特に英語で高い性能を発揮します。
- 無冷启动のホスト型推論:すぐに利用できる構成で、安定した本番運用に向いています。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデルアーキテクチャ | 深層学習ベースのテキスト読み上げ(TTS)モデル |
| モデル名 | Eleven V3 |
| 入力 | テキスト(string)、voice_id(string) |
| 出力 | 音声ファイル URL |
| 出力形式 | MP3 |
| 最大入力長 | 10,000 文字 |
| 課金単位 | 1 文字 = 1 token、実際の文字数に基づいて課金 |
| 音声選択 | Alice、George、Lily、Daniel などの内蔵音声ライブラリを利用可能 |
| 調整可能な項目 | similarity(0.0–1.0)、stability(0.0–1.0)、use_speaker_boost(boolean) |
| ポーズ制御 | 単語間に <#x#> を挿入して間の長さを制御可能(0.01–99.99 秒) |
| 言語対応 | 多言語テキスト読み上げ対応、英語で最良の性能 |
| レイテンシ | 固定値は未公開。ホスト型提供により無冷启动の応答性を重視 |
| 推奨運用 | 長文は分割して生成すると、リズムと安定性が向上しやすいです |
サンプルプロンプト
注記:本モデルはテキスト読み上げモデルのため、画像生成における意味でのプロンプト/ネガティブプロンプトは使用しません。以下は入力テキスト例です。
Welcome to our advanced text-to-speech system! Experience high-quality voice synthesis with natural pronunciation and clear articulation.The meeting will begin at 9:30 AM <#0.5#> and will cover sales performance, regional forecasts, and next quarter planning.本日の製品紹介へようこそ。より自然で聞き取りやすい音声体験をご案内します。
💰 価格
| 項目 | 価格 |
|---|---|
| 基本料金 | $0.1 / 1,000 文字 |
💡 主なユースケース
- デジタルコンテンツのナレーション:解説動画、製品紹介、研修コンテンツ、ブランド向け音声に適しています。
- ポッドキャスト・音声メディア:要約音声、朗読、教育コンテンツ、連載型音声配信に活用できます。
- 業務向け音声自動化:案内音声、社内研修、読み上げ資料、顧客向け音声資産の作成に有効です。
- 多言語コンテンツ制作:グローバル向けマーケティング、ローカライズされた製品説明、国際向け情報発信に適しています。
🔗 関連モデル
- Elevenlabs Dubbing:吹き替えや多言語音声置換のワークフローに適しています。
- Elevenlabs Eleven V3 Timing:タイミングやアラインメント制御がより重要な用途に適しています。
関連モデル
Eleven Turbo v2.5
Our high quality, low latency model in 32 languages. Best for developer use cases where speed matters and you need non-English languages.
ElevenLabs Multilingual V2 is a multilingual text-to-speech model
Our most life-like, emotionally rich mode in 29 languages. Best for voice overs, audiobooks, post-production, or any other content creation needs
Eleven Flash v2.5
Our ultra low latency model in 32 languages. Ideal for conversational use cases.