Eleven Flash v2.5
eleven_flash_v2_5
Our ultra low latency model in 32 languages. Ideal for conversational use cases.
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| voice_id *声音id | text | — | — | |
| language_codeISO 639-1语言code | text | — | — | |
| similarity_boostSimilarity Boost | slider | 0.75 | 0 ~ 1 · step 0.05 | |
| stabilityStability | slider | 0.5 | 0 ~ 1 · step 0.05 |
出力フィールド
| フィールド | 型 | 説明 |
|---|---|---|
| audio_url | string |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/eleven_flash_v2_5" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/eleven_flash_v2_5",
headers=HEADERS,
json={
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/eleven_flash_v2_5", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"voice_id": "JBFqnCBsd6RMkjVDRZzb",
"language_code": "en",
"similarity_boost": 0.8,
"stability": 0.55
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
Flash V2.5
高速・低コスト・ノーコールドスタートを実現する高品質テキスト読み上げモデル。
Flash V2.5 は、WaveSpeed AI 上で提供される ElevenLabs のテキスト読み上げモデルです。自然な発音、滑らかな話速、豊富な音声ライブラリに加え、音声の類似度や安定性を細かく調整できるため、ナレーション、音声案内、コンテンツ制作など幅広い用途に適しています。
🚀 主な特長
- ノーコールドスタート:待機時間を抑えやすく、リアルタイム用途や高頻度処理に適しています。
- 自然で聞き取りやすい音声:明瞭な発音、自然な抑揚、安定したテンポで高品質な読み上げを実現します。
- 豊富な音声ライブラリ:多言語対応の内蔵音声に加え、カスタム
voice_idにも対応しています。 - 音声表現の細かな制御:
similarityとstabilityにより、話者らしさ、明瞭さ、発話の一貫性を調整できます。 - 英語の数値・日時表現に強い:
use_speaker_boostにより、英語の数字、日付、時刻、単位の読み上げ品質を向上できます。 - スケールしやすい料金体系:文字数ベースの明確な課金で、大量生成や商用ワークフローにも導入しやすい構成です。
🛠️ 技術仕様
| 項目 | 内容 |
|---|---|
| モデル名 | Flash V2.5 |
| モデル ID | elevenlabs/flash-v2.5 |
| モデル種別 | テキスト読み上げ(TTS) |
| 入力 | テキスト |
| 出力 | 音声 |
| 出力形式 | MP3 |
| 最大入力長 | 10000 文字 |
| 課金単位 | 実際の文字数に基づいて課金。価格は 1000 文字あたりで表示 |
| voice_id | 既定値 Alice。内蔵音声およびカスタム voice_id に対応 |
| similarity | 0.0~1.0、既定値 1.0。音声の類似度と明瞭さを調整 |
| stability | 0.0~1.0、既定値 0.5。発話の安定性を調整 |
| use_speaker_boost | 真偽値、既定値 true。英語の数値や単位の正規化を改善 |
| ポーズ制御 | 単語間に <#x#> を挿入することで 0.01~99.99 秒の間を指定可能 |
| レイテンシ | 高速生成向けに最適化。実際の推論時間はテキスト長と負荷状況に依存 |
| 対応言語 | 多言語音声に対応。特に英語の数字・日付読み上げに強み |
サンプルプロンプト
注:本モデルはテキスト読み上げモデルのため、以下は画像生成用ではなく、読み上げ入力例です。
Welcome to our product demo. Today we'll walk through the key features, pricing, and setup in under two minutes.Your appointment is scheduled for 3:45 PM on September 18th. Please arrive 10 minutes early.The package weighs 2.5 kilograms and will arrive in 3 to 5 business days.<#0.5#>Thank you for your order.
💰 料金
| 項目 | 価格 |
|---|---|
| 生成音声(1000 文字あたり) | $0.05 |
💡 最適なユースケース
- マーケティング・ブランドコンテンツ:広告音声、商品紹介、SNS 向けナレーションの制作。
- 教育・研修:講義音声、チュートリアル、語学教材、解説コンテンツの読み上げ。
- カスタマーサポート・音声アシスタント:自動案内、通知、FAQ 音声化、対話型体験の強化。
- メディア・出版:ポッドキャスト、オーディオブック、要約音声、多言語ローカライズ音声の生成。
🔗 関連モデル
- Elevenlabs Flash V2:Flash 系列の旧バージョンで、既存フローとの互換性を重視する場合に適しています。
- Elevenlabs Multilingual V1:多言語音声生成やローカライズ用途に適した関連モデルです。
関連モデル
Eleven v3
The most expressive model. Supports 70+ languages. Requires more prompt engineering than our previous models.
Eleven Turbo v2.5
Our high quality, low latency model in 32 languages. Best for developer use cases where speed matters and you need non-English languages.
ElevenLabs Multilingual V2 is a multilingual text-to-speech model
Our most life-like, emotionally rich mode in 29 languages. Best for voice overs, audiobooks, post-production, or any other content creation needs