xAI Grok Imagine Video v1.5 テキストから動画生成
x-ai/grok-imagine-video-v1.5/text-to-video
テキストプロンプトから1-15秒の動画を生成します。480p、720p、1080pに対応しています。
サンプル
パラメータ
| 名前 | 型 | 既定 | 制約 | 説明 |
|---|---|---|---|---|
| prompt *プロンプト | textarea | — | ≤ 5000 chars | 生成したい動画のテキスト説明。 |
| duration長さ | slider | 6 | 1 ~ 15 · step 1 | 出力動画の長さ(秒)。 |
| aspect_ratioアスペクト比 | select | 16:9 | 16:9 | 1:1 | 9:16 | 3:2 | 2:3 | 生成される動画のアスペクト比。 |
| resolution解像度 | select | 720p | 720p | 480p | 1080p | 出力動画の解像度。 |
出力フィールド
| フィールド | 型 | 説明 |
|---|---|---|
| videos | array<string> |
API
統一 REST API でこのモデルを呼び出せます。API Keys ページでキーを取得してください。
cURL
# 1) Submit — returns { "task_uuid": "..." }
curl -X POST "https://www.namifusion.com/api/v1/marketplace/run/x-ai/grok-imagine-video-v1.5/text-to-video" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"input": {
"prompt": "A cinematic futuristic boulevard at sunset, moving vehicles, glowing signs, atmospheric haze, smooth tracking shot, photorealistic.",
"duration": 6,
"aspect_ratio": "16:9",
"resolution": "720p"
}
}'
# 2) Poll until status is "completed", then read the output URLs
curl "https://www.namifusion.com/api/v1/marketplace/run/tasks/TASK_UUID" \
-H "Authorization: Bearer YOUR_API_KEY"Python
import time, requests
API_KEY = "YOUR_API_KEY"
HEADERS = {"Authorization": f"Bearer {API_KEY}"}
# 1) Submit
resp = requests.post(
"https://www.namifusion.com/api/v1/marketplace/run/x-ai/grok-imagine-video-v1.5/text-to-video",
headers=HEADERS,
json={
"input": {
"prompt": "A cinematic futuristic boulevard at sunset, moving vehicles, glowing signs, atmospheric haze, smooth tracking shot, photorealistic.",
"duration": 6,
"aspect_ratio": "16:9",
"resolution": "720p"
}
},
)
resp.raise_for_status() # 401/402/429/5xx stop here instead of polling a bad task
task = resp.json()
# 2) Poll until a terminal state (completed / failed / cancelled).
# This model is allowed up to 300s server-side.
deadline = time.time() + 360
while task.get("status") not in ("completed", "failed", "cancelled"):
if time.time() > deadline:
raise TimeoutError(f"still {task.get('status')} — keep the task_uuid and poll later")
time.sleep(3)
poll = requests.get(f"https://www.namifusion.com/api/v1/marketplace/run/tasks/{task['task_uuid']}", headers=HEADERS)
poll.raise_for_status()
task = poll.json()
print(task["status"], task.get("output"))JavaScript
const API_KEY = "YOUR_API_KEY";
const HEADERS = { Authorization: `Bearer ${API_KEY}` };
// 1) Submit
const resp = await fetch("https://www.namifusion.com/api/v1/marketplace/run/x-ai/grok-imagine-video-v1.5/text-to-video", {
method: "POST",
headers: { ...HEADERS, "Content-Type": "application/json" },
body: JSON.stringify({
"input": {
"prompt": "A cinematic futuristic boulevard at sunset, moving vehicles, glowing signs, atmospheric haze, smooth tracking shot, photorealistic.",
"duration": 6,
"aspect_ratio": "16:9",
"resolution": "720p"
}
}),
});
if (!resp.ok) throw new Error(`submit failed: ${resp.status} ${await resp.text()}`);
let task = await resp.json();
// 2) Poll until a terminal state (completed / failed / cancelled).
// This model is allowed up to 300s server-side.
const deadline = Date.now() + 360 * 1000;
while (!["completed", "failed", "cancelled"].includes(task.status)) {
if (Date.now() > deadline) throw new Error(`still ${task.status} — keep the task_uuid and poll later`);
await new Promise((r) => setTimeout(r, 3000));
const poll = await fetch(`https://www.namifusion.com/api/v1/marketplace/run/tasks/${task.task_uuid}`, { headers: HEADERS });
if (!poll.ok) throw new Error(`poll failed: ${poll.status}`);
task = await poll.json();
}
console.log(task.status, task.output);ドキュメント
xAI Grok Imagine Video v1.5 Text to Video
🚀 Key Features
- プロンプトのみで動画生成:画像入力なしで、プロンプトだけから短尺動画を生成できます。
- モーションとカメラ表現に対応:被写体の動き、カメラモーション、雰囲気、時間経過による変化をプロンプトで細かく記述できます。
- 柔軟な出力品質:480p、720p、1080p から選択でき、試作から最終用途までコストと品質を調整可能です。
- 複数のアスペクト比:16:9、1:1、9:16、3:2、2:3 に対応し、横向き・正方形・縦長の配信形式に適応します。
- 短尺生成に最適化:1〜15 秒 のクリップ生成に適しており、素早い試行錯誤と安定したプロンプト制御に向いています。
🛠️ Technical Specifications
| 項目 | 内容 |
|---|---|
| モデル名 | xAI Grok Imagine Video v1.5 Text to Video |
| モデル種別 | テキスト生成動画モデル |
| モデルアーキテクチャ | プロンプト駆動の短尺動画生成 |
| 入力 | プロンプト |
| 出力 | 動画 |
| 出力形式 | 生成された短尺動画 |
| 長さ | 1〜15 秒(デフォルト:6) |
| アスペクト比 | 16:9、1:1、9:16、3:2、2:3(デフォルト:16:9) |
| 解像度 | 480p、720p、1080p(デフォルト:720p) |
| フレームレート | 非公開 |
| 制御性 | シーン、被写体の動き、カメラモーション、テンポ、雰囲気をプロンプトで指定可能 |
| 最適な用途 | 短尺のコンセプト動画、SNS 向けコンテンツ、迅速なクリエイティブ検証 |
サンプルプロンプト
- 夜明けの海に打ち寄せるシネマティックな波、非常に高精細、海霧の中を差し込む黄金の光、ゆっくり前進するカメラ、ドラマチックな雰囲気。
- ネオンに照らされた夜の都市を歩く未来的なファッションモデル、弱い雨、濡れた路面の反射、滑らかな追従ショット。
- 山道のヘアピンカーブをドリフトで駆け抜ける赤いスポーツカー、低いカメラアングル、背景に強いモーションブラー、緊張感のある演出。
💰 Pricing
| 解像度 | 1 秒あたりの価格 | 5 秒の例 | 10 秒の例 | 15 秒の例 |
|---|---|---|---|---|
| 480p | $0.08 | $0.40 | $0.80 | $1.20 |
| 720p | $0.14 | $0.70 | $1.40 | $2.10 |
| 1080p | $0.25 | $1.25 | $2.50 | $3.75 |
課金ルール
- 料金は 長さ と 解像度 に応じて線形に計算されます。
- 課金対象の長さは 1 秒単位で切り上げられます。
- 最小課金長さは 1 秒 です。
- 最大対応長さは 15 秒 です。
💡 Best Use Cases
- SNS 向け動画制作:縦向き・正方形・横向きの各フォーマットで、投稿用やプロモーション用の短尺動画を素早く作成できます。
- コンセプト可視化:文章ベースのアイデアを、ムードクリップやモーション検証用の映像として具体化できます。
- 広告モックアップ:キャンペーン提案、企画レビュー、制作前の方向性確認向けに、短時間でアニメーション案を作成できます。
- クリエイティブプロトタイピング:モーション、テンポ、カメラ演出をプロンプトベースで試し、制作初期の検証を効率化できます。
🔗 Related Models
- xAI Grok Imagine Video v1.5 Image-to-Video:既存の画像をもとに短尺動画へアニメーション化するモデルです。
- xAI Grok Imagine Video v1.5 Reference-to-Video:最大 7 枚の参照画像で生成を誘導し、より高いビジュアル一貫性を求める用途に適しています。
関連モデル
MiniMax H3 テキストから動画生成
MiniMax H3 テキストから動画生成は、プロンプトから一貫性のある 2K 動画を生成できます。4〜15秒の柔軟な長さと、6種類のアスペクト比に対応し、シネマティックなシーン、クリエイティブ動画、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能・コールドスタートなし・手頃な価格で利用できます。
ltx-2.5/text-to-video(テキストから動画生成)
LTX 2.5 Text-to-Video は、テキストプロンプトから高忠実度で音声と映像が同期したコンテンツを生成します。長さを柔軟に設定でき、720P / 1080P / 2K / 4K 出力に対応しているため、シネマティックな動画、SNS コンテンツ、広告、制作ワークフローに適しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格を実現します。
Kling Omni Video O3 標準版テキストから動画生成
Kling Omni Video O3 は、MVL(マルチモーダルビジュアルランゲージ)技術を採用したKuaishouの高度な統合型マルチモーダル動画モデルです。テキストから動画生成モードでは、プロンプトを基に主体の一貫性、自然な物理シミュレーション、正確な意味理解を備えた映画品質の動画を生成します。音声生成にも対応。すぐに使えるREST API、最高のパフォーマンス、冷スタートなし、手頃な価格。
Kling 3.0 標準版
Kling 3.0 標準版は、高品質なテキストから動画生成を提供します。滑らかな動き、映画のような映像、正確なプロンプトの適合性、そして共有可能なクリップ用のネイティブ音声を備えています。即時利用可能な REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kling V2.6 テキストから動画生成 API
Kling 2.6 は、滑らかなモーション、映画のようなビジュアル、強力なプロンプト適合性、そしてネイティブオーディオを備えた、トップクラスのテキストから動画生成を提供します。共有可能なクリップを即座に生成可能。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Gemini Omni Flash テキストから動画生成 API
Gemini Omni Flash Text to Video は、テキストのプロンプトから音声同期付きの短い AI 動画を生成し、映像生成と音声出力を組み合わせて高速なマルチモーダル動画作成を実現します。すぐに使える REST 推論 API で、高性能、コールドスタートなし、手頃な価格です。
Seedance 2.0 Mini テキストから動画生成
Seedance 2.0 Mini Text to Video は、ByteDance による高速かつ低コストなテキストから動画生成モデルで、シネマティックなマルチショット動画に適しています。テキストのプロンプトから物語性のあるシーケンスを生成し、AI カメラ制御、シーン間で一貫したキャラクター、480P / 720P / 1080P / 4K 出力、4〜15 秒の長さ、柔軟なアスペクト比に対応しています。すぐに使える REST 推論 API を提供し、高性能、コールドスタートなし、手頃な価格が特長です。
Seedance 2.5 テキストから動画生成
Seedance 2.5 は次世代の高品質動画生成モデルであり、テキストから動画生成、複数のアスペクト比、480p/720p/1080p 解像度、AI 同期音声生成に対応し、指示追従性・カメラ制御・モーション品質が向上しています。