Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
まだ動画はありません。フォームを送信して動画を生成してください。
さまざまなユースケースとパラメータ設定を確認できます
透明な価格設定、隠れた手数料なし。使用量に応じてお支払い。
| ルールとモダリティ | Channel | クレジット | 価格(USD) | 公式/参考価格 | 1日の節約額 |
|---|---|---|---|---|---|
grok- imagine-text-to-video-480p videogrokresolution: 480p | Starter | 0.2per second | $0.001 | - | - |
grok- imagine-text-to-video-720p videogrokresolution: 720p | Starter | 0.7per second | $0.003 | - | - |
grok-imagine の完全ガイド
ApiPassプロキシプラットフォームを通じて、テキストプロンプトを映画のようなショート動画に変換します。xAIのgrok-imagineモデルをシームレスに統合し、一貫したモーション、シーンの連続性、アスペクト比・尺・解像度・クリエイティブモードの詳細制御を備えた動画を生成できます。本番環境でのスケーリングを想定して構築されたApiPassの非同期APIゲートウェイにより、タスクを作成してtaskIdを受け取り、その後は自動コールバックWebhookまたはステータスポーリングで出力をすばやく取得できます。

ApiPass APIマーケットプレイスから利用できるGrok Imagine Text-to-Video機能は、自然言語のプロンプトを映画のようなAI動画クリップへ即座に変換します。xAIの高度な生成モデルを活用したこのAPIエンドポイントは、ApiPass経由でプロキシされ、迅速なコンセプトプロトタイピング、自動ショートフォームコンテンツ生成、企業向け動画制作ワークフローに対応します。開発者は、複雑な被写体の動き、豊かな環境、精密なカメラワーク、シーンのタイミングをプログラムで定義できます。
Grok Imagineモデルを通じて、詳細なテキストプロンプトを映画のようなAI動画クリップへ即座に変換します。被写体、環境、カメラワーク、雰囲気を記述するだけで、基盤となるGrokパイプラインがレンダリングを処理し、ApiPassを介した本番ワークフロー向けに最適化された追跡可能なタスクとして提供します。
Grokネイティブのfun、normal、spicyモードから選択し、モデルがモーションや視覚的なエネルギーをどのように解釈するかを制御できます。funはより創造的で遊び心のある解釈、normalはバランスの取れたモーション品質、spicyはよりダイナミックで強いモーション効果を生成します。
ApiPassプラットフォームは、Grokモデル向けの非同期タスクワークフローを提供します。ApiPassエンドポイント/api/v1/jobs/createTaskへリクエストを送信し、返却されたtaskIdを保存したうえで、/api/v1/jobs/recordInfoを照会するか、callBackUrlを指定して完了通知を自動で受け取れます。
アクション、カメラの動き、シーンのダイナミクスを指定して、テキスト説明を映画のような動画に変換します。詳細なプロンプトがgrok-imagineパイプラインを直接導き、意図した視覚的リズム、シーケンス、タイミングを正確に捉えます。
プロジェクトのトーンに合わせてモーションの強度を調整できます。Grok Imagine APIは3つの異なる生成モードを提供します。安定したバランスの良い出力にはNormal、遊び心と想像力のある解釈にはFun、非常にダイナミックで表現力豊かなアクション効果にはSpicyを使用できます。
縦長、横長、正方形、ワイドスクリーン、縦型ロングなどの形式でクリップを作成できます。尺は6〜30秒で設定でき、プロトタイプ、プレビュー、本番用途に合わせて480pまたは720pの解像度を選択できます。
シンプルなテキストプロンプトから、すばやく共有しやすいモーションクリップを作成します。モバイルファーストのコンテンツには9:16のような縦型形式を、広告、プレビュー、ランディングページのビジュアルには16:9のようなワイドスクリーン形式を利用できます。
生成動画を開発プラットフォームやソフトウェアソリューションに統合し、動的バナー、アニメーションプレビュー、自動生成されるアセット背景、ユーザープロンプトにプログラムで適応するインタラクティブなクリエイティブツールを実現できます。
本格的な制作に入る前に、ビジュアルコンセプト、キャラクターの動き、シーン遷移、カメラアイデアを迅速に検証できます。非同期APIワークフローにより、プロンプト実験のバッチ処理を自動化しやすくなります。
Grok Imagine APIのネイティブパラメータを設定し、本番パイプラインに合わせてモーションスタイル、フレーミング、処理速度を最適化します。
バランスの取れた結果にはnormal、遊び心と想像力のあるモーションにはfun、より強くエネルギッシュまたは表現力豊かなモーションにはspicyを使用します。modeパラメータを省略した場合、デフォルトはnormalです。
縦長には2:3、横長には3:2、正方形には1:1、ワイドスクリーンには16:9、縦型ロングコンテンツには9:16を選択します。Durationは6〜30秒の整数値を受け付け、ステップは1です。
より高速なプレビューには480pを使用し、Grokから高解像度の出力が必要な場合は720pを使用します。本番環境の統合では、非同期タスクの完了時にApiPassプロキシゲートウェイがサービスへ通知できるよう、callBackUrlを指定してください。
新規ApiPassユーザーは無料クレジットで対応する生成ワークフローをテストできるため、スケール前にプロンプトの挙動、モーション品質、アスペクト比、モード、統合フローを簡単に評価できます。
任意のchannelパラメータはauto、starter、regular、officialをサポートします。autoを使用すると、ApiPassがリアルタイムの価格と安定性指標に基づいて、利用可能なチャネルへタスクを割り当てます。
各リクエストは生成タスクを作成し、taskIdを返します。この設計により、時間のかかる生成処理を安定して扱え、開発者はアプリケーションのワークフローをブロックせずに進捗を照会したり、完了コールバックを受け取ったりできます。
ApiPass playgroundを開き、詳細なプロンプトを入力して、aspect_ratio、mode、duration、resolutionなどの対応設定をテストします。デフォルト値であるaspect_ratio 2:3、mode normal、duration 6、resolution 480pから始めてください。
modelをgrok-imagine/text-to-videoに設定し、inputオブジェクトを含めて/api/v1/jobs/createTaskへPOSTリクエストを送信します。自動完了通知を受け取る必要がある本番システムでは、callBackUrlを含めてください。
ポーリングで問題ない場合は、返却されたtaskIdを使用して/api/v1/jobs/recordInfoを照会します。callBackUrlが設定されている場合は、コールバック通知を利用できます。タスクが成功すると、結果には生成された動画出力が含まれます。
すべてのAPIはBearer Tokenによる認証が必要です。
Authorization: Bearer
テキストプロンプトから非同期の Grok Imagine テキスト動画生成タスクを作成します。
1{
2 "model": "grok-imagine/text-to-video",
3 "channel": "auto",
4 "callBackUrl": "https://your-domain.com/api/callback",
5 "input": {
6 "prompt": "A couple of doors open to the right one by one randomly and stay open, to show the inside, each is either a living room, or a kitchen, or a bedroom or an office, with little people living inside.",
7 "aspect_ratio": "2:3",
8 "mode": "normal",
9 "duration": 6,
10 "resolution": "480p"
11 }
12}model必要stringモデルエンドポイント名です。この API では grok-imagine/text-to-video を使用してください。
grok-imagine/text-to-video
channelオプションstringデフォルトのチャネルは auto です。APIPASS は、リアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当てます。starter は超低コストですが、クォータが制限され、安定性は低めです。regular は標準的なチャネルで、公式 API より大幅に安価であり、安定性は中程度です。official はモデルネイティブ API を使用し、高い安定性、高速なタスク実行、公式価格を提供します。
デフォルトのチャネルは auto です。APIPASS は、リアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当てます。starter は超低コストですが、クォータが制限され、安定性は低めです。regular は標準的なチャネルで、公式 API より大幅に安価であり、安定性は中程度です。official はモデルネイティブ API を使用し、高い安定性、高速なタスク実行、公式価格を提供します。
利用可能なオプション:
auto
callBackUrlオプションstringタスク完了の自動通知を受け取るための任意のコールバック URL です。本番環境で使用する場合は、照会エンドポイントをポーリングする代わりにコールバック通知を使用することを推奨します。
https://your-domain.com/api/callback
prompt必要string目的の動画の動きを記述するテキストプロンプトです。望ましいビジュアル、動き、アクションの流れ、カメラワーク、タイミング、被写体、環境、モーションダイナミクスについて、詳しく具体的に記述してください。最大長: 5000 文字。英語のプロンプトに対応しています。
必須です。より良い結果を得るために、動き、アクション、カメラワーク、シーンのダイナミクスを明確に記述してください。
A couple of doors open to the right one by one randomly and stay open, to show the inside, each is either a living room, or a kitchen, or a bedroom or an office, with little people living inside.
aspect_ratioオプションstring生成される動画の幅と高さの比率を指定します。デフォルト: 2:3。
2:3 は縦長、3:2 は横長、1:1 は正方形、16:9 はワイドスクリーン、9:16 は縦型ロングフォーマットです。
利用可能なオプション:
2:3
modeオプションstring動きのスタイルと強度に影響する生成モードです。デフォルト: normal。
fun はより創造的で遊び心のある解釈を行います。normal は良好なモーション品質を備えたバランスの取れたアプローチを提供します。spicy はよりダイナミックで強い動きの効果を生成します。
利用可能なオプション:
normal
durationオプションnumber生成される動画の長さ(秒)です。最小: 6、最大: 30、ステップ: 1。
6 から 30 までの整数値を使用してください。
6
resolutionオプションstring生成される動画の解像度です。デフォルト: 480p。
利用可能なオプション:
480p
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Authorization: Bearer YOUR_API_KEY" \
3 -H "Content-Type: application/json" \
4 -d '{
5 "model": "grok-imagine/text-to-video",
6 "channel": "auto",
7 "callBackUrl": "https://your-domain.com/api/callback",
8 "input": {
9 "aspect_ratio": "2:3",
10 "mode": "normal",
11 "duration": 6,
12 "resolution": "480p",
13 "prompt": "A couple of doors open to the right one by one randomly and stay open, to show the inside, each is either a living room, or a kitchen, or a bedroom or an office, with little people living inside."
14 }
15}'1{
2 "taskId": "task_44e091a72fa8424b",
3 "status": "queued"
4}taskId一意のタスク識別子です。この値を使用してタスクのステータスと結果を照会します。
status作成後の現在のタスクステータスです。

ByteDance
ByteDance
開始価格
0 クレジット
ByteDance
ByteDance
開始価格
0 クレジット
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
開始価格
0 クレジット
MiniMax
MiniMax
開始価格
0 クレジット
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
開始価格
0 クレジット
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
開始価格
0 クレジット
wan
wan
開始価格
0 クレジット
Runway
Runway
開始価格
0 クレジット
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
開始価格
0 クレジット
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
開始価格
0 クレジット
Luma
Luma
開始価格
0 クレジット
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
開始価格
0 クレジット
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
開始価格
0 クレジット
開始価格
0 クレジット
grok
grok
開始価格
0 クレジット
kling
kling
開始価格
0 クレジット