Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
まだ画像はありません。フォームを送信して画像を生成してください。
さまざまなユースケースとパラメータ設定を確認できます
透明な価格設定、隠れた手数料なし。使用量に応じてお支払い。
| ルールとモダリティ | Channel | クレジット | 価格(USD) | 公式/参考価格 | 1日の節約額 |
|---|---|---|---|---|---|
text-to-image imagegrokenable_pro: false | Starter | 0.45per run | $0.002 | - | - |
text-to-image-quality imagegrokenable_pro: true | Starter | 0.6per run | $0.003 | - | - |
grok-imagine の完全ガイド
grok-imagine/text-to-image エンドポイントを使用して、テキストプロンプトから高忠実度の画像を直接生成できます。ApiPass プラットフォームからシームレスに利用可能です。基盤となる Grok モデルは複雑な視覚的説明を高精度に解釈し、複数のアスペクト比をネイティブにサポートするほか、本番環境向けレンダリングを想定した高度な品質モードも提供します。

ApiPass は xAI の Grok Imagine モデル向けの高並行 API プロキシとして機能し、標準的な HTTP リクエストで高度なテキスト画像生成アセットを作成できます。ApiPass は上流インフラを安定した非同期ワークフローとしてラップし、レート制限、課金、グローバルルーティングを標準で処理するため、Grok のビジュアル生成機能をプラットフォーム、開発者向けソリューション、自動化されたバックエンドパイプラインにそのまま組み込めます。
明確な英語の説明文を書くことで、ポートレート、環境、製品、コンセプトアート、エディトリアルシーン、抽象的なビジュアルを生成できます。
縦向きには 2:3、横向きには 3:2、正方形には 1:1、ワイドスクリーン画像には 16:9、縦長の垂直画像には 9:16 を使用できます。
まずタスクを作成し、その後コールバックで完了結果を受け取るか、返却された taskId を使ってタスク記録エンドポイントを照会します。
本番環境で統合する場合は、タスク作成時に callBackUrl を設定すると、ApiPass がタスク結果の更新を自動的に送信できます。
柔らかなライティング、フィルムグレイン、時代感のあるスタイリング、浅い被写界深度を備えた、温かく雰囲気のあるポートレートを作成します。
スタジオライティング、シンプルな背景、余白、洗練された表面ディテールを備えた、クリーンな商用スタイルの画像を生成します。
説明的なアイデアを、ムードボード、デザイン探索、クリエイティブ提案、ビジュアルリサーチ向けの印象的なビジュアルに変換します。
ワークフローはシンプルです。プロンプトを作成し、任意の設定を選択し、タスクを作成して、生成された画像 URL を取得します。
被写体、場所、構図、スタイル、ライティング、色、雰囲気、重要なディテールを含めます。prompt パラメータは必須で、最大 5000 文字までサポートします。
aspect_ratio を 2:3、3:2、1:1、16:9、または 9:16 に設定します。空のままにすると、デフォルトの 1:1 正方形フォーマットが使用されます。
速度モードには enable_pro=false、品質モードには enable_pro=true を設定します。
ApiPass エンドポイント /api/v1/jobs/createTask に POST リクエストを送信します。返却された taskId を使って /api/v1/jobs/recordInfo を照会するか、callBackUrl を設定して結果を自動的に受け取ります。
Grok Text-to-Image の生成は非同期です。まず生成タスクを作成し、その後コールバック通知またはポーリングによって最終的な画像 URL を受け取ります。
Authorization: Bearer YOUR_API_KEY と Content-Type: application/json を指定して、POST https://api.apipass.dev/api/v1/jobs/createTask を呼び出します。リクエストボディのトップレベルは model と input に固定されており、callBackUrl は任意です。
このエンドポイントでは model 値として grok-imagine/text-to-image を使用します。
コールバック通知を設定していない場合は、GET https://api.apipass.dev/api/v1/jobs/recordInfo?taskId=YOUR_TASK_ID でステータスを確認し、output.urls を取得します。
callBackUrl が設定されている場合、ApiPass はその URL にタスク更新を送信します。タスクが成功すると、生成された画像結果 URL を含む output.urls が返されます。
{"model":"grok-imagine/text-to-image","channel":"auto","callBackUrl":"https://your-domain.com/api/callback","input":{"prompt":"Cinematic portrait of a woman sitting by a vinyl record player, retro living room background, soft ambient lighting, warm earthy tones, nostalgic 1970s wardrobe, reflective mood, gentle film grain texture, shallow depth of field, vintage editorial photography style.","aspect_ratio":"3:2","enable_pro":false}}
ソーシャルチャネル向けに、共有しやすい画像、サムネイル、投稿用グラフィック、キャンペーンコンセプト、縦型ビジュアルを生成します。
動的バナー、プロフィール用アセット、グラフィックツール、パーソナライズされたビジュアル、自動化されたユーザー生成コンテンツ体験のために、プロンプトベースの画像生成を開発者プラットフォームへ組み込めます。
制御されたライティングと構図で、洗練された製品シーン、広告モックアップ、パッケージコンセプト、プレゼンテーション用アセットを作成します。
アートディレクション、キャラクター案、カラーパレット、シーンレイアウト、エディトリアルコンセプト、ビジュアルデザインリサーチをすばやく探索できます。
xAI の高度な生成アーキテクチャを基盤としており、このモデルは深い意味的整合性に優れ、複雑で多層的な英語プロンプトの説明を、意図から逸脱することなく高忠実度のビジュアルアセットへ変換します。
ApiPass は生の Grok インフラを完全管理型の高並行プロキシレイヤーとしてラップし、上流のレート制限スパイクを排除しながら、商用ネットワークのスケーリングに必要なエンタープライズグレードの稼働安定性を確保します。
このエンドポイントは API レベルで、1:1(正方形)、16:9(ワイドスクリーン)、9:16(縦長)、3:2(横長)、2:3(ポートレート)の 5 つの主要な本番向けアスペクト比をネイティブにサポートします。
いいえ。ApiPass の統合では非同期タスクアーキテクチャを利用します。API は一意の taskId を含む即時の 202 Accepted レスポンスを返すため、メインのバックエンドスレッドを完全にブロックしません。
はい。リクエストペイロードに任意の seed 整数を渡すことで、モデルの初期ノイズ状態を固定できます。これにより、プロンプトのデバッグや特定のレイアウト変数の調整時に、複数回の生成で構造的一貫性を確保できます。
premium を選択すると、Grok バックエンドで拡張された推論ステップが実行されます。レンダリングライフサイクルの所要時間はわずかに増えますが、画像内の細かな空間精度、テクセル密度、タイポグラフィの可読性が向上します。
すべてのAPIはBearer Tokenによる認証が必要です。
Authorization: Bearer
テキストプロンプトから非同期の Grok Imagine テキストから画像生成タスクを作成します。
1{
2 "model": "grok-imagine/text-to-image",
3 "channel": "auto",
4 "callBackUrl": "https://your-domain.com/api/callback",
5 "input": {
6 "prompt": "Cinematic portrait of a woman sitting by a vinyl record player, retro living room background, soft ambient lighting, warm earthy tones, nostalgic 1970s wardrobe, reflective mood, gentle film grain texture, shallow depth of field, vintage editorial photography style.",
7 "aspect_ratio": "3:2",
8 "enable_pro": false
9 }
10}model必要stringモデルエンドポイント名。このエンドポイントでは grok-imagine/text-to-image を使用します。
grok-imagine/text-to-image
channelオプションstringデフォルトの channel は auto です。APIPASS はリアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当てます。starter は超低コストですが、クォータが制限され安定性は低めです。regular は標準で、公式 API より大幅に低コストで、中程度の安定性があります。official はモデルネイティブ API を使用し、高い安定性、高速なタスク実行、公式価格を提供します。
デフォルトの channel は auto です。APIPASS はリアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当てます。starter は超低コストですが、クォータが制限され安定性は低めです。regular は標準で、公式 API より大幅に低コストで、中程度の安定性があります。official はモデルネイティブ API を使用し、高い安定性、高速なタスク実行、公式価格を提供します。
利用可能なオプション:
auto
callBackUrlオプションstring生成完了時にタスク結果の自動通知を受け取るためのコールバック URL。本番環境では、ステータスエンドポイントのポーリングの代わりに使用することを推奨します。
https://your-domain.com/api/callback
prompt必要string目的の画像を説明するテキストプロンプト。構図、スタイル、照明、雰囲気、その他の詳細を含め、視覚要素を具体的かつ詳細に記述してください。最大長: 5000 文字。英語のプロンプトに対応しています。
レコードプレーヤーのそばに座る女性のシネマティックなポートレート、レトロなリビングルームの背景、柔らかな環境光、温かみのあるアースカラー、ノスタルジックな 1970s のワードローブ、内省的な雰囲気、繊細なフィルムグレインの質感、浅い被写界深度、ヴィンテージのエディトリアル写真スタイル。
aspect_ratioオプションstring生成される画像の幅と高さの比率を指定します。デフォルト: 1:1。
2:3 は縦向き、3:2 は横向き、1:1 は正方形、16:9 はワイドスクリーン形式、9:16 は縦長形式です。
利用可能なオプション:
3:2
enable_proオプションbooleanリクエストの処理戦略を制御します。false は速度モードを有効にし、レイテンシに敏感なシナリオ向けにレスポンスタイムとスループットを優先します。true は品質モードを有効にし、より高い精度が必要なシナリオ向けに処理品質と精度を優先します。
false
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Authorization: Bearer YOUR_API_KEY" \
3 -H "Content-Type: application/json" \
4 -d '{
5 "model": "grok-imagine/text-to-image",
6 "channel": "auto",
7 "callBackUrl": "https://your-domain.com/api/callback",
8 "input": {
9 "aspect_ratio": "3:2",
10 "prompt": "Cinematic portrait of a woman sitting by a vinyl record player, retro living room background, soft ambient lighting, warm earthy tones, nostalgic 1970s wardrobe, reflective mood, gentle film grain texture, shallow depth of field, vintage editorial photography style.",
11 "enable_pro": false
12 }
13}'1{
2 "taskId": "task_xxx",
3 "status": "queued"
4}taskId作成された生成ジョブの一意のタスク ID。この ID を使用してタスクのステータスと結果を照会します。
status作成後の初期タスクステータス(queued など)。

flux
flux
Generate photorealistic images with robust text
開始価格
0 クレジット
Nano Banana 2 Lite, aka Gemini 3.1 Flash-Lite Image, is a newly released image model from Google DeepMind built for fast 1K image generation, efficient creative iteration, prompt-based image editing, and responsive visual output in product-facing creative scenarios.
開始価格
0 クレジット
OpenAI
OpenAI
Generate intentionally designed visuals with less prompting using the latest OpenAI GPT Image 2 model.
開始価格
0 クレジット
Nano Banana now allows you to freely draw on edited images, bringing you a completely new experience. Simply click on the image to draw whatever you want. You can also add text and details, and Gemini will do the rest.
開始価格
0 クレジット
Fast image generation model built on Gemini 3.1 Flash Image. Supports text-to-image, image editing, multi-image fusion with up to 14 reference images, Google Search grounding, and outputs up to 4K resolution.
開始価格
0 クレジット
seedream
seedream
開始価格
0 クレジット
qwen
qwen
Generate realistic 2K images with structured text
開始価格
0 クレジット
seedream
seedream
開始価格
0 クレジット
OpenAI
OpenAI
Bring your ideas to life with sharper, faster, more precise image generation using the GPT Image 2.5 API.
開始価格
0 クレジット
wan
wan
Generate images with cinematic precision through high-fidelity text-to-image synthesis and structural editing.
開始価格
0 クレジット
seedream
seedream
Gemini said Generate images with lightning-fast efficiency and high-fidelity detail through a streamlined, lightweight architecture optimized for instant creative expression.
開始価格
0 クレジット
qwen
qwen
Generate realistic 2K images with structured text
開始価格
0 クレジット
Luma
Luma
開始価格
0 クレジット
seedream
seedream
開始価格
0 クレジット