まだ動画はありません。フォームを送信して動画を生成してください。
さまざまなユースケースとパラメータ設定を確認できます
透明な価格設定、隠れた手数料なし。使用量に応じてお支払い。
| ルールとモダリティ | Channel | クレジット | 価格(USD) | 公式/参考価格 | 1日の節約額 |
|---|---|---|---|---|---|
with-video-720p videoGoogleresolution: 720p | Regular | 268per run | $1.218 | - | - |
with-video-1080p videoGoogleresolution: 1080p | Regular | 270per run | $1.227 | - | - |
with-video-4k videoGoogleresolution: 4k | Regular | 400per run | $1.818 | - | - |
no-video-720p-4s videoGoogleduration: 4, resolution: 720p | Regular | 102per run | $0.464 | - | - |
no-video-720p-6s videoGoogleduration: 6, resolution: 720p | Regular | 135per run | $0.614 | - | - |
no-video-720p-8s videoGoogleduration: 8, resolution: 720p | Regular | 168per run | $0.764 | - | - |
no-video-720p-10s videoGoogleduration: 10, resolution: 720p | Regular | 200per run | $0.909 | - | - |
no-video-1080p-4s videoGoogleduration: 4, resolution: 1080p | Regular | 103per run | $0.468 | - | - |
no-video-1080p-6s videoGoogleduration: 6, resolution: 1080p | Regular | 136per run | $0.618 | - | - |
no-video-1080p-8s videoGoogleduration: 4, resolution: 1080p | Regular | 168per run | $0.764 | - | - |
no-video-1080p-10s videoGoogleduration: 10, resolution: 1080p | Regular | 202per run | $0.918 | - | - |
no-video-4k-4s videoGoogleduration: 4, resolution: 4k | Regular | 233per run | $1.059 | - | - |
no-video-4k-6s videoGoogleduration: 6, resolution: 4k | Regular | 268per run | $1.218 | - | - |
no-video-4k-8s videoGoogleduration: 8, resolution: 4k | Regular | 300per run | $1.364 | - | - |
no-video-4k-10s videoGoogleduration: 10, resolution: 4k | Regular | 335per run | $1.523 | - | - |
Gemini Omni の完全ガイド
Google の Gemini Omni モデルにより、映画のような質感で物理挙動を考慮した AI 動画を生成。再利用可能なキャラクターや音声と組み合わせ、単一の ApiPass エンドポイントから利用できます。

ApiPass の Gemini Omni Video API は、Google の Gemini Omni Flash が提供する動画生成機能です。Gemini Omni Flash は、高速な動画生成、編集、映画的な演出制御のために設計された高性能マルチモーダルモデルです。テキストから動画への生成を単独の呼び出しとして扱うのではなく、ApiPass は Gemini Omni Video を Omni ファミリーのコンポジションレイヤーとして提供します。ApiPass 上で作成済みの再利用可能なキャラクターリソースや音声プロファイルを渡すことで、映像と音声が同期した完全にレンダリング済みの動画を取得できます。Gemini Omni はテキスト、画像、音声、動画を同時に処理するため、より一貫性があり、まとまりがあり、制御しやすい出力を実現します。ApiPass はこの機能を、他のモデルカタログと同じ 1 つの API キーで利用できるように統合しています。
個別のアカウント管理、プレビューアクセス、クラウド設定を行う代わりに、ApiPass では既に他のモデルカタログで使用している同じ API キーで Gemini Omni Video を利用できます。
Gemini Omni Video は、テキスト、画像、動画、音声を任意に組み合わせた単一のプロンプトを受け付けます。空のテキストプロンプトからではなく、実際のクリエイティブ素材を起点に生成できます。
現実世界の物理モデルに基づいて、信頼感のある反射、重力、照明、天候をレンダリングします。動きのあるショットでもアーティファクトに崩れにくく、シーン全体の視覚的な整合性を保ちます。
複数の参照画像や短い動画クリップで生成をガイドでき、モデルは被写体、スタイル、シーンの一貫性を維持します。編集やショットをまたいでもアイデンティティを安定して保てます。
会話型編集により、自然言語で動画を段階的に調整・編集できます。プロンプト全体を最初から作り直すことなく、シーンを作り替えられます。
Gemini Omni は幅広い世界知識と強力な動画生成能力を組み合わせています。文化的背景、歴史的設定、科学的な正確性を理解し、単に見栄えが良いだけでなく、意味の通る動画を生成します。特定の時代、場所、概念を参照し、事実に基づく整合性が求められるプロンプトに有用です。
Gemini Omni API は自然言語による動画編集に対応しており、毎回プロンプト全体を作り直す代わりに、シーンを段階的に調整できます。ユーザーは元のシーンの整合性を保ちながら、環境の変更、アクションの調整、オブジェクトの置き換え、カメラアングルの変更、視覚効果の追加を行えます。AI 動画エディター、クリエイターツール、既存映像をより直感的に変換する必要があるアプリケーションに役立ちます。
Gemini Omni Video は、視覚的な生成を物理、歴史、生物学、文化、物語のロジックに関する知識と結び付けます。これにより、生成される動画はランダムさが少なく、より意図のある内容になります。解説動画、映画的なストーリーテリング、製品コンセプト、教育コンテンツに有用です。
テキストは方向性を定義し、画像は被写体やスタイルを導き、動画は動きやシーンの文脈を提供し、音声やキャラクターリソースは発話主導またはアイデンティティを意識したワークフローを支援できます。これにより開発者は、空のプロンプトだけでなく実際のクリエイティブ素材から始める動画ツールを構築できます。
Gemini Omni Video は、キャラクターの存在感、表情、話し方、環境が自然につながって感じられる必要があるアバター型のシナリオを支援できます。プレゼンター動画、キャラクター主導のコンテンツ、インタラクティブメディア、次世代のクリエイティブ動画プロダクトに有用です。
プロンプトと 1 枚の参照画像から縦型クリップを生成し、各エピソードで繰り返し登場する主人公を維持できます。
ブランドに合った同一のスポークスパーソンと音声を共有しながら、製品、メッセージ、市場を差し替えたローカライズ広告バリエーションを作成できます。
教育コンテンツ、歴史的に正確なシーン、知識を豊富に含むストーリーテリングなど、視覚品質と同じくらい事実の整合性が重要な用途に適しています。
音声表現が最終結果を導く、発話主導のアバター型ワークフローに対応します。プレゼンター動画、キャラクターの会話、ナレーション付きシーン、音声・表情・画面上の動きが自然につながって感じられる生成クリップに有用です。
公式の Gemini Omni へのアクセスは現在、プレビュートラック、複数のコンソール、エンタープライズ向けサーフェスに分散しています。ApiPass はこれを、他のモデルスタックと同じ単一の API キーの背後に統合します。そのため統合は、新しいプロバイダーのオンボーディングではなく、base-URL とキーの変更で済みます。
公式 API では、各生成が自己完結型のリクエストとして扱われます。ApiPass では、Gemini Omni Video が Gemini Omni Character と Gemini Omni Audio の機能を通じて、プラットフォーム上で既に作成したキャラクターおよび音声リソースを利用できるように設計されています。これにより、アイデンティティと音声のライブラリを維持し、その後の任意の動画ジョブに組み込めます。
繰り返し登場する主人公、ナレーター、ビジュアルスタイルが必要なエピソード形式の短尺動画を制作できます。
市場やクリエイティブのバリエーションをまたいでもブランドの一貫性を保つ、ローカライズされたパーソナライズ広告バリエーションを展開できます。
コースの台本やレッスンプランを、歴史的または科学的に根拠のあるシーンを備えた、ナレーション付きのキャラクター主導の教育動画に変換できます。
多数のショットや反復制作をまたいで同じキャラクターが安定して登場する、シネマティック映像、トレーラー、アプリ内ストーリーシーケンスを制作できます。
ApiPass アカウントを作成し、ダッシュボードから API キーを生成すると、動画、キャラクター、音声を含む Gemini Omni ファミリー全体を、他のモデルカタログと併せて利用できるようになります。
シーンのプロンプトを作成し、必要に応じて参照素材を用意します。画像、短いソース動画、再利用可能なキャラクターリソース、Gemini Omni Audio の音声プロファイルを揃えることで、モデルがアイデンティティ、トーン、スタイルの一貫性を保つために必要な情報を得られます。
プロンプトと選択した入力を使って Gemini Omni Video を呼び出し、生成されたクリップを確認し、シーン、動き、話し方がクリエイティブの方向性に合うまで会話型編集で調整します。
すべてのAPIはBearer Tokenによる認証が必要です。
Authorization: Bearer
新しい Nano Banana 2 の画像生成または編集タスクを送信します
この API は、次の構造の JSON ペイロードを受け付けます:
1{
2 "model": "string",
3 "callBackUrl": "string (optional)",
4 "channel": "auto",
5 "input": {
6 // Input parameters
7 }
8}model必要string生成に使用するモデル名
"google/nano-banana-2"
callBackUrlオプションstringタスク完了通知用のコールバック URL。省略した場合、コールバックは送信されません。
"https://your-domain.com/api/callback"
channelオプションstringchannel パラメータを使用して、APIPASS 内の対応するプロバイダーを指定できます。これらのプロバイダーは、実際の画像および動画生成タスクを処理します。APIPASS は現在、3 つのプロバイダーオプションを提供しています:
channel パラメータのデフォルト値は auto です。有効にすると、APIPASS はリアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当て、最小コストと信頼性の高いパフォーマンスのバランスを取ります。カスタムルーティング要件がない限り、デフォルト値 auto を維持してください。
利用可能なオプション:
auto
input オブジェクトには次のパラメータが含まれます:
input.prompt必要string生成したい画像のテキスト説明
最良の結果を得るには、被写体、スタイル、ライティング、構図を記述してください
"A serene alpine lake reflecting snow-capped mountains at golden hour, photorealistic"
input.image_inputオプションarray(URL)変換または参照として使用する入力画像。最大 14 枚の画像に対応しています。
受け付ける形式: image/jpeg, image/png; 最大サイズ: 画像 1 枚あたり 30MB; 最大ファイル数: 14
["https://example.com/reference.jpg"]
input.aspect_ratioオプションstring生成画像のアスペクト比。image_input が指定されている場合のデフォルトは match_input_image、それ以外の場合は 1:1 です。
利用可能なオプション:
"16:9"
input.resolutionオプションstring生成画像の解像度。解像度が高いほど詳細になりますが、生成に時間がかかります。デフォルト: 1K。
利用可能なオプション:
"1K"
input.output_formatオプションstring出力画像の形式。デフォルト: jpg。
利用可能なオプション:
"jpg"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "google/nano-banana-2",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "prompt": "A serene alpine lake reflecting snow-capped mountains at golden hour, photorealistic",
9 "aspect_ratio": "16:9",
10 "resolution": "1K",
11 "google_search": false,
12 "image_search": false,
13 "output_format": "jpg"
14 }
15 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}codeステータスコード。200 は成功、その他は失敗を示します
messageレスポンスメッセージ。失敗時はエラーの説明が含まれます
data.taskIdタスクのステータスと結果を照会するためのタスク ID

ByteDance
ByteDance
開始価格
0 クレジット
ByteDance
ByteDance
開始価格
0 クレジット
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
開始価格
0 クレジット
MiniMax
MiniMax
開始価格
0 クレジット
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
開始価格
0 クレジット
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
開始価格
0 クレジット
wan
wan
開始価格
0 クレジット
Runway
Runway
開始価格
0 クレジット
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
開始価格
0 クレジット
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
開始価格
0 クレジット
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
開始価格
0 クレジット
Luma
Luma
開始価格
0 クレジット
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
開始価格
0 クレジット
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
開始価格
0 クレジット
grok
grok
開始価格
0 クレジット
kling
kling
開始価格
0 クレジット