Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
まだ動画はありません。フォームを送信して動画を生成してください。
さまざまなユースケースとパラメータ設定を確認できます
透明な価格設定、隠れた手数料なし。使用量に応じてお支払い。
| ルールとモダリティ | Channel | クレジット | 価格(USD) | 公式/参考価格 | 1日の節約額 |
|---|---|---|---|---|---|
veo-3-1-lite--text-to-video-4K videoGoogleresolution: 4k | Starter | 5per run | $0.023 | - | - |
veo-3-1-lite--image-to-video-1080p videoGoogleresolution: 1080p | Starter | 4per run | $0.018 | - | - |
veo-3-1-lite-image-to-video-720p videoGoogleresolution: 720p | Starter | 3.5per run | $0.016 | - | - |
Veo 3.1 の完全ガイド
apipass で使用される Kie.ai アダプターを通じて、テキストプロンプト、または 1〜2 枚のガイドフレームから、コスト効率の高い AI 動画を生成します。
このアダプターでは、google/veo-3-1-lite は Kie.ai のモデル名 veo3_lite にマッピングされ、軽量な動画生成ワークフローに使用されます。実装は標準的なテキストから動画への生成に加え、1 枚または 2 枚の参照画像を受け付ける最初と最後のフレームモードをサポートしつつ、より機能が充実した Veo Fast バリアントよりもリクエストの範囲を小さく保ちます。
プロンプトを使用して動画を直接生成します。これはデフォルトのモードで、参照画像は不要です。
imageUrls に 1 枚または 2 枚の画像を指定してショットをガイドします。2 枚の画像を指定した場合、アダプターはそれらを開始フレームと終了フレームとして扱い、その間の動きを生成するようプロバイダーにリクエストします。
Veo 3.1 Lite は、Google の最もコスト効率に優れた動画生成モデルとして設計されており、開発者は Veo 3.1 Fast の 50% 未満のコストで、大量の動画アプリケーションを構築できます。
非常に利用しやすい価格帯でありながら、Veo 3.1 Lite はパフォーマンスを妥協せず、Veo 3.1 Fast とまったく同じ生成速度を提供します。これにより、開発者は長い待ち時間なしで迅速に反復し、理想的な動画を作り上げることができます。
実用性とプロフェッショナルな機能のバランスを取りながら、このモデルは Text-to-Video と Image-to-Video の両方の生成を完全にサポートし、クリエイターや開発者に動的コンテンツのワークフローにおける柔軟な出発点を提供します。
多様な視聴プラットフォームやアプリケーション要件に対応するため、Veo 3.1 Lite は横向き (16:9) と縦向き (9:16) の両方のアスペクト比を含む柔軟なフレーミングオプションを提供し、720p および 1080p 解像度の鮮明な動画を出力します。
開発者は動画の長さを 4 秒、6 秒、または 8 秒に正確にカスタマイズできるため、アプリケーションの具体的なニーズに応じて生成コストをスムーズに調整できます。
この統合フローは、KieAdapter に実装されている非同期動作を反映しています。
モデルとして google/veo-3-1-lite を選択し、プロンプトに加えて、必要に応じて generationType、imageUrls、aspect_ratio、seeds、enableTranslation、watermark などの Veo 固有の任意パラメータを含むペイロードを作成します。
リクエストを Veo 生成エンドポイントに送信します。アダプターは callBackUrl を自動的に挿入し、上流プロバイダーがタスクを受け付けると taskId を返します。
query API または独自のコールバックエンドポイントを通じて、タスクを非同期に追跡します。アダプターは queuing、processing、success、fail などの上流ステータスを、プラットフォームのタスクステータスにマッピングします。
成功後、タスク結果オブジェクトから resultUrls を利用します。完了したジョブについては、アダプターが上流の出力ファイルを設定済みの CDN にアップロードし、利用可能な場合は CDN ベースの URL を返します。
これらの提案は、現在アダプターに実装されているパラメータと検証ルールに基づいています。
プロンプトのみがある場合は TEXT_2_VIDEO を使用します。1 枚または 2 枚のガイド画像を提供する場合にのみ、FIRST_AND_LAST_FRAMES_2_VIDEO に切り替えてください。
16:9、9:16、または Auto のみを使用してください。それ以外の値はアダプターによって 16:9 に書き換えられるため、サポートされていない比率を指定しても追加の制御はできません。
フレームガイド生成では、視覚的な連続性が明確な画像を選択してください。1 枚の画像は視覚的なアンカーとして機能し、2 枚の画像は動きのもっともらしい開始状態と終了状態を定義する必要があります。
Veo 3.1 Lite は、より高価な動画モデルへ移行する前に、プロンプトのアイデア、ラフなストーリー展開、素早いクリエイティブドラフトを検証するのに適しています。
組み込みの 9:16 アスペクト比オプションにより、このモデルはモバイルファーストのショートフォームコンセプト、製品ティーザー、クリエイターコンテンツのモックアップに実用的です。
FIRST_AND_LAST_FRAMES_2_VIDEO モードは、完全なアニメーションパイプラインを構築せずに、ストーリーボードのフレーム間や主要なビジュアルビート間の遷移をテストするために使用できます。
このドキュメントでは外部向けに google/veo-3-1-lite を使用し、リクエスト例では veo3_lite を使用しています。これは _get_kie_api_model_name によって実装されている正確なマッピングであるためです。
check_params がそのモードを veo3_fast に明示的に制限しているため、REFERENCE_2_VIDEO は選択可能なモードから意図的に省略されています。
create-task API セクションでは ApiPass のリクエスト形状を説明しており、model はトップレベルに置かれ、Veo パラメータは input の下にネストされます。
すべてのAPIはBearer Tokenによる認証が必要です。
Authorization: Bearer
新しい Veo 3.1 Lite 動画生成タスクを作成します
Veo エンドポイントは標準の ApiPass リクエストエンベロープを使用します。model はトップレベルに保持し、Veo の生成パラメータは input の下に配置してください。
1{
2 "model": "google/veo-3-1-lite",
3 "callBackUrl": "string (optional)",
4 "input": {
5 "prompt": "string",
6 "imageUrls": [
7 "string"
8 ],
9 "generationType": "TEXT_2_VIDEO | FIRST_AND_LAST_FRAMES_2_VIDEO",
10 "aspect_ratio": "16:9 | 9:16 | Auto",
11 "seeds": 12345,
12 "enableTranslation": true,
13 "watermark": true
14 },
15 "channel": "auto"
16}model必要stringVeo 3.1 Lite 用の ApiPass モデル識別子。
"google/veo-3-1-lite"
callBackUrlオプションstringタスク完了通知用の任意のコールバック URL。
"https://your-domain.com/api/callback"
input必要objectVeo 生成パラメータのコンテナ。
{"prompt":"A simple white coffee cup on a wooden table, steam rising"}channelオプションstringchannel パラメータを使用して、APIPASS 内の対応するプロバイダーを指定できます。これらのプロバイダーが実際の画像および動画生成タスクを処理します。APIPASS は現在、3 つのプロバイダーオプションを提供しています:
channel パラメータのデフォルト値は auto です。有効な場合、APIPASS はリアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当て、最小コストと信頼性の高いパフォーマンスのバランスを取ります。カスタムルーティング要件がない限り、デフォルトの auto 値を保持してください。
利用可能なオプション:
auto
Veo 生成パラメータにはこのオブジェクトを使用します。プロンプトおよび Veo 固有のすべてのオプションは input 内で送信する必要があります。
prompt必要string生成プロンプト。
"A simple white coffee cup on a wooden table, steam rising."
imageUrlsオプションarray(URL)フレームガイド生成用の参照画像。generationType が FIRST_AND_LAST_FRAMES_2_VIDEO の場合は必須です。アダプターのドキュメントでは 1 枚または 2 枚の画像がサポートされています。
["https://example.com/frame-1.png", "https://example.com/frame-2.png"]
generationTypeオプションstring生成モード。このドキュメントでは、Lite は TEXT_2_VIDEO と FIRST_AND_LAST_FRAMES_2_VIDEO をサポートしています。
利用可能なオプション:
"TEXT_2_VIDEO"
aspect_ratioオプションstring出力アスペクト比。アダプターのデフォルトは 16:9 です。
利用可能なオプション:
"16:9"
seedsオプションnumberアダプターによって直接転送される任意のシード値。
12345
enableTranslationオプションbooleanプロンプトの自動翻訳フラグ。省略した場合のデフォルトは true です。
true
watermarkオプションboolean任意のウォーターマークフラグ。true の場合にのみ上流へ送信されます。
true
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "google/veo-3-1-lite",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "seeds": 12345,
9 "prompt": "A simple white coffee cup on a wooden table, steam rising",
10 "imageUrls": [],
11 "watermark": false,
12 "aspect_ratio": "16:9",
13 "generationType": "TEXT_2_VIDEO",
14 "enableTranslation": true
15 }
16 }'1{
2 "code": 200,
3 "msg": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}codeステータスコード。200 はタスクが正常に作成されたことを示します。
msgプロバイダーからのレスポンスメッセージ。
data.taskId後続のステータス確認に使用するタスク識別子。

ByteDance
ByteDance
開始価格
0 クレジット
ByteDance
ByteDance
開始価格
0 クレジット
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
開始価格
0 クレジット
MiniMax
MiniMax
開始価格
0 クレジット
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
開始価格
0 クレジット
wan
wan
開始価格
0 クレジット
Runway
Runway
開始価格
0 クレジット
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
開始価格
0 クレジット
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
開始価格
0 クレジット
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
開始価格
0 クレジット
Luma
Luma
開始価格
0 クレジット
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
開始価格
0 クレジット
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
開始価格
0 クレジット
開始価格
0 クレジット
grok
grok
開始価格
0 クレジット
kling
kling
開始価格
0 クレジット