Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
还没有视频。提交表单以生成视频。
探索不同用例和参数配置
透明定价,无隐藏费用。按需支付。
| 规则与模式 | 渠道 | 积分 | 价格(美元) | 官方/参考价格 | 每日节省 |
|---|---|---|---|---|---|
veo-3-1-lite--text-to-video-4K videoGoogleresolution: 4k | Starter | 5per run | $0.023 | - | - |
veo-3-1-lite--image-to-video-1080p videoGoogleresolution: 1080p | Starter | 4per run | $0.018 | - | - |
veo-3-1-lite-image-to-video-720p videoGoogleresolution: 720p | Starter | 3.5per run | $0.016 | - | - |
Veo 3.1 使用完整指南
通过 apipass 使用的 Kie.ai 适配器,基于文本提示词,或一到两张引导帧,生成经济高效的 AI 视频。
在此适配器中,google/veo-3-1-lite 映射到 Kie.ai 模型名称 veo3_lite,用于轻量级视频生成工作流。该实现支持标准的文本生成视频,以及可接受一张或两张参考图的首尾帧模式,同时相比功能更完整的 Veo Fast 变体,保持更精简的请求接口。
使用提示词直接生成视频。这是默认模式,不需要任何参考图像。
在 imageUrls 中提供一张或两张图像来引导镜头。提供两张图像时,适配器会将它们视为开场帧和结尾帧,并要求提供方生成两者之间的运动过程。
Veo 3.1 Lite 被设计为 Google 最具成本效益的视频生成模型,帮助开发者以不到 Veo 3.1 Fast 50% 的成本构建高吞吐量视频应用。
尽管价格极具可及性,Veo 3.1 Lite 并未牺牲性能,提供与 Veo 3.1 Fast 完全相同的生成速度,让开发者无需长时间等待即可快速迭代并打造理想视频。
该模型兼顾实用性与专业能力,完整支持 Text-to-Video 和 Image-to-Video 生成,为创作者和开发者的动态内容工作流提供灵活的起点。
为适配多样化观看平台和应用需求,Veo 3.1 Lite 提供灵活的画幅选项,包括横屏 (16:9) 和竖屏 (9:16) 宽高比,并可输出清晰的 720p 和 1080p 分辨率视频。
开发者可以精确控制内容时长,将视频时长自定义为 4 秒、6 秒或 8 秒,确保生成成本能够根据应用的具体需求灵活调整。
该集成流程与 KieAdapter 中实现的异步行为保持一致。
选择 google/veo-3-1-lite 作为模型,并构建包含 prompt 以及所需可选 Veo 专属参数的 payload,例如 generationType、imageUrls、aspect_ratio、seeds、enableTranslation 和 watermark。
将请求发送到 Veo 生成端点。适配器会自动注入 callBackUrl,并在上游提供方接受任务后返回 taskId。
通过查询 API 或你的回调端点异步跟踪任务。适配器会将上游状态(如 queuing、processing、success 和 fail)映射为平台任务状态。
成功后,从任务结果对象中使用 resultUrls。对于已完成的任务,适配器会尝试将上游输出文件上传到配置的 CDN,并在可用时返回由 CDN 托管的 URL。
这些建议源自适配器当前实现的参数和校验规则。
当你只有 prompt 时,使用 TEXT_2_VIDEO。仅当你提供一张或两张引导图像时,才切换到 FIRST_AND_LAST_FRAMES_2_VIDEO。
请使用 16:9、9:16 或 Auto。任何其他值都会被适配器重写为 16:9,因此不受支持的比例不会提供额外控制能力。
对于帧引导生成,请选择具有清晰视觉连续性的图像。一张图像可作为视觉锚点,两张图像则应为运动定义一个合理的起始和结束状态。
Veo 3.1 Lite 适合在切换到更昂贵的视频模型之前,用于验证提示词想法、粗略故事节奏和快速创意草稿。
内置的 9:16 宽高比选项让该模型适用于移动优先的短视频概念、产品预热视频和创作者内容样片。
FIRST_AND_LAST_FRAMES_2_VIDEO 模式可用于测试分镜帧或关键视觉节点之间的过渡,而无需构建完整的动画流水线。
文档在外部使用 google/veo-3-1-lite,并在请求示例中使用 veo3_lite,因为这正是 _get_kie_api_model_name 实现的精确映射。
REFERENCE_2_VIDEO 被有意从可选模式中省略,因为 check_params 明确将该模式限制为仅适用于 veo3_fast。
create-task API 部分记录了 ApiPass 请求结构,其中 model 保持在顶层,而 Veo 参数嵌套在 input 下。
所有 API 都需要通过 Bearer Token 进行身份验证。
Authorization: Bearer
创建新的 Veo 3.1 Lite 视频生成任务
Veo 端点使用标准 ApiPass 请求封装。请将 model 保持在顶层,并将 Veo 生成参数放在 input 下。
1{
2 "model": "google/veo-3-1-lite",
3 "callBackUrl": "string (optional)",
4 "input": {
5 "prompt": "string",
6 "imageUrls": [
7 "string"
8 ],
9 "generationType": "TEXT_2_VIDEO | FIRST_AND_LAST_FRAMES_2_VIDEO",
10 "aspect_ratio": "16:9 | 9:16 | Auto",
11 "seeds": 12345,
12 "enableTranslation": true,
13 "watermark": true
14 },
15 "channel": "auto"
16}model必填stringVeo 3.1 Lite 的 ApiPass 模型标识符。
"google/veo-3-1-lite"
callBackUrl可选string可选的任务完成通知回调 URL。
"https://your-domain.com/api/callback"
input必填objectVeo 生成参数的容器。
{"prompt":"A simple white coffee cup on a wooden table, steam rising"}channel可选string你可以通过 channel 参数指定 APIPASS 内对应的提供方;这些提供方负责实际的图像和视频生成任务。APIPASS 目前提供三种提供方选项:
channel 参数的默认值为 auto。启用后,APIPASS 会根据实时价格和稳定性指标,在可用提供方之间自动分配任务,以平衡最低成本和可靠性能。除非你有自定义路由需求,否则请保留默认值 auto。
可用选项:
auto
使用此对象传入 Veo 生成参数。提示词和所有 Veo 专用选项都必须发送到 input 内。
prompt必填string生成提示词。
"A simple white coffee cup on a wooden table, steam rising."
imageUrls可选array(URL)用于帧引导生成的参考图像。当 generationType 为 FIRST_AND_LAST_FRAMES_2_VIDEO 时必填。根据适配器文档,支持一张或两张图像。
["https://example.com/frame-1.png", "https://example.com/frame-2.png"]
generationType可选string生成模式。本文档中 Lite 支持 TEXT_2_VIDEO 和 FIRST_AND_LAST_FRAMES_2_VIDEO。
可用选项:
"TEXT_2_VIDEO"
aspect_ratio可选string输出宽高比。适配器默认值为 16:9。
可用选项:
"16:9"
seeds可选number可选的种子值,由适配器直接转发。
12345
enableTranslation可选boolean自动提示词翻译标志。省略时默认为 true。
true
watermark可选boolean可选的水印标志。仅在为 true 时发送到上游。
true
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "google/veo-3-1-lite",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "seeds": 12345,
9 "prompt": "A simple white coffee cup on a wooden table, steam rising",
10 "imageUrls": [],
11 "watermark": false,
12 "aspect_ratio": "16:9",
13 "generationType": "TEXT_2_VIDEO",
14 "enableTranslation": true
15 }
16 }'1{
2 "code": 200,
3 "msg": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}code状态码。200 表示任务已成功创建。
msg提供方返回的响应消息。
data.taskId用于后续状态查询的任务标识符。

ByteDance
ByteDance
起价
0 积分
ByteDance
ByteDance
起价
0 积分
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
起价
0 积分
MiniMax
MiniMax
起价
0 积分
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
起价
0 积分
wan
wan
起价
0 积分
Runway
Runway
起价
0 积分
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
起价
0 积分
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
起价
0 积分
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
起价
0 积分
Luma
Luma
起价
0 积分
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
起价
0 积分
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
起价
0 积分
起价
0 积分
grok
grok
起价
0 积分
kling
kling
起价
0 积分