还没有视频。提交表单以生成视频。
探索不同用例和参数配置
透明定价,无隐藏费用。按需支付。
| 规则与模式 | 渠道 | 积分 | 价格(美元) | 官方/参考价格 | 每日节省 |
|---|---|---|---|---|---|
wan 2.6,video to video,10s-1080p videowanduration: 10, resolution: 1080p, nsfw_checker: false | Starter | 5per run | $0.023 | - | - |
wan 2.6,video to video,10s-720p videowanduration: 10, resolution: 720p, nsfw_checker: false | Starter | 5per run | $0.023 | - | - |
wan 2.6,video to video,15s-1080p videowanduration: 15, resolution: 1080p, nsfw_checker: false | Starter | 5per run | $0.023 | - | - |
wan 2.6,video to video,15s-720p videowanduration: 15, resolution: 720p, nsfw_checker: false | Starter | 5per run | $0.023 | - | - |
wan 2.6,video to video,5s-1080p videowanduration: 5, resolution: 1080p, nsfw_checker: false | Starter | 5per run | $0.023 | - | - |
wan 2.6,video to video,5s-720p videowanduration: 5, resolution: 720p, nsfw_checker: false | Starter | 5per run | $0.023 | - | - |
wan 2.6 video to video 使用完整指南
使用上传的参考视频来引导生成新的场景。
Wan 2.6 由 Alibaba 生态系统开发,是一款前沿的 AI 视频生成模型,旨在将简单提示词和参考媒体转化为连贯的多镜头故事。通过 APIPASS 无缝接入的 Wan 2.6 Video-to-Video(Reference-to-Video)API,使开发者能够使用上传的参考片段来引导全新场景的创作。该 API 会智能提取核心视觉和听觉元素,例如主体外观、整体风格和声音,并将其一致地应用到新生成的内容中。你可以输出最长 15 秒的高清 1080p 电影级视频,并包含原生音频和精准唇形同步,是面向应用的理想商业级解决方案。
提供提示词以及一个或多个源视频,将原始素材转换为新的动作、风格或场景演绎,同时保留底层时间节奏和结构。
上游 API 每次请求最多支持 3 个视频 URL。适配器可直接接收 video_urls,并会将 video 和 video_url 别名规范化到同一字段中。
Wan 2.6 video-to-video 目前仅支持 5 秒和 10 秒输出。适配器会将不支持的取值规范化回 5 秒。
利用我们先进的叙事引擎生成 1080p 视频,呈现流畅的场景转场、均衡的节奏和自然的镜头运动。通过 Wan 2.6 API,你可以轻松将分镜脚本式提示词转化为完整连贯的视觉叙事。
构建具备完美连续性的角色驱动故事。Wan 2.6 Video to Video API 可让你从参考片段中提取精准的外观、动作风格和声音特征,确保所有生成场景中的身份保持稳定一致。
通过最长 15 秒的视频输出延展你的创意叙事。Wan 2.6 Video to Video API 可确保生成内容保持出色的逐帧一致性,让光照、环境元素和角色服装等复杂细节在运动中依然稳定。
将平移、变焦和跟拍等动态镜头动作与完整集成的原生音频相结合,交付可直接发布的高保真内容。Wan 2.6 Video to Video API 可在单一工作流中无缝生成同步的背景音乐、环境音效和精准唇形同步对白。
该集成流程遵循其他由 Kie 支持的模型所使用的相同异步 jobs API。
选择 wan/wan-2-6-video-to-video 作为模型,并准备包含 prompt、video_urls 以及 duration、resolution、nsfw_checker 等可选控制项的 input 对象。
将 payload 发送到 ApiPass /api/v1/jobs/createTask 端点。适配器会将公开模型名称映射到上游 Kie.ai 标识符,并在请求被接受时返回 taskId。
通过查询端点或你的 callback URL 跟踪任务。适配器会将上游任务状态映射为 ApiPass 状态,例如 queuing、generating、success 和 fail。
任务成功后,从任务结果对象中读取 resultUrls。对于已完成的任务,当上传步骤成功时,适配器会尝试返回由 CDN 支持的 URL。
这些建议基于适配器实现的请求约束以及提供方文档。
描述源视频中应该改变的内容,而不是抽象地重写整个场景。Wan 2.6 会保留源视频的时间节奏和结构,因此精准的动作与风格指令通常效果更好。
Kie.ai 文档说明支持 MP4、QuickTime 和 Matroska,每个文件最大 10MB,且最多 3 个视频 URL。遵守这些限制可避免上游校验失败。
使用 5 秒可更快迭代;仅在动作需要更多时间才能清晰呈现时使用 10 秒。低成本实验建议选择 720p,最终清晰度很重要时选择 1080p。
在保持原始运动节奏的同时,将现有片段转换为新的视觉氛围、服装变化、舞蹈变体或广告风格剪辑。
在多个提示词变体中复用同一个基础视频,以一致的运动布局测试不同主题、产品角度或风格方向。
团队可以在投入更高成本的手动剪辑或更大型视频流水线之前,基于现有片段快速探索动作、舞蹈和造型变化。
本文档使用 wan/wan-2-6-video-to-video 作为公开的 ApiPass 模型名称,因为这是你更新后 SUPPORT_MODEL 中的当前值。
readme 和 API 部分说明 ApiPass 会将公开模型转发到上游 Kie.ai 标识符 wan/2-6-video-to-video,与适配器映射逻辑一致。
create-task API 部分记录了公开 ApiPass payload 结构,即 model 加可选的 callBackUrl 和 input。这与适配器在将请求发送到上游之前接收的结构相同。
所有 API 都需要通过 Bearer Token 进行身份验证。
Authorization: Bearer
通过 ApiPass 统一 jobs API 创建新的 Wan 2.6 视频到视频任务
ApiPass 在各类异步视频模型之间保持公开请求封装稳定。Wan 专属参数放在 input 对象中。
1{
2 "model": "wan/wan-2-6-video-to-video",
3 "callBackUrl": "string (optional)",
4 "input": {
5 "prompt": "string",
6 "video_urls": [
7 "string"
8 ],
9 "duration": "5 | 10",
10 "resolution": "720p | 1080p",
11 "nsfw_checker": false
12 },
13 "channel": "auto"
14}model必填stringWan 2.6 视频到视频的公开 ApiPass 模型名称。
"wan/wan-2-6-video-to-video"
callBackUrl可选string用于任务完成通知的可选回调 URL。
"https://your-domain.com/api/callback"
channel可选string你可以通过 channel 参数指定 APIPASS 内对应的提供商;这些提供商负责实际的图像和视频生成任务。APIPASS 目前提供三种提供商选项:
channel 参数的默认值为 auto。启用后,APIPASS 会根据实时价格和稳定性指标,在可用提供商之间自动分配任务,以平衡最低成本和可靠性能。除非你有自定义路由需求,否则请保留默认值 auto。
可用选项:
auto
input 对象包含 ApiPass 接受的 Wan 2.6 视频到视频参数。适配器会在将请求转发到上游之前,对这些参数进行重构和规范化。
input.prompt必填string用于描述应如何转换源视频的提示词。
"The video drinks milk tea while doing some improvised dance moves to the music."
input.video_urls必填array(URL)任务的源视频 URL。适配器也接受 video 和 video_url,并会将其转换为 video_urls。Kie.ai 最多支持 3 个 URL。
["https://static.aiquickdraw.com/tools/example/1765957777782_cNJpvhRx.mp4"]
input.duration可选string请求的输出时长。不支持的值会被规范化为 5 秒。
可用选项:
"5"
input.resolution可选string请求的输出分辨率。不支持的值会被规范化为 1080p。
可用选项:
"1080p"
input.nsfw_checker可选boolean可选的 NSFW 审核开关。适配器也接受 nsfwChecker,并会以 nsfw_checker 转发。
false
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "wan/wan-2-6-video-to-video",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "prompt": "The video drinks milk tea while doing some improvised dance moves to the music.",
9 "video_urls": [
10 "https://static.aiquickdraw.com/tools/example/1765957777782_cNJpvhRx.mp4"
11 ],
12 "duration": "5",
13 "resolution": "1080p",
14 "nsfw_checker": false
15 }
16 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}code状态码。200 表示任务已成功创建。
messageApiPass 返回的响应消息。
data.taskId用于后续状态查询的任务标识符。

ByteDance
ByteDance
起价
0 积分
ByteDance
ByteDance
起价
0 积分
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
起价
0 积分
MiniMax
MiniMax
起价
0 积分
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
起价
0 积分
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
起价
0 积分
wan
wan
起价
0 积分
Runway
Runway
起价
0 积分
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
起价
0 积分
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
起价
0 积分
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
起价
0 积分
Luma
Luma
起价
0 积分
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
起价
0 积分
起价
0 积分
grok
grok
起价
0 积分
kling
kling
起价
0 积分