아직 동영상이 없습니다. 폼을 제출해 동영상을 생성하세요.
다양한 사용 사례와 매개변수 구성을 살펴보세요
숨겨진 수수료 없이 투명한 가격. 사용량에 따라 지불합니다.
| 규칙 및 양식 | Channel | 크레딧 | 가격 (USD) | 공식/참고 가격 | 일일 절감액 |
|---|---|---|---|---|---|
with-video-720p videoGoogleresolution: 720p | Regular | 268per run | $1.218 | - | - |
with-video-1080p videoGoogleresolution: 1080p | Regular | 270per run | $1.227 | - | - |
with-video-4k videoGoogleresolution: 4k | Regular | 400per run | $1.818 | - | - |
no-video-720p-4s videoGoogleduration: 4, resolution: 720p | Regular | 102per run | $0.464 | - | - |
no-video-720p-6s videoGoogleduration: 6, resolution: 720p | Regular | 135per run | $0.614 | - | - |
no-video-720p-8s videoGoogleduration: 8, resolution: 720p | Regular | 168per run | $0.764 | - | - |
no-video-720p-10s videoGoogleduration: 10, resolution: 720p | Regular | 200per run | $0.909 | - | - |
no-video-1080p-4s videoGoogleduration: 4, resolution: 1080p | Regular | 103per run | $0.468 | - | - |
no-video-1080p-6s videoGoogleduration: 6, resolution: 1080p | Regular | 136per run | $0.618 | - | - |
no-video-1080p-8s videoGoogleduration: 4, resolution: 1080p | Regular | 168per run | $0.764 | - | - |
no-video-1080p-10s videoGoogleduration: 10, resolution: 1080p | Regular | 202per run | $0.918 | - | - |
no-video-4k-4s videoGoogleduration: 4, resolution: 4k | Regular | 233per run | $1.059 | - | - |
no-video-4k-6s videoGoogleduration: 6, resolution: 4k | Regular | 268per run | $1.218 | - | - |
no-video-4k-8s videoGoogleduration: 8, resolution: 4k | Regular | 300per run | $1.364 | - | - |
no-video-4k-10s videoGoogleduration: 10, resolution: 4k | Regular | 335per run | $1.523 | - | - |
Gemini Omni 사용 전체 가이드
Google의 Gemini Omni 모델로 영화 같은 물리 인식 AI 동영상을 생성하세요. 재사용 가능한 캐릭터와 음성을 결합해 단일 ApiPass 엔드포인트로 이용할 수 있습니다.

ApiPass의 Gemini Omni Video API는 고속 동영상 생성, 편집, 시네마틱 제어를 위해 설계된 고성능 멀티모달 모델인 Google의 Gemini Omni Flash의 동영상 생성 인터페이스입니다. ApiPass는 텍스트-투-비디오를 독립적인 호출로 실행하는 대신, Omni 제품군의 구성 레이어로 Gemini Omni Video를 제공합니다. ApiPass에서 이미 생성한 재사용 가능한 캐릭터 리소스와 음성 프로필을 전달하면, 시각 요소와 오디오가 동기화된 완성형 동영상을 받을 수 있습니다. Gemini Omni는 텍스트, 이미지, 오디오, 동영상을 동시에 처리하여 더 응집력 있고 일관적이며 제어 가능한 출력을 제공하며, ApiPass는 이러한 기능을 나머지 모델 카탈로그와 함께 하나의 API key 뒤에 통합해 제공합니다.
별도 계정, preview access, 클라우드 설정을 관리할 필요 없이, ApiPass는 나머지 모델 카탈로그에 이미 사용하는 동일한 API key로 Gemini Omni Video를 제공합니다.
Gemini Omni Video는 단일 프롬프트에서 텍스트, 이미지, 동영상, 오디오의 어떤 조합이든 받아들여, 빈 텍스트 프롬프트가 아니라 실제 창작 자료를 기반으로 생성을 시작할 수 있게 합니다.
현실 세계의 물리 모델에 기반하여, API는 믿을 수 있는 반사, 중력, 조명, 날씨를 렌더링합니다. 따라서 동적인 장면에서도 장면이 아티팩트로 흐트러지지 않고 시각적으로 자연스럽게 유지됩니다.
여러 참조 이미지와 짧은 동영상 클립으로 생성을 안내할 수 있으며, 모델은 피사체, 스타일, 장면을 일관되게 유지해 편집과 샷 전반에서 정체성을 안정적으로 보존합니다.
대화형 편집을 통해 자연어로 동영상을 반복적으로 다듬고 편집할 수 있으므로, 전체 프롬프트를 처음부터 다시 만들지 않고도 장면을 재작업할 수 있습니다.
Gemini Omni는 폭넓은 세계 지식과 강력한 동영상 기능을 결합합니다. 문화적 맥락, 역사적 배경, 과학적 정확성을 이해해 단순히 보기 좋은 것을 넘어 의미가 통하는 동영상을 생성하며, 특정 시대, 장소, 개념처럼 사실적 일관성이 필요한 요소를 프롬프트가 참조할 때 유용합니다.
Gemini Omni API는 자연어 동영상 편집을 지원하여, 사용자가 매번 전체 프롬프트를 다시 작성하는 대신 장면을 단계별로 다듬을 수 있게 합니다. 사용자는 원본 장면의 일관성을 유지하면서 환경을 바꾸고, 동작을 조정하고, 객체를 교체하고, 카메라 각도를 변경하거나 시각 효과를 추가할 수 있습니다. 이는 AI 동영상 편집기, 크리에이터 도구, 기존 영상을 더 직관적으로 변환해야 하는 애플리케이션에 유용합니다.
Gemini Omni Video는 시각적 창작을 물리, 역사, 생물학, 문화, 서사 논리에 대한 지식과 연결합니다. 이를 통해 생성된 동영상이 덜 무작위적이고 더 의도적으로 느껴지도록 하며, 설명 영상, 시네마틱 스토리텔링, 제품 콘셉트, 교육 콘텐츠에 가치가 있습니다.
텍스트는 방향을 정의하고, 이미지는 피사체나 스타일을 안내하며, 동영상은 움직임과 장면 맥락을 제공하고, 오디오 또는 캐릭터 리소스는 음성 기반 또는 정체성 인식 워크플로를 지원할 수 있습니다. 이를 통해 개발자는 빈 프롬프트만이 아니라 실제 창작 자료에서 시작하는 동영상 도구를 구축할 수 있습니다.
Gemini Omni Video는 캐릭터의 존재감, 표정, 전달 방식, 환경이 서로 연결되어 느껴져야 하는 아바타 스타일 시나리오를 지원할 수 있습니다. 프레젠터 클립, 캐릭터 중심 콘텐츠, 인터랙티브 미디어, 미래 지향적인 창작 동영상 제품에 유용합니다.
프롬프트와 단일 참조 이미지로 생성되는 세로형 클립으로, 모든 에피소드에서 반복적으로 등장하는 주인공을 유지합니다.
하나의 브랜드 일관성 있는 대변인과 음성을 공유하면서도 제품, 메시지 또는 시장을 바꿀 수 있는 현지화된 광고 변형입니다.
시각적 품질만큼 사실적 일관성이 중요한 교육 콘텐츠, 역사적으로 정확한 장면, 지식 기반 스토리텔링입니다.
음성 전달이 최종 결과를 이끄는 음성 기반 아바타 스타일 워크플로입니다. 프레젠터 동영상, 캐릭터 대화, 내레이션 장면, 음성, 표정, 화면 속 동작이 서로 연결되어 느껴져야 하는 생성 클립에 유용합니다.
공식 Gemini Omni 액세스는 현재 preview 트랙과 여러 콘솔 및 엔터프라이즈 인터페이스로 나뉘어 있습니다. ApiPass는 이를 나머지 모델 스택과 함께 단일 API key 뒤에 통합하므로, 새로운 제공업체 온보딩이 아니라 base-URL과 key 변경만으로 통합할 수 있습니다.
공식 API는 각 생성을 독립적인 요청으로 취급합니다. ApiPass에서 Gemini Omni Video는 Gemini Omni Character 및 Gemini Omni Audio 기능을 통해 플랫폼에서 이미 구축한 캐릭터와 음성 리소스를 활용하도록 설계되었습니다. 따라서 정체성과 음성 라이브러리를 유지하고 이후의 어떤 동영상 작업에도 연결할 수 있습니다.
반복적으로 등장하는 주인공, 내레이터, 시각 스타일이 필요한 에피소드형 숏폼 동영상을 제작합니다.
시장과 크리에이티브 조합 전반에서 브랜드 일관성을 유지하는 현지화·개인화 광고 변형을 출시합니다.
강의 스크립트와 수업 계획을 역사적 또는 과학적으로 근거 있는 장면을 갖춘 내레이션 기반 캐릭터 중심 교육 동영상으로 전환합니다.
동일한 캐릭터가 여러 샷과 반복 작업 전반에서 안정적으로 등장하는 시네마틱, 트레일러, 앱 내 스토리 시퀀스를 제작합니다.
ApiPass 계정을 만들고 대시보드에서 API key를 생성하여, 나머지 모델 카탈로그와 함께 동영상, 캐릭터, 오디오를 포함한 전체 Gemini Omni 제품군을 사용할 수 있습니다.
장면 프롬프트를 작성하고, 선택적으로 참조 자료를 모으세요. 이미지, 짧은 소스 동영상, 재사용 가능한 캐릭터 리소스, Gemini Omni Audio의 음성 프로필을 준비하면 모델이 정체성, 톤, 스타일을 일관되게 유지하는 데 필요한 모든 정보를 갖추게 됩니다.
프롬프트와 선택한 입력으로 Gemini Omni Video를 호출하고, 생성된 클립을 검토한 뒤, 장면, 움직임, 전달 방식이 창작 방향과 일치할 때까지 대화형 편집으로 다듬으세요.
모든 API는 Bearer Token을 통한 인증이 필요합니다.
Authorization: Bearer
새 Nano Banana 2 이미지 생성 또는 편집 작업을 제출합니다
API는 다음 구조의 JSON 페이로드를 받습니다:
1{
2 "model": "string",
3 "callBackUrl": "string (optional)",
4 "channel": "auto",
5 "input": {
6 // Input parameters
7 }
8}model필수string생성에 사용할 모델 이름입니다
"google/nano-banana-2"
callBackUrl선택적string작업 완료 알림을 받을 콜백 URL입니다. 생략하면 콜백이 전송되지 않습니다.
"https://your-domain.com/api/callback"
channel선택적stringchannel 파라미터를 통해 APIPASS 내 해당 제공업체를 지정할 수 있습니다. 이러한 제공업체는 실제 이미지 및 동영상 생성 작업을 처리합니다. APIPASS는 현재 세 가지 제공업체 옵션을 제공합니다:
channel 파라미터의 기본값은 auto입니다. 활성화하면 APIPASS가 실시간 가격 및 안정성 지표를 기반으로 사용 가능한 제공업체에 작업을 자동으로 배분하여 최소 비용과 안정적인 성능의 균형을 맞춥니다. 맞춤 라우팅 요구사항이 없다면 기본값 auto를 유지하세요.
사용 가능한 옵션:
auto
input 객체에는 다음 파라미터가 포함됩니다:
input.prompt필수string생성하려는 이미지에 대한 텍스트 설명입니다
최상의 결과를 위해 주제, 스타일, 조명, 구도를 설명하세요
"A serene alpine lake reflecting snow-capped mountains at golden hour, photorealistic"
input.image_input선택적array(URL)변환하거나 참조로 사용할 입력 이미지입니다. 최대 14개의 이미지를 지원합니다.
허용되는 유형: image/jpeg, image/png; 최대 크기: 이미지당 30MB; 최대 파일 수: 14
["https://example.com/reference.jpg"]
input.aspect_ratio선택적string생성된 이미지의 화면 비율입니다. image_input이 제공되면 기본값은 match_input_image이고, 그렇지 않으면 1:1입니다.
사용 가능한 옵션:
"16:9"
input.resolution선택적string생성된 이미지의 해상도입니다. 해상도가 높을수록 더 많은 디테일이 생성되지만 생성 시간이 더 오래 걸립니다. 기본값: 1K.
사용 가능한 옵션:
"1K"
input.output_format선택적string출력 이미지의 형식입니다. 기본값: jpg.
사용 가능한 옵션:
"jpg"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "google/nano-banana-2",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "prompt": "A serene alpine lake reflecting snow-capped mountains at golden hour, photorealistic",
9 "aspect_ratio": "16:9",
10 "resolution": "1K",
11 "google_search": false,
12 "image_search": false,
13 "output_format": "jpg"
14 }
15 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}code상태 코드입니다. 200은 성공을, 그 외 값은 실패를 의미합니다
message응답 메시지입니다. 실패 시 오류 설명이 포함됩니다
data.taskId작업 상태와 결과를 조회하는 데 사용하는 작업 ID입니다

ByteDance
ByteDance
시작가
0 크레딧
ByteDance
ByteDance
시작가
0 크레딧
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
시작가
0 크레딧
MiniMax
MiniMax
시작가
0 크레딧
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
시작가
0 크레딧
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
시작가
0 크레딧
wan
wan
시작가
0 크레딧
Runway
Runway
시작가
0 크레딧
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
시작가
0 크레딧
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
시작가
0 크레딧
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
시작가
0 크레딧
Luma
Luma
시작가
0 크레딧
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
시작가
0 크레딧
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
시작가
0 크레딧
grok
grok
시작가
0 크레딧
kling
kling
시작가
0 크레딧