아직 동영상이 없습니다. 폼을 제출해 동영상을 생성하세요.
다양한 사용 사례와 매개변수 구성을 살펴보세요
숨겨진 수수료 없이 투명한 가격. 사용량에 따라 지불합니다.
| 규칙 및 양식 | Channel | 크레딧 | 가격 (USD) | 공식/참고 가격 | 일일 절감액 |
|---|---|---|---|---|---|
kling-avatar-v2-pro videoKlingmode: pro | Starter | 1per second | $0.005 | - | - |
kling-avatar-v2-std videoKlingmode: std | Starter | 0.8per second | $0.004 | - | - |
kling-avatar-v2 사용 전체 가이드
Kling AI Avatar v2 API를 사용해 단일 이미지와 오디오 파일만으로 사실적인 말하는 아바타 영상을 생성하세요. 자연스러운 표정과 신체 움직임이 포함된 생생한 립싱크 애니메이션을 만들 수 있습니다.

KuaiShou가 개발한 Kling Avatar v2는 단일 참조 이미지와 오디오 파일을 기반으로 사실적인 영상 콘텐츠를 생성하는 고급 AI 기반 말하는 아바타 생성 시스템입니다. 이 시스템은 오디오를 분석하여 음성과 완벽하게 동기화되는 정확한 입 움직임, 얼굴 표정, 자연스러운 신체 제스처를 생성합니다. 이 기술을 활용하면 복잡한 모션 캡처 장비나 수작업 애니메이션 없이도 가상 대변인, 디지털 프레젠터, 애니메이션 캐릭터를 만들 수 있습니다. Kling Avatar v2 API는 이러한 기능에 대한 프로그래밍 방식의 접근을 제공하여 개발자가 말하는 아바타 생성을 애플리케이션, 플랫폼, 제작 워크플로에 통합할 수 있도록 합니다.
Kling AI Avatar v2 Standard API는 최적화된 처리 속도로 720p 해상도의 말하는 아바타 영상을 생성합니다. 자연스러운 립싱크와 신체 움직임을 제공하며, 효율성과 비용 효율성이 중요한 소셜 미디어 콘텐츠, 마케팅 자료, 대량 제작에 적합합니다.
Kling AI Avatar v2 Pro API는 향상된 시각 품질로 1080p 해상도의 말하는 아바타 영상을 생성합니다. 더 높은 해상도와 정교한 디테일이 필수적인 전문 프레젠테이션, 방송 콘텐츠, 프리미엄 제작에 이상적인 모드입니다.
Kling Avatar v2 API는 입력 오디오와 완벽하게 동기화되는 매우 정확한 입 움직임을 생성합니다. 시스템은 발화 패턴, 음소, 타이밍을 분석하여 오디오 콘텐츠와 일치하는 자연스러운 입 움직임을 만들어, 믿을 수 있는 말하는 아바타 영상을 구현합니다.
Kling AI Avatar v2 API를 사용하면 아바타가 음성 콘텐츠에 어울리는 사실적인 얼굴 표정을 보여줍니다. 시스템은 적절한 감정 표현, 눈 움직임, 미세 표정을 생성하여 아바타에 생동감을 더하고 시청자 몰입도를 높입니다.
Kling Avatar v2 API는 생성된 영상에 자연스러운 신체 움직임과 제스처를 추가합니다. 손동작, 머리 움직임, 어깨 움직임이 합성되어 말하는 동안의 실제 사람 행동을 모방하는 더 역동적이고 몰입감 있는 프레젠테이션을 만듭니다.
Kling AI Avatar v2 API는 아바타의 동작, 표정, 카메라 움직임을 안내하기 위한 선택적 텍스트 프롬프트를 지원합니다. 개발자는 원하는 행동, 감정 톤, 프레젠테이션 스타일을 지정하여 다양한 사용 사례와 대상에 맞게 결과물을 맞춤화할 수 있습니다.
Kling Avatar v2 API는 말하는 아바타 영상을 생성하기 위해 단 하나의 참조 이미지만 필요로 합니다. 시스템은 이미지에서 얼굴 특징, 외형 디테일, 신체 구조를 추출하여 생성된 영상 전체에서 일관되고 알아볼 수 있는 캐릭터를 만듭니다.
몇 가지 간단한 단계만으로 제품을 시작해 보세요...
계정을 생성하고 액세스 등록을 완료하여 Kling AI Avatar v2 API Key를 발급받으세요. 이 API 키는 Kling Avatar v2 API로 보내는 모든 요청을 인증하고 사용량을 계정과 연결합니다. 키가 발급되면 애플리케이션에서 말하는 아바타 생성 엔드포인트를 안전하게 호출하고 생성 작업을 프로그래밍 방식으로 관리할 수 있습니다.
API를 시스템에 통합하기 전에 playground를 사용하여 대화형 환경에서 Kling AI Avatar v2 API를 테스트하세요. 참조 이미지와 오디오 파일을 업로드하고, 동작 제어를 위한 선택적 프롬프트를 추가한 뒤 생성 결과를 미리 확인할 수 있습니다. 이 단계는 프로덕션으로 이동하기 전에 입력 품질을 검증하고 출력 결과를 이해하는 데 도움이 됩니다.
테스트가 끝나면 Kling Avatar v2 API를 백엔드 또는 애플리케이션 로직에 통합하세요. 참조 이미지, 오디오 파일, 프롬프트, 생성 파라미터가 API 요청을 통해 어떻게 전달될지 정의합니다. 이 통합을 통해 기존 워크플로 또는 서비스의 일부로 말하는 아바타 영상 생성을 자동화할 수 있습니다.
Kling AI Avatar v2 API를 사용하여 통합 기능을 프로덕션 환경에 배포하세요. 일반적인 배포에는 비동기 생성 작업 처리, 작업 상태 추적, 생성된 영상 출력의 저장 또는 전달이 포함됩니다. 이 단계는 말하는 아바타 생성을 실제 사용자 대상 또는 내부 프로덕션 파이프라인과 연결합니다.
배포가 완료되면 이미지 선택, 오디오 품질, 생성 모드 선택을 최적화하여 Kling AI Avatar v2 API로 말하는 아바타 영상 생성을 확장하세요. 수요가 증가하더라도 API는 대량 워크로드를 지원하므로, 팀은 안정적인 출력 품질과 예측 가능한 리소스 사용량을 유지하면서 제작 규모를 확대할 수 있습니다.
Kling AI Avatar v2 API로 안정적이고 고품질의 결과를 얻으려면 참조 이미지와 오디오 파일을 신중하게 준비하는 것이 중요합니다. 아래 가이드를 따르면 정확한 립싱크, 자연스러운 표정, 일관된 출력을 확보하는 데 도움이 됩니다.
얼굴, 머리, 어깨, 몸통이 명확하게 보이는 참조 이미지를 선택하세요. 이미지는 조명이 좋고 가림이 최소화되어야 하며, 중립적이거나 정면을 향한 자세가 좋습니다. 립싱크 정확도에 영향을 줄 수 있는 진한 메이크업, 극단적인 각도, 얼굴을 크게 가리는 요소가 있는 이미지는 피하세요.
음성이 명확하고 배경 소음이 최소화된 오디오 파일을 사용하세요. 오디오는 볼륨 수준이 일정해야 하며, 겹치는 목소리나 음악은 피하는 것이 좋습니다. 깨끗한 오디오는 시스템이 아바타 영상에서 더 정확한 입 움직임과 자연스러운 타이밍을 생성하는 데 도움이 됩니다.
선택적 prompt 파라미터를 사용하여 아바타의 행동, 표정, 카메라 움직임을 안내하세요. '전문적인 제스처를 가진 자신감 있는 발표자' 또는 '따뜻한 미소를 지닌 친근한 대변인'과 같은 설명형 프롬프트는 시스템이 더 목표에 맞고 맥락에 적합한 애니메이션을 생성하는 데 도움이 됩니다.
Kling AI Avatar v2 API를 사용하면 마케터가 말하는 대변인 영상을 대규모로 제작할 수 있습니다. 브랜드 이미지와 스크립트 오디오를 결합하여 반복적인 영상 촬영이나 출연자 조율 없이 캠페인, 제품 발표, 소셜 미디어를 위한 일관된 마케팅 콘텐츠를 만들 수 있습니다.
Kling Avatar v2 API를 사용하면 교육 콘텐츠 제작자가 정적 이미지와 내레이션 오디오를 기반으로 강사 주도형 영상을 생성할 수 있습니다. 이를 통해 여러 강의에 걸쳐 일관된 발표자 외형을 유지하면서 교육 자료, 강의 콘텐츠, 학습 영상을 확장 가능하게 제작할 수 있습니다.
Kling Avatar v2 API는 소셜 미디어와 스트리밍 플랫폼을 위한 AI 인플루언서와 가상 프레젠터 제작을 지원합니다. 콘텐츠 제작자는 캐릭터 이미지에서 말하는 영상을 생성하여, 가상 페르소나가 사실적인 립싱크와 표정으로 스크립트 콘텐츠를 전달하도록 할 수 있습니다.
고객 서비스 애플리케이션에서 Kling AI Avatar v2 API는 텍스트 음성 변환 오디오를 기반으로 개인화된 영상 응답을 생성할 수 있습니다. 이를 통해 챗봇과 지원 시스템은 사람 같은 존재감을 담은 영상 메시지를 전달하여 고객 참여도와 커뮤니케이션 명확성을 높일 수 있습니다.
apipass.dev는 실제 프로덕션 워크로드에 맞춰 설계된 합리적인 Kling AI Avatar v2 API 가격을 제공합니다. 이 가격 모델은 예측 가능한 리소스 사용량으로 확장 가능한 말하는 아바타 생성을 지원하여, 불필요한 비용 부담 없이 개발, 테스트, 배포 단계 전반에서 지속적으로 사용하기에 적합합니다.
Kling AI Avatar v2 API 문서는 전체 통합 수명 주기 동안 개발자를 위한 명확하고 체계적인 가이드를 제공합니다. API 키 설정과 playground 테스트부터 배포 및 확장까지, 문서에는 팀이 말하는 아바타 워크플로를 효율적으로 구현하는 데 도움이 되는 실용적인 설명과 예제가 포함되어 있습니다.
apipass.dev는 24/7 Kling AI Avatar v2 API 지원을 통해 항상 지속적인 서비스 가용성과 신속한 기술 지원을 보장합니다. 통합, 프로덕션 배포, 지속적인 운영 중 어느 단계에서든 팀은 말하는 아바타 생성을 안정적이고 원활하게 유지하기 위해 상시 지원을 받을 수 있습니다.
모든 API는 Bearer Token을 통한 인증이 필요합니다.
Authorization: Bearer
새 Kling Avatar v2 생성 작업을 생성합니다
API는 다음 구조의 JSON 페이로드를 받습니다:
1{
2 "model": "string",
3 "callBackUrl": "string (optional)",
4 "channel": "auto",
5 "input": {
6 // Input parameters based on form configuration
7 }
8}model필수string생성에 사용할 모델 이름
"kling/avatar-v2"
callBackUrl선택적string작업 완료 알림을 받을 콜백 URL입니다.
"https://your-domain.com/api/callback"
channel선택적stringchannel 매개변수를 통해 APIPASS 내 해당 제공업체를 지정할 수 있으며, 이러한 제공업체가 실제 이미지 및 비디오 생성 작업을 처리합니다. APIPASS는 현재 세 가지 제공업체 옵션을 제공합니다:
channel 매개변수의 기본값은 auto입니다. 활성화하면 APIPASS가 실시간 가격 및 안정성 지표를 기반으로 사용 가능한 제공업체 간에 작업을 자동으로 할당하여 최소 비용과 안정적인 성능의 균형을 맞춥니다. 사용자 지정 라우팅 요구 사항이 없다면 기본값 auto를 유지하세요.
사용 가능한 옵션:
auto
입력 객체에는 폼 구성에 따라 다음 매개변수가 포함됩니다:
input.image필수string (URL)아바타 참조 이미지 URL입니다. 사진에는 대상의 머리, 어깨, 상반신이 명확하게 보여야 합니다.
허용 형식: .jpg/.jpeg/.png; 최대 크기: 10MB; 최소 크기: 300px; 종횡비: 1:2.5 ~ 2.5:1
"https://example.com/avatar-image.jpg"
input.audio필수string (URL)립싱크 및 아바타 애니메이션에 사용할 오디오 파일 URL입니다.
허용 형식: .mp3/.wav/.m4a/.aac; 최대 크기: 5MB
"https://example.com/speech-audio.mp3"
input.prompt선택적string아바타의 동작, 표정, 카메라 움직임을 정의하는 텍스트 프롬프트입니다.
최대 길이: 2500자
"A professional spokesperson delivering a speech with confident gestures"
input.mode선택적string비디오 생성 모드입니다. 기본값은 'std'입니다.
사용 가능한 옵션:
"std"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "kling/avatar-v2",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "image": "https://example.com/avatar-image.jpg",
9 "audio": "https://example.com/speech-audio.mp3",
10 "prompt": "A professional spokesperson delivering a speech with confident gestures",
11 "mode": "std"
12 }
13 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}code상태 코드입니다. 200은 성공을, 그 외는 실패를 의미합니다
message응답 메시지입니다. 실패 시 오류 설명이 표시됩니다
data.taskId작업 상태 조회에 사용할 작업 ID

ByteDance
ByteDance
시작가
0 크레딧
ByteDance
ByteDance
시작가
0 크레딧
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
시작가
0 크레딧
MiniMax
MiniMax
시작가
0 크레딧
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
시작가
0 크레딧
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
시작가
0 크레딧
wan
wan
시작가
0 크레딧
Runway
Runway
시작가
0 크레딧
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
시작가
0 크레딧
ByteDance
ByteDance
Generate realistic human animation videos by combining a portrait image with audio, producing natural lip-sync, facial expressions, and body movements.
시작가
0 크레딧
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
시작가
0 크레딧
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
시작가
0 크레딧
Kling
Kling
시작가
0 크레딧
Luma
Luma
시작가
0 크레딧
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
시작가
0 크레딧
시작가
0 크레딧
kling
kling
시작가
0 크레딧