아직 오디오가 없습니다. 폼을 제출해 오디오를 생성하세요.
다양한 사용 사례와 매개변수 구성을 살펴보세요
elevenlabs/text-to-dialogue-v3 사용 전체 가이드
APIPASS를 통해 세밀한 제어, 다중 화자 생성, 유연한 배포를 활용하여 70개 이상의 언어에서 자연스럽고 감정 표현이 풍부한 대화 경험을 구축하세요.

Eleven V3 (Alpha) API는 현재까지 ElevenLabs에서 가장 표현력이 뛰어난 Text to Speech 모델로, 기계적인 합성음이 아니라 실제로 연출된 연기처럼 들리도록 설계되었습니다. 감정의 뉘앙스, 속도, 맥락을 이해하여 기존 AI 음성 생성의 한계를 뛰어넘으며, 생성된 음성이 속삭이고, 웃고, 한숨 쉬고, 자연스럽게 반응할 수 있게 합니다. APIPASS 기반의 이 API는 고급 다중 화자 Text to Dialogue와 인라인 오디오 태그를 프로덕션 워크플로에 직접 제공하여, 몰입감 있고 감정적으로 풍부한 오디오 스토리텔링과 인터랙티브 애플리케이션을 구축할 수 있도록 지원합니다.
모든 요청에는 비어 있지 않은 배열 형태의 dialogue가 포함되어야 합니다. 각 항목은 text와 voice를 모두 포함하는 객체여야 합니다.
어댑터는 stability 값으로 0, 0.5 또는 1만 허용합니다. 해당 필드가 생략되면 어댑터는 작업을 업스트림으로 전달하기 전에 기본값 0.5를 주입합니다.
제공자를 안내하기 위해 language_code를 전송할 수 있습니다. 이를 생략하면 어댑터는 해당 필드를 제외하고 자동 언어 감지를 허용합니다.
크리에이터는 텍스트 내 인라인 태그를 사용해 어조, 감정, 비언어적 반응을 세밀하게 제어할 수 있으며, 음성이 인위적으로 생성된 느낌이 아니라 의도적으로 연출된 것처럼 느껴지게 할 수 있습니다.
이 API는 다중 화자 Text to Dialogue를 기본 지원하여, 별도의 음성 트랙을 수동으로 이어 붙일 필요 없이 현실적인 발화 전환, 속도, 끼어들기가 포함된 자연스러운 대화를 생성할 수 있습니다.
이 모델은 70개 이상의 언어에서 감정 전달, 뉘앙스, 운율을 유지하므로 국제 사용자와 다국어 제품에 매우 적합합니다.
Eleven V3는 스크립트의 맥락과 의도를 매우 뛰어나게 해석하여, 긴 음성 구간에서도 강세, 리듬, 감정적 연속성을 개선합니다.
개발자는 MP3, PCM (S16LE), μ-law, A-law, Opus 등 애플리케이션 요구사항에 맞는 다양한 오디오 형식 중에서 선택할 수 있습니다.
사용자를 경직된 구독 요금제에 묶어두는 대신, 플랫폼은 유연한 크레딧 기반 시스템을 활용하여 팀이 실제 수요에 따라 사용량을 원활하게 확장하고 지출을 제어할 수 있도록 합니다.
이 통합은 Kie 기반 생성 모델에서 사용되는 표준 ApiPass 비동기 작업 흐름을 따릅니다.
apipass.dev에서 계정을 만들고 고유한 API Key를 생성하여 Eleven V3 API에 대한 액세스를 활성화하고 요청을 인증하세요.
apipass.dev playground를 활용해 표현력 있는 생성을 실험하고, 다양한 오디오 태그를 테스트하며, 실제 프로덕션 환경에 통합하기 전에 다중 화자 대화 동작을 미리 확인하세요.
대화 텍스트 입력을 준비하고, 화자 구조를 설정하며, 특정 사용 사례에 적합한 출력 형식을 선택하여 애플리케이션 내 요청 구조를 정의하세요.
API를 서비스, 애플리케이션 또는 내부 워크플로에 직접 배포하여 창작 또는 인터랙티브 플랫폼 전반의 음성 기능을 구동하세요.
제품이 성장함에 따라 apipass.dev에서 Eleven V3 API 사용량을 쉽게 확장할 수 있으며, 간단한 음성 생성부터 고급 대화 경험까지 동일한 기술 기반을 활용할 수 있습니다.
이 제안들은 어댑터 가드레일 및 업스트림 페이로드 형식과 일치합니다.
가장 안정적인 생성을 보장하고 표현 품질을 유지하려면 텍스트 요청을 2,000자 이하로 유지하고, 긴 스크립트는 장면이나 화자 발화처럼 논리적인 세그먼트로 나누세요.
오디오 태그([whispers] 또는 [laughs] 등)는 계속 사용하기보다 핵심적인 감정 지점에 의도적으로 배치하세요. 태그를 과도하게 사용하면 대화가 지나치게 양식화되어 보이고 일관성이 떨어질 수 있습니다.
말줄임표를 삽입하면 속도를 조절하고, 미묘하게 이어지는 생각, 멈춤 또는 망설임을 표현하는 데 효과적이며, 이는 대화형 타이밍에 매우 중요합니다.
대시는 갑작스러운 방향 전환이나 문장 중간의 끼어들기를 나타내는 데 도움이 되며, 매우 현실적인 대화 흐름과 역동적인 리듬을 만들어냅니다.
긴 형식의 내러티브 콘텐츠에 적합하며, 크리에이터가 실제 연기에 가까운 뚜렷한 캐릭터 감정과 속도를 담은 오디오북과 이야기를 제작할 수 있게 합니다.
현실적인 다중 화자 타이밍과 감정적 연속성을 갖춘 팟캐스트 스타일 에피소드 또는 인터뷰 시뮬레이션을 쉽게 생성할 수 있습니다.
믿을 수 있는 개성, 분기형 대화, 내러티브 중심 상호작용으로 비디오 게임 캐릭터와 NPC에 생동감을 부여하여 플레이어의 몰입감을 크게 높이세요.
AI 아바타, 영상 내레이션, 전달 방식이 사용자 경험을 크게 좌우하는 창작 미디어 워크플로에서 표현력 있는 Text to Speech 보이스오버를 시각적 스토리텔링과 매끄럽게 맞출 수 있습니다.
이 문서는 elevenlabs/text-to-dialogue-v3를 사용합니다. 이는 이 기능에 대해 Kie adapter가 인식하는 정확한 공개 모델 식별자이기 때문입니다.
readme와 API 섹션은 코드에 구현된 동일한 규칙을 설명합니다. dialogue는 필수이고, 각 항목에는 text와 voice가 필요하며, 전체 text는 5000자 이내여야 하고, stability는 0, 0.5 또는 1만 허용합니다.
예제에서 resultUrls를 반환하는 이유는 Kie adapter가 완료된 작업 출력을 비동기 생성 모델 전반에서 사용되는 공통 ApiPass resultJson 구조로 정규화하기 때문입니다.
모든 API는 Bearer Token을 통한 인증이 필요합니다.
Authorization: Bearer
ApiPass 통합 jobs API를 통해 새로운 ElevenLabs Dialogue V3 오디오 생성 작업을 생성합니다.
ApiPass는 비동기 Kie 기반 모델 전반에서 공개 요청 엔벨로프를 안정적으로 유지합니다. Dialogue 생성 매개변수는 input 객체 내부에 전달됩니다.
1{
2 "model": "elevenlabs/text-to-dialogue-v3",
3 "callBackUrl": "string (optional)",
4 "input": {
5 "dialogue": [
6 {
7 "text": "string",
8 "voice": "string"
9 }
10 ],
11 "stability": "0 | 0.5 | 1 (optional)",
12 "language_code": "string (optional)"
13 },
14 "channel": "auto"
15}model필수stringElevenLabs 대화 생성을 위한 공개 ApiPass 모델 이름입니다.
"elevenlabs/text-to-dialogue-v3"
callBackUrl선택적string작업 완료 알림을 위한 선택적 콜백 URL입니다.
"https://your-domain.com/api/callback"
channel선택적stringchannel 매개변수를 통해 APIPASS 내 해당 제공업체를 지정할 수 있습니다. 이러한 제공업체는 실제 이미지 및 비디오 생성 작업을 처리합니다. APIPASS는 현재 세 가지 제공업체 옵션을 제공합니다:
channel 매개변수의 기본값은 auto입니다. 활성화하면 APIPASS가 실시간 가격 및 안정성 지표를 기반으로 사용 가능한 제공업체 간에 작업을 자동 할당하여 최소 비용과 안정적인 성능의 균형을 맞춥니다. 사용자 지정 라우팅 요구 사항이 없다면 기본값 auto를 유지하세요.
사용 가능한 옵션:
auto
input 객체에는 ApiPass가 허용하는 대화 생성 필드가 포함됩니다. 어댑터는 필수 dialogue 항목을 검증하고 생략된 경우 기본 stability 값을 삽입합니다.
input.dialogue필수array<object>Dialogue 배열입니다. 각 항목에는 text와 voice가 포함되어야 하며, 모든 항목의 합산 텍스트 길이는 5000자를 초과할 수 없습니다.
[{"text":"Hello and welcome.","voice":"BIvP0GN1cAtSRTxNHnWS"},{"text":"Thanks, let's begin.","voice":"aMSt68OGf4xUZAnLpTU8"}]input.stability선택적number선택적 안정성 제어 값입니다. 허용되는 값은 0, 0.5, 1입니다. 이 필드가 생략되면 어댑터는 기본값으로 0.5를 사용합니다.
사용 가능한 옵션:
0.5
input.language_code선택적string제공된 경우 업스트림으로 전달되는 선택적 언어 코드입니다.
"eng"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "elevenlabs/text-to-dialogue-v3",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "dialogue": [
9 {
10 "text": "Thanks for joining the launch review today. I want us to keep the tone warm and natural.",
11 "voice": "BIvP0GN1cAtSRTxNHnWS"
12 },
13 {
14 "text": "Absolutely. I will keep the pacing calm and conversational so the exchange feels like a real discussion.",
15 "voice": "aMSt68OGf4xUZAnLpTU8"
16 }
17 ],
18 "stability": 0.5,
19 "language_code": "eng"
20 }
21 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_elevenlabs_dialogue_1768468200000"
6 }
7}code상태 코드입니다. 200은 작업이 성공적으로 생성되었음을 나타냅니다.
messageApiPass가 반환한 응답 메시지입니다.
data.taskId이후 상태 확인에 사용되는 작업 식별자입니다.