まだ音声はありません。フォームを送信して音声を生成してください。
さまざまなユースケースとパラメータ設定を確認できます
elevenlabs/text-to-dialogue-v3 の完全ガイド
APIPASS を通じて、70+ の言語に対応した自然で感情表現豊かな対話体験を構築できます。細かな制御、マルチスピーカー生成、柔軟なデプロイに対応しています。

Eleven V3 (Alpha) API は、ElevenLabs がこれまで提供してきた中で最も表現力に優れた Text to Speech モデルです。機械的な合成音声ではなく、実際に演出されたパフォーマンスのように聞こえるよう設計されています。感情のニュアンス、間の取り方、文脈を理解することで、従来の AI 音声生成を超え、生成音声がささやき、笑い、ため息をつき、自然に反応できるようにします。APIPASS により、この API は高度なマルチスピーカー Text to Dialogue とインライン音声タグを本番ワークフローへ直接組み込めるため、没入感があり感情豊かな音声ストーリーテリングやインタラクティブアプリケーションを構築できます。
すべてのリクエストには、空でない配列として dialogue を含める必要があります。各項目は、text と voice の両方を含むオブジェクトでなければなりません。
アダプターが受け付ける stability 値は 0、0.5、1 のみです。このフィールドが省略された場合、アダプターはタスクを上流へ転送する前にデフォルト値 0.5 を挿入します。
プロバイダーへの指示として language_code を送信できます。省略した場合、アダプターはこのフィールドを含めず、自動言語検出に委ねます。
クリエイターはテキスト内のインラインタグを使用して、トーン、感情、非言語的な反応を細かく制御できます。これにより、音声は人工的に生成されたものではなく、意図を持って演出されたように感じられます。
この API はマルチスピーカー Text to Dialogue をネイティブにサポートしており、個別の音声トラックを手動でつなぎ合わせることなく、リアルな発話交替、間の取り方、割り込みを備えた流れるような会話を実現できます。
このモデルは 70 を超える言語で感情表現、ニュアンス、韻律を維持できるため、国際的なオーディエンスや多言語プロダクトに最適です。
Eleven V3 はスクリプトの文脈と意図を非常に高い精度で解釈し、長い発話全体で強調、リズム、感情の一貫性を向上させます。
開発者はアプリケーションのニーズに合わせて、MP3、PCM (S16LE)、μ-law、A-law、Opus など、さまざまな音声形式を選択できます。
ユーザーを固定的なサブスクリプションプランに縛るのではなく、このプラットフォームは柔軟なクレジットベースのシステムを採用しており、チームは実際の需要に応じて利用量をシームレスに拡張し、支出を管理できます。
この統合は、Kie-backed 生成モデルで使用される標準的な ApiPass 非同期ジョブフローに従います。
apipass.dev でアカウントを作成し、固有の API Key を生成して、Eleven V3 API へのアクセスを有効化し、リクエストを認証します。
apipass.dev の playground を利用して、表現豊かな生成を試し、さまざまな音声タグをテストし、マルチスピーカー対話の挙動を本番環境へ統合する前にプレビューできます。
アプリケーション内で、対話テキスト入力を準備し、話者構成を設定し、特定のユースケースに適した出力形式を選択して、リクエスト構造を定義します。
API をサービス、アプリケーション、または社内ワークフローへ直接デプロイし、クリエイティブまたはインタラクティブなプラットフォーム全体で音声機能を提供します。
プロダクトの成長に合わせて、apipass.dev 上で Eleven V3 API の利用量を簡単に拡張できます。シンプルな音声生成から高度な対話体験まで、同じ技術基盤を活用できます。
これらの提案は、アダプターのガードレールと上流ペイロードの形状に沿っています。
最も信頼性の高い生成を確保し、表現品質を維持するために、テキストリクエストは 2,000 文字以下に抑え、長いスクリプトはシーンや話者のターンなど論理的なセグメントに分割してください。
音声タグ([whispers] や [laughs] など)は連続して使うのではなく、重要な感情のポイントに意図的に配置してください。タグを使いすぎると、対話が過度に演出された印象になり、一貫性が低下する場合があります。
省略記号を挿入することは、話す速度感に影響を与える効果的な方法です。余韻のある思考、間、ためらいをさりげなく加えられるため、会話のタイミングにおいて非常に重要です。
ダッシュは、方向性の急な変化や文の途中での割り込みを示すのに役立ち、非常にリアルな会話の流れとダイナミックなリズムを生み出します。
長編のナラティブコンテンツに最適です。クリエイターは、実際の演技に近い、明確なキャラクター感情と間の取り方を備えたオーディオブックや物語を制作できます。
リアルなマルチスピーカーのタイミングと感情の一貫性を備えた、ポッドキャスト形式のエピソードやインタビューシミュレーションを簡単に生成できます。
説得力のある個性、分岐する会話、物語主導のインタラクションにより、ビデオゲームのキャラクターや NPC に命を吹き込み、プレイヤーの没入感を大きく高めます。
AI アバター、動画ナレーション、クリエイティブメディアのワークフローにおいて、表現豊かな Text to Speech のボイスオーバーをビジュアルストーリーテリングとシームレスに連携させ、発話表現がユーザー体験を大きく左右する場面に対応します。
このドキュメントでは elevenlabs/text-to-dialogue-v3 を使用しています。これは、この機能に対して Kie adapter が認識する正確な公開モデル識別子であるためです。
readme と API セクションでは、コードに実装されている同じルールを説明しています。dialogue は必須であり、各項目には text と voice が必要で、合計テキストは 5000 文字以内に収める必要があり、stability は 0、0.5、1 のみを受け付けます。
例では resultUrls を返しています。これは、Kie adapter が完了したタスクの出力を、非同期生成モデル全体で使用される共通の ApiPass resultJson 構造へ正規化するためです。
すべてのAPIはBearer Tokenによる認証が必要です。
Authorization: Bearer
ApiPass の統合 jobs API を通じて、新しい ElevenLabs Dialogue V3 音声生成タスクを作成します
ApiPass は、非同期の Kie バックエンドモデル全体で公開リクエストのエンベロープを安定して維持します。Dialogue 生成パラメーターは input オブジェクト内で渡されます。
1{
2 "model": "elevenlabs/text-to-dialogue-v3",
3 "callBackUrl": "string (optional)",
4 "input": {
5 "dialogue": [
6 {
7 "text": "string",
8 "voice": "string"
9 }
10 ],
11 "stability": "0 | 0.5 | 1 (optional)",
12 "language_code": "string (optional)"
13 },
14 "channel": "auto"
15}model必要stringElevenLabs dialogue 生成用の公開 ApiPass モデル名です。
"elevenlabs/text-to-dialogue-v3"
callBackUrlオプションstringタスク完了通知用の任意のコールバック URL です。
"https://your-domain.com/api/callback"
channelオプションstringchannel パラメーターを使用して、APIPASS 内の対応するプロバイダーを指定できます。これらのプロバイダーが実際の画像および動画生成タスクを処理します。APIPASS は現在、3 つのプロバイダーオプションを提供しています。
channel パラメーターのデフォルト値は auto です。有効にすると、APIPASS はリアルタイムの価格と安定性指標に基づいて、利用可能なプロバイダー間でタスクを自動的に割り当て、最小コストと信頼性の高いパフォーマンスのバランスを取ります。カスタムルーティング要件がない限り、デフォルト値の auto を維持してください。
利用可能なオプション:
auto
input オブジェクトには、ApiPass が受け付ける dialogue 生成フィールドが含まれます。アダプターは必須の dialogue 項目を検証し、省略された場合はデフォルトの stability 値を注入します。
input.dialogue必要array<object>Dialogue 配列です。各項目には text と voice を含める必要があり、すべての項目を合計したテキスト長は 5000 文字を超えてはいけません。
[{"text":"Hello and welcome.","voice":"BIvP0GN1cAtSRTxNHnWS"},{"text":"Thanks, let's begin.","voice":"aMSt68OGf4xUZAnLpTU8"}]input.stabilityオプションnumber任意の stability 制御です。許可される値は 0、0.5、1 です。このフィールドが省略された場合、アダプターはデフォルトで 0.5 を使用します。
利用可能なオプション:
0.5
input.language_codeオプションstring指定された場合にアップストリームへ転送される任意の言語コードです。
"eng"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "elevenlabs/text-to-dialogue-v3",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "dialogue": [
9 {
10 "text": "Thanks for joining the launch review today. I want us to keep the tone warm and natural.",
11 "voice": "BIvP0GN1cAtSRTxNHnWS"
12 },
13 {
14 "text": "Absolutely. I will keep the pacing calm and conversational so the exchange feels like a real discussion.",
15 "voice": "aMSt68OGf4xUZAnLpTU8"
16 }
17 ],
18 "stability": 0.5,
19 "language_code": "eng"
20 }
21 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_elevenlabs_dialogue_1768468200000"
6 }
7}codeステータスコード。200 はタスクが正常に作成されたことを示します。
messageApiPass から返されるレスポンスメッセージです。
data.taskId後続のステータス確認に使用するタスク識別子です。