Noch kein Audio. Senden Sie das Formular ab, um Audio zu generieren.
Entdecken Sie verschiedene Anwendungsfälle und Parameterkonfigurationen
Transparente Preisgestaltung ohne versteckte Gebühren. Bezahlen Sie nach Verbrauch.
| Regel & Modalität | Channel | Guthaben | Preis (USD) | Offizieller / Referenzpreis | Tägliche Ersparnis |
|---|---|---|---|---|---|
text-to-speech otherElevenlabs | Starter | 1per prompt/1000 | $0.005 | Fal$0.100per prompt/1000 | bei 10,000 Anfragen/TagFal kostet $954.550/Tag mehrApiPass ist 95.46% günstiger |
Wettbewerberpreise kosten $954.550/Tag mehr
ApiPass ist 95.46% günstiger, geschätzt bei Basierend auf 10,000 Anfragen/Tag
text-to-speech
ApiPass-Preis
$0.005
1 Credits per prompt/1000
Wettbewerberpreise
Vollständige Anleitung zur Verwendung von ElevenLabs V3 TTS
Erstellen Sie ausdrucksstarke Text-to-Speech-Workflows mit ElevenLabs V3 TTS auf ApiPass. Generieren Sie natürlich klingende KI-Sprachaudios aus Skripten, steuern Sie die Darbietung mit Audio-Tags wie [excited], [whispers] und [laughs] und kontrollieren Sie Stimme, Stabilität, Sprache, Textnormalisierung und Zeitstempel über eine einzige asynchrone API.

ElevenLabs V3 TTS ist ein ausdrucksstarkes Text-to-Speech-Modell, das geschriebene Skripte in natürlich klingende KI-Sprachaudios umwandelt. Es ist für Sprachausgaben konzipiert, die nicht nur vorlesen, sondern performen, und eignet sich daher für Erzählungen, Dialoge, Produkt-Voiceovers, Lokalisierung, Charakterstimmen und Kurzformat-Medien. Die ApiPass API verwendet den öffentlichen Modellnamen elevenlabs/elevenlabs-v3-tts, übermittelt die Generierung als asynchrone Aufgabe und gibt Ausgabedatei-URLs über Aufgabenabfragen oder optionale Callbacks zurück.
Generieren Sie natürliche Sprache aus Skripten mit bis zu 5000 Zeichen. Inline-Audio-Tags wie [excited], [whispers] und [laughs] können Tonfall und Vortragsweise steuern, um eine gezieltere Sprachausgabe zu ermöglichen.
Wählen Sie aus unterstützten Stimmnamen wie Rachel, Aria, Daniel, Lily und weiteren. Stellen Sie stability von 0 bis 1 ein, um zu steuern, wie konsistent oder variabel die Stimmperformance sein soll.
Verwenden Sie optionale zweibuchstabige language_code-Werte für mehrsprachige Workflows, wenden Sie Textnormalisierung mit auto, on oder off an und fordern Sie eine Zeitstempel-Ausgabe als JSON an, wenn nachgelagerte Ausrichtungsdaten benötigt werden.
Steuern Sie emotionale Färbung, Vortragsweise und menschliche Reaktionen direkt im Skript. Dasselbe Textfeld kann gesprochene Inhalte und Performance-Hinweise enthalten, sodass Teams Erzählungen, Charakterdialoge und Social-Media-Voiceovers mit einer einzigen Anfrage erstellen können.
Senden Sie die dokumentierten Felder text, voice, stability, timestamps, language_code und apply_text_normalization. ApiPass validiert Typen und unterstützte Werte und führt die Generierung anschließend über einen standardisierten asynchronen Aufgaben-Workflow aus.
Übermitteln Sie eine Aufgabe, fragen Sie /api/v1/jobs/recordInfo ab oder erhalten Sie einen optionalen Callback. Erfolgreiche Aufgaben geben resultJson.resultUrls mit generierten Audio-URLs zurück und, wenn Zeitstempel angefordert und erzeugt wurden, zusätzliche JSON-Datei-URLs.
Generieren Sie ausdrucksstarke Erzählstimmen für Reels, Produktdemos, Anzeigen, Erklärvideos, Launch-Videos und Social-Media-Clips mithilfe von Inline-Hinweisen zur Vortragsweise.
Wandeln Sie Kursskripte, Onboarding-Leitfäden, Hilfeartikel und Tutorials in klare gesprochene Audiodateien für Bildungsplattformen und interne Schulungstools um.
Prototypisieren Sie Charakterzeilen, Sprachausgaben von App-Assistenten, Rollenspielabläufe, narrative Dialoge und performancebewusste Spracherlebnisse mithilfe ausdrucksstarker Tags.
Generieren Sie mehrsprachige Sprach-Assets mit optionalen Sprachcodes und Steuerung der Textnormalisierung für globale Produkt-, Medien- und Support-Workflows.
ApiPass stellt ElevenLabs V3 TTS über einen standardisierten asynchronen Aufgaben-Workflow bereit, der mit anderen ApiPass-Modell-APIs konsistent ist.
Senden Sie eine POST-Anfrage an /api/v1/jobs/createTask, wobei model auf elevenlabs/elevenlabs-v3-tts gesetzt ist und ein input-Objekt text sowie optionale Felder für voice, stability, timestamps, language_code und apply_text_normalization enthält.
Verwenden Sie die zurückgegebene taskId mit GET /api/v1/jobs/recordInfo, um den Aufgabenstatus zu prüfen. Wenn callBackUrl bei der Erstellung angegeben wird, sendet ApiPass das finale Aufgabenergebnis per POST an Ihren Endpunkt, sobald die Generierung abgeschlossen ist.
Wenn data.state success ist, lesen Sie data.resultJson.resultUrls aus. Das Ergebnis kann ein Objekt oder ein parsebarer JSON-String sein, und Aufgaben mit aktivierten Zeitstempeln können sowohl Audio- als auch JSON-URLs enthalten.
Die aktuelle Abrechnung im regulären Kanal beträgt 16 Credits pro 1000 Eingabezeichen, proportional berechnet als 16 × len(text) ÷ 1000 ohne Aufrundung.
Für die Abrechnung wird die Länge der unverarbeiteten Eingabezeichenfolge verwendet, einschließlich Leerzeichen, Zeilenumbrüchen und Satzzeichen. Die Textvalidierung lehnt leeren getrimmten Text ab, aber die ursprüngliche Zeichenfolge wird gesendet und gezählt.
voice, stability, timestamps, language_code und apply_text_normalization ändern die Credit-Formel derzeit nicht. Zeitstempeldateien haben derzeit keinen separaten zusätzlichen Credit-Posten.
Die Online-Abrechnung hängt von bereitgestellten und aktiven Credit-Regeln des Modells ab. Aktionspreise, Kanalpreise oder spätere Migrationen können die tatsächlich berechneten Credits ändern.
Erstellen Sie im Dashboard einen ApiPass API Key und verwenden Sie ihn als Bearer-Token beim Aufruf der Endpunkte zur Aufgabenerstellung und Abfrage.
Bereiten Sie einen Text mit 1-5000 Zeichen vor. Fügen Sie ausdrucksstarke Tags wie [excited], [whispers] oder [laughs] hinzu, wenn das Modell bestimmten Performance-Anweisungen folgen soll.
Wählen Sie einen unterstützten, groß-/kleinschreibungssensitiven Stimmnamen, stellen Sie stability von 0 bis 1 ein und setzen Sie optional language_code, timestamps und apply_text_normalization.
Übermitteln Sie die Aufgabe an /api/v1/jobs/createTask und fragen Sie anschließend /api/v1/jobs/recordInfo mit der zurückgegebenen taskId ab. Abgeschlossene Aufgaben liefern Audiodatei-URLs zurück und können bei entsprechender Anforderung Zeitstempel-JSON-URLs enthalten.
Alle APIs erfordern eine Authentifizierung über Bearer Token.
Authorization: Bearer
Senden Sie eine neue ElevenLabs-V3-Text-to-Speech-Aufgabe und fordern Sie optional eine Timestamp-Ausgabe an.
Die API akzeptiert ein JSON-Payload mit der folgenden Struktur:
1{
2 "model": "elevenlabs/elevenlabs-v3-tts",
3 "callBackUrl": "string (optional)",
4 "channel": "auto",
5 "input": {
6 "text": "string",
7 "voice": "Rachel",
8 "stability": 0.5,
9 "timestamps": false,
10 "language_code": "en",
11 "apply_text_normalization": "auto"
12 }
13}modelErforderlichstringDer öffentliche Modellname von ApiPass. Muss für diese API fest auf elevenlabs/elevenlabs-v3-tts gesetzt sein.
"elevenlabs/elevenlabs-v3-tts"
callBackUrlOptionalstringCallback-URL für Benachrichtigungen zum Abschluss der Aufgabe. Wenn sie weggelassen wird, wird kein Callback gesendet.
"https://your-domain.com/api/callback"
channelOptionalstringSie können den entsprechenden Anbieter innerhalb von APIPASS über den Parameter channel angeben. Der Standard-Channel ist auto. APIPASS verteilt Aufgaben automatisch über verfügbare Anbieter auf Basis von Echtzeit-Preisen und Stabilitätsmetriken. starter ist extrem günstig, hat aber begrenzte Kontingente und eine geringere Stabilität. regular ist die Standardoption und deutlich günstiger als offizielle APIs bei moderater Stabilität. official verwendet die native API des Modells mit hoher Stabilität, schneller Aufgabenausführung und offiziellen Preisen.
Der Standardwert für den Parameter channel ist auto. Wenn aktiviert, verteilt APIPASS Aufgaben automatisch über verfügbare Anbieter auf Basis von Echtzeit-Preisen und Stabilitätsmetriken, um minimale Kosten und zuverlässige Leistung auszubalancieren. starter ist extrem günstig, hat aber begrenzte Kontingente und eine geringere Stabilität; regular ist der Standard und deutlich günstiger als offizielle APIs bei moderater Stabilität; official verwendet die native API des Modells mit hoher Stabilität, schneller Aufgabenausführung und offiziellen Preisen.
Verfügbare Optionen:
auto
Das Eingabeobjekt enthält die folgenden Parameter:
input.textErforderlichstringText, der in Sprache umgewandelt werden soll. Muss nach der Validierung eine Zeichenkette mit 1 bis 5000 Python-Zeichen sein und darf nach dem Trimmen von führenden und nachfolgenden Leerzeichen nicht leer sein.
Die Validierung verwendet text.strip(), um leeren Text abzulehnen, aber der ursprüngliche Text wird ohne Trimmen an den Upstream gesendet. Die Abrechnung verwendet len(text) auf der rohen Zeichenkette, daher zählen Leerzeichen, Zeilenumbrüche und Satzzeichen zur Zeichennutzung. Text mit mehr als 5000 Zeichen wird nicht automatisch aufgeteilt; teilen Sie langen Text selbst in mehrere Aufgaben auf.
"Welcome to ApiPass. This sentence will be converted to speech."
input.voiceOptionalstringStimmcharakter für die Spracherzeugung. Standardmäßig Rachel, wenn weggelassen oder auf null gesetzt.
Voicenamen sind exakte, groß- und kleinschreibungssensitive Werte. Varianten wie rachel oder RACHEL werden nicht automatisch konvertiert, und nicht unterstützte Stimmen fallen nicht stillschweigend auf Rachel zurück.
Verfügbare Optionen:
"Rachel"
input.stabilityOptionalnumberSteuert die Stabilität der Stimme. Standardmäßig 0.5. Der gültige Bereich liegt einschließlich 0 bis 1.
Muss eine JSON-Zahl sein. Ganze Zahlen 0 und 1 sowie gültige Gleitkommawerte werden akzeptiert und vor dem Senden an den Upstream in float umgewandelt. JSON-Boolean-Werte, numerische Strings wie "0.5", NaN und Unendlichkeitswerte werden abgelehnt.
0.5
input.timestampsOptionalbooleanOb Text-zu-Audio-Timestamp-Informationen angefordert werden sollen. Standardmäßig false.
Wenn wahr, kann der Upstream-Anbieter zusätzlich zur Audiodatei eine Timestamp-JSON-Datei zurückgeben. Das vereinheitlichte ApiPass-resultJson extrahiert Datein-URLs in resultUrls und behält nicht jedes Upstream-file_type bei. Clients sollten daher mehrere URLs verarbeiten und Audio und JSON anhand von Inhalt oder Endung identifizieren.
Verfügbare Optionen:
false
input.language_codeOptionalstringOptionaler zweibuchstabiger ISO-639-1-Sprachcode, zum Beispiel en, zh, ja oder fr. Wenn weggelassen oder auf null gesetzt, wird dieses Feld nicht an den Upstream gesendet.
Verfügbare Optionen:
"en"
input.apply_text_normalizationOptionalstringSteuert das Verhalten der Textnormalisierung. Standardmäßig auto, wenn weggelassen oder auf null gesetzt.
Muss eine Zeichenkette sein. Die Eingabe wird vor der Validierung getrimmt und kleingeschrieben, daher wird " ON " zu "on" normalisiert. Andere Werte liefern einen Parameterfehler und fallen nicht auf den Standard zurück.
Verfügbare Optionen:
"auto"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "elevenlabs/elevenlabs-v3-tts",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "channel": "auto",
8 "input": {
9 "text": "Hello! This is an ElevenLabs V3 text-to-speech test.",
10 "voice": "Rachel",
11 "stability": 0.5,
12 "timestamps": false,
13 "language_code": "en",
14 "apply_text_normalization": "auto"
15 }
16 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_xxxxxxxxxxxxxxxx"
6 }
7}codeStatuscode, 200 für Erfolg, andere für Fehler.
messageAntwortnachricht. Wenn die Anfrage fehlschlägt, enthält sie die Fehlerbeschreibung.
data.taskIdAufgaben-ID zum Abfragen von Aufgabenstatus und Ergebnissen.