Noch kein Video. Senden Sie das Formular ab, um ein Video zu generieren.
Entdecken Sie verschiedene Anwendungsfälle und Parameterkonfigurationen
Transparente Preisgestaltung ohne versteckte Gebühren. Bezahlen Sie nach Verbrauch.
| Regel & Modalität | Channel | Guthaben | Preis (USD) | Offizieller / Referenzpreis | Tägliche Ersparnis |
|---|---|---|---|---|---|
kling-avatar-v2-pro videoKlingmode: pro | Starter | 1per second | $0.005 | - | - |
kling-avatar-v2-std videoKlingmode: std | Starter | 0.8per second | $0.004 | - | - |
Vollständige Anleitung zur Verwendung von kling-avatar-v2
Erstellen Sie realistische Talking-Avatar-Videos aus einem einzelnen Bild und einer Audiodatei mit der Kling AI Avatar v2 API. Erzeugen Sie lebensechte Lip-Sync-Animationen mit natürlichen Gesichtsausdrücken und Körperbewegungen.

Kling Avatar v2 wurde von KuaiShou entwickelt und ist ein fortschrittliches, KI-gestütztes System zur Erstellung sprechender Avatare, das aus einem einzelnen Referenzbild und einer Audiodatei realistische Videoinhalte erzeugt. Das System analysiert das Audio, um präzise Lippenbewegungen, Gesichtsausdrücke und natürliche Körpergesten zu generieren, die perfekt mit der Sprache synchronisiert sind. Diese Technologie ermöglicht die Erstellung virtueller Sprecher, digitaler Moderatoren und animierter Charaktere, ohne komplexe Motion-Capture-Ausrüstung oder manuelle Animation zu benötigen. Die Kling Avatar v2 API bietet programmatischen Zugriff auf diese Funktion und ermöglicht es Entwicklern, die Generierung sprechender Avatare in ihre Anwendungen, Plattformen und Produktions-Workflows zu integrieren.
Die Kling AI Avatar v2 Standard API generiert Talking-Avatar-Videos in 720p-Auflösung mit optimierter Verarbeitungsgeschwindigkeit. Sie liefert natürliche Lip-Sync- und Körperbewegungen und eignet sich für Social-Media-Inhalte, Marketingmaterialien und die Produktion großer Mengen, bei denen Effizienz und Kosteneffektivität im Vordergrund stehen.
Die Kling AI Avatar v2 Pro API erstellt Talking-Avatar-Videos in 1080p-Auflösung mit verbesserter visueller Qualität. Dieser Modus ist ideal für professionelle Präsentationen, Broadcast-Inhalte und Premium-Produktionen, bei denen höhere Auflösung und verfeinerte Details entscheidend sind.
Die Kling Avatar v2 API erzeugt hochpräzise Lippenbewegungen, die perfekt mit dem eingegebenen Audio synchronisiert sind. Das System analysiert Sprachmuster, Phoneme und Timing, um natürliche Mundbewegungen zu erzeugen, die zum Audioinhalt passen und glaubwürdige Talking-Avatar-Videos ermöglichen.
Mit der Kling AI Avatar v2 API zeigen Avatare realistische Gesichtsausdrücke, die den gesprochenen Inhalt sinnvoll ergänzen. Das System generiert passende emotionale Ausdrücke, Augenbewegungen und Mikroexpressionen, die den Avatar lebendig wirken lassen und die Zuschauerbindung erhöhen.
Die Kling Avatar v2 API fügt dem generierten Video natürliche Körperbewegungen und Gesten hinzu. Handgesten, Kopfbewegungen und Schulterbewegungen werden synthetisiert, um eine dynamischere und ansprechendere Präsentation zu schaffen, die echtes menschliches Verhalten beim Sprechen nachahmt.
Die Kling AI Avatar v2 API unterstützt optionale Text-Prompts, um Aktionen, Gesichtsausdrücke und Kamerabewegungen des Avatars zu steuern. Entwickler können gewünschte Verhaltensweisen, emotionale Tonalitäten und Präsentationsstile festlegen, um die Ausgabe für unterschiedliche Anwendungsfälle und Zielgruppen anzupassen.
Die Kling Avatar v2 API benötigt nur ein einzelnes Referenzbild, um ein Talking-Avatar-Video zu generieren. Das System extrahiert Gesichtszüge, Erscheinungsdetails und Körperstruktur aus dem Bild, um während des gesamten generierten Videos einen konsistenten und wiedererkennbaren Charakter zu erstellen.
Starten Sie mit unserem Produkt in nur wenigen einfachen Schritten...
Erstellen Sie ein Konto und registrieren Sie sich für den Zugriff, um Ihren Kling AI Avatar v2 API Key zu erhalten. Dieser API-Schlüssel authentifiziert alle Anfragen an die Kling Avatar v2 API und verknüpft die Nutzung mit Ihrem Konto. Nach der Ausstellung kann Ihre Anwendung damit sicher die Endpunkte zur Generierung sprechender Avatare aufrufen und Generierungsaufgaben programmatisch verwalten.
Bevor Sie die API in Ihr System integrieren, nutzen Sie den Playground, um die Kling AI Avatar v2 API in einer interaktiven Umgebung zu testen. Laden Sie ein Referenzbild und eine Audiodatei hoch, fügen Sie optionale Prompts zur Verhaltenssteuerung hinzu und sehen Sie sich generierte Ergebnisse in der Vorschau an. Dieser Schritt hilft Ihnen, die Eingabequalität zu validieren und die Ausgabe zu verstehen, bevor Sie in die Produktion wechseln.
Nach dem Testen integrieren Sie die Kling Avatar v2 API in Ihr Backend oder Ihre Anwendungslogik. Legen Sie fest, wie Referenzbilder, Audiodateien, Prompts und Generierungsparameter über API-Anfragen übergeben werden. Diese Integration ermöglicht die automatisierte Generierung von Talking-Avatar-Videos als Teil Ihrer bestehenden Workflows oder Services.
Stellen Sie Ihre Integration mit der Kling AI Avatar v2 API in einer Produktionsumgebung bereit. Eine typische Bereitstellung umfasst die Verarbeitung asynchroner Generierungsjobs, das Nachverfolgen des Aufgabenstatus sowie das Speichern oder Ausliefern der generierten Videoausgaben. Dieser Schritt verbindet die Generierung sprechender Avatare mit echten nutzerorientierten oder internen Produktionspipelines.
Nach der Bereitstellung können Sie die Generierung von Talking-Avatar-Videos mit der Kling AI Avatar v2 API skalieren, indem Sie Bildauswahl, Audioqualität und die Wahl des Generierungsmodus optimieren. Mit wachsender Nachfrage unterstützt die API Workloads mit hohem Volumen, sodass Teams die Produktion ausweiten können, während stabile Ausgabequalität und planbare Ressourcennutzung erhalten bleiben.
Um stabile, hochwertige Ergebnisse mit der Kling AI Avatar v2 API zu erzielen, ist es wichtig, Referenzbild und Audiodatei sorgfältig vorzubereiten. Die folgenden Richtlinien helfen dabei, präzisen Lip-Sync, natürliche Gesichtsausdrücke und konsistente Ausgaben sicherzustellen.
Wählen Sie Referenzbilder, auf denen Gesicht, Kopf, Schultern und Oberkörper klar sichtbar sind. Das Bild sollte gut ausgeleuchtet sein, möglichst wenige Verdeckungen aufweisen und eine neutrale oder frontale Pose zeigen. Vermeiden Sie Bilder mit starkem Make-up, extremen Blickwinkeln oder deutlichen Gesichtsverdeckungen, die die Lip-Sync-Genauigkeit beeinträchtigen könnten.
Verwenden Sie Audiodateien mit klarer Sprache und minimalen Hintergrundgeräuschen. Das Audio sollte eine gleichmäßige Lautstärke haben und sich überschneidende Stimmen oder Musik vermeiden. Sauberes Audio hilft dem System, genauere Lippenbewegungen und ein natürlicheres Timing im Avatar-Video zu erzeugen.
Verwenden Sie den optionalen Prompt-Parameter, um Verhalten, Gesichtsausdrücke und Kamerabewegungen des Avatars zu steuern. Beschreibende Prompts wie „selbstbewusster Moderator mit professionellen Gesten“ oder „freundlicher Sprecher mit warmem Lächeln“ helfen dem System, gezieltere und kontextuell passendere Animationen zu generieren.
Die Kling AI Avatar v2 API ermöglicht es Marketingteams, sprechende Sprecher-Videos in großem Umfang zu erstellen. Durch die Kombination von Markenbildern mit geskriptetem Audio können Teams konsistente Marketinginhalte für Kampagnen, Produktankündigungen und Social Media produzieren, ohne wiederholte Videodrehs oder Talentkoordination.
Mit der Kling Avatar v2 API können Ersteller von Bildungsinhalten aus statischen Bildern und gesprochenem Audio dozentengeführte Videos generieren. Dies ermöglicht die skalierbare Produktion von Schulungsmaterialien, Kursinhalten und Lernvideos mit einem konsistenten Erscheinungsbild des Präsentators über mehrere Lektionen hinweg.
Die Kling Avatar v2 API unterstützt die Erstellung von KI-Influencern und virtuellen Moderatoren für Social-Media- und Streaming-Plattformen. Content Creators können sprechende Videos aus Charakterbildern generieren und so virtuellen Personas ermöglichen, geskriptete Inhalte mit realistischem Lip-Sync und passenden Gesichtsausdrücken zu präsentieren.
Für Kundenservice-Anwendungen kann die Kling AI Avatar v2 API personalisierte Videoantworten aus Text-to-Speech-Audio generieren. So können Chatbots und Supportsysteme Videonachrichten mit menschenähnlicher Präsenz bereitstellen, wodurch Kundenbindung und Verständlichkeit der Kommunikation verbessert werden.
apipass.dev bietet preisgünstige Kling AI Avatar v2 API-Tarife, die für reale Produktions-Workloads ausgelegt sind. Das Preismodell unterstützt skalierbare Generierung sprechender Avatare mit planbarer Ressourcennutzung und eignet sich damit für den kontinuierlichen Einsatz in Entwicklungs-, Test- und Bereitstellungsphasen ohne unnötigen Kostendruck.
Die Dokumentation der Kling AI Avatar v2 API bietet Entwicklern klare, strukturierte Anleitung über den gesamten Integrationszyklus hinweg. Von der Einrichtung des API-Schlüssels und Playground-Tests bis hin zu Bereitstellung und Skalierung enthält die Dokumentation praxisnahe Erklärungen und Beispiele, die Teams dabei helfen, Workflows für sprechende Avatare effizient umzusetzen.
Mit 24/7-Support für die Kling AI Avatar v2 API stellt apipass.dev jederzeit kontinuierliche Serviceverfügbarkeit und reaktionsschnelle technische Unterstützung sicher. Ob während der Integration, der Produktionsbereitstellung oder im laufenden Betrieb: Teams können sich auf Support rund um die Uhr verlassen, damit die Generierung sprechender Avatare stabil und reibungslos läuft.
Alle APIs erfordern eine Authentifizierung über Bearer Token.
Authorization: Bearer
Eine neue Kling Avatar v2-Generierungsaufgabe erstellen
Die API akzeptiert eine JSON-Nutzlast mit der folgenden Struktur:
1{
2 "model": "string",
3 "callBackUrl": "string (optional)",
4 "channel": "auto",
5 "input": {
6 // Input parameters based on form configuration
7 }
8}modelErforderlichstringDer für die Generierung zu verwendende Modellname
"kling/avatar-v2"
callBackUrlOptionalstringCallback-URL für Benachrichtigungen zum Abschluss der Aufgabe.
"https://your-domain.com/api/callback"
channelOptionalstringSie können den entsprechenden Anbieter innerhalb von APIPASS über den Parameter channel angeben; diese Anbieter übernehmen die eigentlichen Bild- und Videogenerierungsaufgaben. APIPASS bietet derzeit drei Anbieteroptionen:
Der Standardwert für den Parameter channel ist auto. Wenn aktiviert, verteilt APIPASS Aufgaben automatisch auf verfügbare Anbieter basierend auf Echtzeitpreisen und Stabilitätsmetriken, um minimale Kosten und zuverlässige Leistung auszubalancieren. Behalten Sie den Standardwert auto bei, sofern Sie keine benutzerdefinierten Routing-Anforderungen haben.
Verfügbare Optionen:
auto
Das input-Objekt enthält die folgenden Parameter basierend auf der Formularkonfiguration:
input.imageErforderlichstring (URL)URL des Avatar-Referenzbilds. Das Foto muss Kopf, Schultern und Oberkörper der Person deutlich zeigen.
Akzeptierte Formate: .jpg/.jpeg/.png; Maximale Größe: 10MB; Mindestabmessung: 300px; Seitenverhältnis: 1:2.5 bis 2.5:1
"https://example.com/avatar-image.jpg"
input.audioErforderlichstring (URL)URL der Audiodatei für Lip-Sync und Avatar-Animation.
Akzeptierte Formate: .mp3/.wav/.m4a/.aac; Maximale Größe: 5MB
"https://example.com/speech-audio.mp3"
input.promptOptionalstringText-Prompt zur Definition der Aktionen, Ausdrücke und Kamerabewegungen des Avatars.
Maximale Länge: 2500 Zeichen
"A professional spokesperson delivering a speech with confident gestures"
input.modeOptionalstringVideogenerierungsmodus. Standard ist 'std'.
Verfügbare Optionen:
"std"
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Content-Type: application/json" \
3 -H "Authorization: Bearer YOUR_API_KEY" \
4 -d '{
5 "model": "kling/avatar-v2",
6 "callBackUrl": "https://your-domain.com/api/callback",
7 "input": {
8 "image": "https://example.com/avatar-image.jpg",
9 "audio": "https://example.com/speech-audio.mp3",
10 "prompt": "A professional spokesperson delivering a speech with confident gestures",
11 "mode": "std"
12 }
13 }'1{
2 "code": 200,
3 "message": "success",
4 "data": {
5 "taskId": "task_12345678"
6 }
7}codeStatuscode, 200 für Erfolg, andere Werte für Fehler
messageAntwortnachricht, Fehlerbeschreibung bei Fehlschlag
data.taskIdAufgaben-ID zum Abfragen des Aufgabenstatus

ByteDance
ByteDance
Ab
0 Credits
ByteDance
ByteDance
Ab
0 Credits
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
Ab
0 Credits
MiniMax
MiniMax
Ab
0 Credits
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
Ab
0 Credits
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
Ab
0 Credits
wan
wan
Ab
0 Credits
Runway
Runway
Ab
0 Credits
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
Ab
0 Credits
ByteDance
ByteDance
Generate realistic human animation videos by combining a portrait image with audio, producing natural lip-sync, facial expressions, and body movements.
Ab
0 Credits
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
Ab
0 Credits
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
Ab
0 Credits
Kling
Kling
Ab
0 Credits
Luma
Luma
Ab
0 Credits
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
Ab
0 Credits
Ab
0 Credits
kling
kling
Ab
0 Credits