Noch keine Ausgabe. Senden Sie das Formular ab, um Inhalte zu generieren.
Vollständige Anleitung zur Verwendung von Gemini Omni
Verwandeln Sie ein Referenzbild und eine kurze Beschreibung in einen wiederverwendbaren KI-Charakter, den Sie in jede Gemini Omni-Videogenerierung auf ApiPass einbinden können.

Gemini Omni Character auf ApiPass ermöglicht es Ihnen, aus einer kurzen Beschreibung und einem Referenzbild eine wiederverwendbare Charakterressource zu erstellen. Statt einen Charakter bei jedem Aufruf erneut zu beschreiben oder Fotos erneut hochzuladen, registrieren Sie den Charakter einmalig und erhalten eine kompakte Ressource, die Sie in jeder zukünftigen Gemini Omni Video-Anfrage wiederverwenden können — mit demselben API-Schlüssel, den Sie bereits für den restlichen ApiPass-Modellkatalog nutzen.
Registrieren Sie einen Charakter nur ein einziges Mal und referenzieren Sie ihn in jedem zukünftigen Gemini Omni Video-Aufruf — ohne Fotos erneut hochzuladen oder Beschreibungen erneut einzugeben.
Verankern Sie einen Charakter an einem Referenzbild, damit dasselbe Gesicht, derselbe Stil und dieselbe Identität nahtlos von Clip zu Clip und von Szene zu Szene erhalten bleiben.
Charakterressourcen lassen sich nahtlos mit über Gemini Omni Audio erstellten Sprachprofilen kombinieren, sodass ein Charakter über eine ganze Serie oder Kampagne hinweg sowohl ein konsistentes Aussehen als auch eine konsistente Stimme behält.
Jeder erstellte Charakter gibt eine kompakte Ressource zurück, die sich leicht in Ihrer eigenen Datenbank speichern und in der UI Ihres Produkts anzeigen lässt.
Die Charaktererstellung befindet sich in derselben ApiPass-Oberfläche wie Gemini Omni Video und Gemini Omni Audio, sodass Sie durchgängige, charaktergesteuerte Pipelines erstellen können, ohne mehrere Anbieter verwalten zu müssen.
Registrieren Sie einen neuen Charakter aus einem klaren Referenzbild und einer natürlichsprachlichen Beschreibung, die Aussehen, Stil und Persönlichkeit abdeckt.
Geben Sie jedem Charakter beim Erstellen der Ressource einen Namen, damit er in Ihrer eigenen Bibliothek oder UI leicht zu erkennen ist.
Kombinieren Sie einen Charakter mit Sprachprofilen aus Gemini Omni Audio, damit die stimmliche Persona von Anfang an mit dem Charakter verknüpft ist.
Die API gibt eine wiederverwendbare Charakterressource zurück, die an jede Gemini Omni Video-Anfrage angehängt werden kann, um bei Bedarf charakterkonsistente Generierungen zu steuern.
Mehrere registrierte Charaktere können in einer einzigen Gemini Omni Video-Anfrage kombiniert werden, sodass Szenen mit mehr als einem wiederkehrenden Charakter gemeinsam modelltreu bleiben.
Erstellen Sie Ihren KI-Avatar einmalig auf ApiPass und lassen Sie ihn anschließend Ihre Videos für Sie moderieren. Ob Sie einen YouTube-Kanal, eine TikTok-Serie oder einen wöchentlichen Podcast betreiben: Ihr Charakter erscheint in jeder Folge konsistent — dasselbe Gesicht, dieselbe Stimme, dieselbe Ausstrahlung. Kein Kameraaufbau mehr, keine Bad-Hair-Days mehr. Schreiben Sie einfach Ihr Skript und lassen Sie Ihr KI-Ich sprechen.
Ein einzelner freigegebener Charakter, der in Anzeigenvarianten, Produkt-Tutorials und lokalisierten Märkten erscheint und die Markenidentität überall dort konsistent hält, wo er auftritt.
Protagonisten, Sidekicks und Hosts für episodische Kurzform-Inhalte und serialisierte Story-Welten, die von einer Folge zur nächsten stets modelltreu bleiben.
Konsistente Lehrkräfte, Erzähler und Hosts für Kurse, Erklärvideos und Schulungsmodule, sodass sich jede Lektion anfühlt, als würde sie von demselben vertrauten Gesicht vermittelt.
Erstellung episodischer Serien, in denen derselbe Host oder Protagonist zuverlässig in jedem Video erscheinen muss.
Pflege eines markenkonformen Sprechers oder Maskottchens, das in jeder Anzeige, jedem Erklärvideo und jeder lokalisierten Variante im Mittelpunkt steht.
Gestaltung einer konsistenten Dozenten- oder Präsentator-Persona, die ganze Kurskataloge begleitet.
Registrierung wiederkehrender Charaktere, die in Cinematics, Trailern und In-App-Story-Sequenzen auftreten.
Bereitstellung einer „Meine Charaktere“-Bibliothek für Endnutzer, in der sie ihre eigenen KI-Identitäten speichern, verwalten und wiederverwenden können.
Erstellen Sie ein ApiPass-Konto und generieren Sie in Ihrem Dashboard einen API-Schlüssel, um die gesamte Gemini Omni-Familie — Character, Video und Audio — mit einem einzigen Zugangsschlüssel freizuschalten.
Wählen Sie ein klares Referenzbild aus, schreiben Sie eine kurze Beschreibung zu Aussehen und Stil und wählen Sie einen Charakternamen. Optional können Sie den Charakter mit einem Sprachprofil aus Gemini Omni Audio kombinieren, um eine vollständig ausgearbeitete Identität zu schaffen.
Rufen Sie Gemini Omni Character auf, um den Charakter zu registrieren, und hängen Sie ihn anschließend an jede zukünftige Gemini Omni Video-Anfrage an, um konsistente, charaktergesteuerte Videos in großem Maßstab zu generieren.
Alle APIs erfordern eine Authentifizierung über Bearer Token.
Authorization: Bearer
Create a reusable Gemini Omni character resource from a character description and one public reference image. The returned characterId can be used as a character_ids value with google/gemini-omni-video.
1{
2 "model": "google/gemini-omni-character",
3 "channel": "auto",
4 "input": {
5 "descriptions": "A young female character with short silver hair, a black futuristic utility jacket, calm expression, agile posture, and a clean cyberpunk visual style.",
6 "image_urls": [
7 "https://cdn.apipass.dev/apipass/results/task_78514b0d12c44ad4_0.png"
8 ],
9 "character_name": "Jenny"
10 }
11}modelErforderlichstringModel endpoint name. Use google/gemini-omni-character for this endpoint.
google/gemini-omni-character
channelOptionalstringDefault channel is auto. APIPASS automatically allocates tasks across available providers based on real-time pricing and stability metrics; starter is ultra-low-cost with limited quotas and weaker stability; regular is standard and much cheaper than official APIs with moderate stability; official uses the model native API with high stability, fast task execution, and official pricing.
Default channel is auto. APIPASS automatically allocates tasks across available providers based on real-time pricing and stability metrics. starter is ultra-low-cost with limited quotas and weaker stability. regular is standard and much cheaper than official APIs with moderate stability. official uses the model native API with high stability, fast task execution, and official pricing.
Verfügbare Optionen:
auto
callBackUrlOptionalstringOptional callback URL for receiving task result updates. For this model, callback behavior depends on the adapter implementation.
https://example.com/callback
descriptionsErforderlichstringCharacter description used to define the appearance, identity, style, clothing, or personality of the character.
Use the plural field name descriptions. The official schema requires descriptions and image_urls; although some examples may show description, descriptions is the recommended field name.
A young female character with short silver hair and a futuristic utility jacket, calm, agile, and strongly cyberpunk in style.
image_urlsErforderlicharray<string>Array of public character reference image URLs. Only 1 image is supported, and each image must be no larger than 20MB.
The image URL must be publicly accessible by the upstream service. Maximum items: 1.
[ "https://cdn.apipass.dev/apipass/results/task_78514b0d12c44ad4_0.png" ]
audio_idsOptionalarray<string>Array of audio IDs generated by the google/gemini-omni-audio endpoint. These can provide voice traits, tone, or persona guidance for the character.
audio_ids must come from the corresponding KIE gemini-omni-audio resource.
[ "audio_xxx" ]
character_nameOptionalstringCharacter name.
Jenny
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Authorization: Bearer YOUR_API_KEY" \
3 -H "Content-Type: application/json" \
4 -d '{
5 "model": "google/gemini-omni-character",
6 "channel": "auto",
7 "input": {
8 "descriptions": "A young female character with short silver hair, a black futuristic utility jacket, calm expression, agile posture, and a clean cyberpunk visual style.",
9 "image_urls": [
10 "https://cdn.apipass.dev/apipass/results/task_78514b0d12c44ad4_0.png"
11 ],
12 "character_name": "Jenny"
13 }
14}'1{
2 "code": 200,
3 "msg": "success",
4 "data": {
5 "characterId": "b09dbf56...",
6 "characterName": "Jenny",
7 "imageUrl": "https://xx.com/a.png"
8 }
9}codeResponse status code. 200 indicates a successful upstream character creation response.
msgResponse message.
dataCreated character resource information.
data.characterIdGenerated character ID. Use this value in google/gemini-omni-video input.character_ids when generating videos with this character.
data.characterNameCharacter name returned by the provider.
data.imageUrlURL of the character reference or generated character image returned by the provider.

ByteDance
ByteDance
Ab
0 Credits
ByteDance
ByteDance
Ab
0 Credits
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
Ab
0 Credits
MiniMax
MiniMax
Ab
0 Credits
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
Ab
0 Credits
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
Ab
0 Credits
wan
wan
Ab
0 Credits
Runway
Runway
Ab
0 Credits
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
Ab
0 Credits
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
Ab
0 Credits
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
Ab
0 Credits
Luma
Luma
Ab
0 Credits
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
Ab
0 Credits
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
Ab
0 Credits
grok
grok
Ab
0 Credits
kling
kling
Ab
0 Credits