Aucune sortie pour le moment. Envoyez le formulaire pour générer du contenu.
Guide complet d'utilisation de Gemini Omni
Transformez une image de référence et une courte description en un personnage IA réutilisable que vous pouvez intégrer à chaque génération vidéo Gemini Omni sur ApiPass.

Gemini Omni Character sur ApiPass vous permet de créer une ressource de personnage réutilisable à partir d’une courte description et d’une image de référence. Au lieu de redécrire un personnage ou de téléverser à nouveau des photos à chaque appel, vous enregistrez le personnage une seule fois et recevez une ressource compacte que vous pouvez réutiliser dans toute future requête Gemini Omni Video — avec la même clé API que vous utilisez déjà pour le reste du catalogue de modèles ApiPass.
Enregistrez un personnage une seule fois et référencez-le dans chaque futur appel Gemini Omni Video — sans téléverser à nouveau de photos ni ressaisir de descriptions.
Ancrez un personnage à une image de référence afin que le même visage, le même style et la même identité se transmettent proprement d’un clip à l’autre et d’une scène à l’autre.
Les ressources de personnage s’associent naturellement aux profils vocaux créés via Gemini Omni Audio, afin qu’un personnage conserve à la fois une apparence cohérente et une voix cohérente tout au long d’une série ou d’une campagne.
Chaque personnage créé renvoie une ressource compacte, facile à conserver dans votre propre base de données et à afficher dans l’interface de votre produit.
La création de personnages fait partie de la même interface ApiPass que Gemini Omni Video et Gemini Omni Audio, ce qui vous permet de construire des pipelines de bout en bout centrés sur les personnages sans jongler entre plusieurs fournisseurs.
Enregistrez un nouveau personnage à partir d’une image de référence claire et d’une description en langage naturel couvrant l’apparence, le style et la personnalité.
Attribuez un nom à chaque personnage lors de la création de la ressource afin de l’identifier facilement dans votre propre bibliothèque ou interface.
Associez un personnage à des profils vocaux de Gemini Omni Audio afin que sa personnalité vocale soit liée au personnage dès le départ.
L’API renvoie une ressource de personnage réutilisable qui peut être attachée à n’importe quelle requête Gemini Omni Video pour générer à la demande des contenus cohérents avec le personnage.
Plusieurs personnages enregistrés peuvent être combinés dans une seule requête Gemini Omni Video, afin que les scènes avec plusieurs personnages récurrents restent cohérentes avec leur modèle respectif.
Créez votre avatar IA une fois sur ApiPass, puis laissez-le animer vos vidéos pour vous. Que vous gériez une chaîne YouTube, une série TikTok ou un podcast hebdomadaire, votre personnage apparaît de manière cohérente dans chaque épisode — même visage, même voix, même ambiance. Plus besoin d’installer des caméras, fini les mauvais jours capillaires. Écrivez simplement votre script et laissez votre double IA parler à votre place.
Un seul personnage approuvé qui apparaît dans les variantes publicitaires, les tutoriels produit et les marchés localisés, en préservant l’identité de marque partout où il est présent.
Protagonistes, acolytes et animateurs pour des contenus courts épisodiques et des univers narratifs sérialisés, qui restent tous fidèles au modèle d’un épisode à l’autre.
Des enseignants, narrateurs et animateurs cohérents pour les cours, les vidéos explicatives et les modules de formation, afin que chaque leçon semble délivrée par le même visage familier.
Créer des séries épisodiques où le même animateur ou protagoniste doit apparaître de manière fiable dans chaque vidéo.
Maintenir un porte-parole ou une mascotte conforme à la marque, présent dans chaque publicité, vidéo explicative et variante localisée.
Concevoir une persona d’instructeur ou de présentateur cohérente qui incarne l’ensemble des catalogues de cours.
Enregistrer des personnages récurrents qui apparaissent dans les cinématiques, bandes-annonces et séquences narratives intégrées à l’application.
Proposer aux utilisateurs finaux une bibliothèque "My Characters" pour enregistrer, gérer et réutiliser leurs propres identités IA.
Créez un compte ApiPass et générez une clé API depuis votre tableau de bord pour accéder à toute la famille Gemini Omni — character, video et audio — avec un seul identifiant.
Choisissez une image de référence claire, rédigez une courte description couvrant l’apparence et le style, puis choisissez un nom de personnage. Vous pouvez aussi associer le personnage à un profil vocal de Gemini Omni Audio pour créer une identité pleinement aboutie.
Appelez Gemini Omni Character pour enregistrer le personnage, puis attachez-le à toute future requête Gemini Omni Video afin de générer à grande échelle des vidéos cohérentes centrées sur ce personnage.
Toutes les API nécessitent une authentification via un token Bearer.
Authorization: Bearer
Create a reusable Gemini Omni character resource from a character description and one public reference image. The returned characterId can be used as a character_ids value with google/gemini-omni-video.
1{
2 "model": "google/gemini-omni-character",
3 "channel": "auto",
4 "input": {
5 "descriptions": "A young female character with short silver hair, a black futuristic utility jacket, calm expression, agile posture, and a clean cyberpunk visual style.",
6 "image_urls": [
7 "https://cdn.apipass.dev/apipass/results/task_78514b0d12c44ad4_0.png"
8 ],
9 "character_name": "Jenny"
10 }
11}modelRequisstringModel endpoint name. Use google/gemini-omni-character for this endpoint.
google/gemini-omni-character
channelOptionnelstringDefault channel is auto. APIPASS automatically allocates tasks across available providers based on real-time pricing and stability metrics; starter is ultra-low-cost with limited quotas and weaker stability; regular is standard and much cheaper than official APIs with moderate stability; official uses the model native API with high stability, fast task execution, and official pricing.
Default channel is auto. APIPASS automatically allocates tasks across available providers based on real-time pricing and stability metrics. starter is ultra-low-cost with limited quotas and weaker stability. regular is standard and much cheaper than official APIs with moderate stability. official uses the model native API with high stability, fast task execution, and official pricing.
Options disponibles :
auto
callBackUrlOptionnelstringOptional callback URL for receiving task result updates. For this model, callback behavior depends on the adapter implementation.
https://example.com/callback
descriptionsRequisstringCharacter description used to define the appearance, identity, style, clothing, or personality of the character.
Use the plural field name descriptions. The official schema requires descriptions and image_urls; although some examples may show description, descriptions is the recommended field name.
A young female character with short silver hair and a futuristic utility jacket, calm, agile, and strongly cyberpunk in style.
image_urlsRequisarray<string>Array of public character reference image URLs. Only 1 image is supported, and each image must be no larger than 20MB.
The image URL must be publicly accessible by the upstream service. Maximum items: 1.
[ "https://cdn.apipass.dev/apipass/results/task_78514b0d12c44ad4_0.png" ]
audio_idsOptionnelarray<string>Array of audio IDs generated by the google/gemini-omni-audio endpoint. These can provide voice traits, tone, or persona guidance for the character.
audio_ids must come from the corresponding KIE gemini-omni-audio resource.
[ "audio_xxx" ]
character_nameOptionnelstringCharacter name.
Jenny
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Authorization: Bearer YOUR_API_KEY" \
3 -H "Content-Type: application/json" \
4 -d '{
5 "model": "google/gemini-omni-character",
6 "channel": "auto",
7 "input": {
8 "descriptions": "A young female character with short silver hair, a black futuristic utility jacket, calm expression, agile posture, and a clean cyberpunk visual style.",
9 "image_urls": [
10 "https://cdn.apipass.dev/apipass/results/task_78514b0d12c44ad4_0.png"
11 ],
12 "character_name": "Jenny"
13 }
14}'1{
2 "code": 200,
3 "msg": "success",
4 "data": {
5 "characterId": "b09dbf56...",
6 "characterName": "Jenny",
7 "imageUrl": "https://xx.com/a.png"
8 }
9}codeResponse status code. 200 indicates a successful upstream character creation response.
msgResponse message.
dataCreated character resource information.
data.characterIdGenerated character ID. Use this value in google/gemini-omni-video input.character_ids when generating videos with this character.
data.characterNameCharacter name returned by the provider.
data.imageUrlURL of the character reference or generated character image returned by the provider.

ByteDance
ByteDance
À partir de
0 crédits
ByteDance
ByteDance
À partir de
0 crédits
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
À partir de
0 crédits
MiniMax
MiniMax
À partir de
0 crédits
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
À partir de
0 crédits
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
À partir de
0 crédits
wan
wan
À partir de
0 crédits
Runway
Runway
À partir de
0 crédits
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
À partir de
0 crédits
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
À partir de
0 crédits
grok
grok
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
À partir de
0 crédits
Luma
Luma
À partir de
0 crédits
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
À partir de
0 crédits
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
À partir de
0 crédits
grok
grok
À partir de
0 crédits
kling
kling
À partir de
0 crédits