Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
Grok Imagine is xAI’s AI video generation model for creating high-quality videos with realistic motion, native audio, and synchronized speech. Grok Imagine 1.5 introduces faster generation speeds, improved motion physics, and stronger visual consistency for modern AI video applications.
Aucune vidéo pour le moment. Envoyez le formulaire pour générer une vidéo.
Explorez différents cas d'utilisation et configurations de paramètres
Tarifs transparents sans frais cachés. Payez à l'utilisation.
| Règle & Modalité | Channel | Crédits | Prix (USD) | Prix officiel / référence | Économie quotidienne |
|---|---|---|---|---|---|
grok- imagine-text-to-video-480p videogrokresolution: 480p | Starter | 0.2per second | $0.001 | - | - |
grok- imagine-text-to-video-720p videogrokresolution: 720p | Starter | 0.7per second | $0.003 | - | - |
Le prix concurrent coûte $409.090/jour de plus
ApiPass est 81.82% moins cher, estimé sur Basé sur 1,000 vidéos de 10 secondes/jour
grok- imagine-text-to-video-480p
resolution: 480p
Prix ApiPass
$0.009
2 crédits per second
Prix concurrents
Guide complet d'utilisation de grok-imagine
Transformez des prompts textuels en courtes vidéos cinématographiques via la plateforme proxy ApiPass. Intégrez facilement le modèle grok-imagine de xAI pour générer des vidéos avec des mouvements cohérents, une continuité de scène et un contrôle complet des formats d’image, durées, résolutions et modes créatifs. Conçue pour la montée en charge en production, la passerelle API asynchrone ApiPass simplifie votre workflow : créez une tâche pour recevoir un taskId, puis récupérez rapidement les résultats via des webhooks de rappel automatisés ou par interrogation de statut.

La fonctionnalité Grok Imagine de texte vers vidéo, accessible via la marketplace API d’ApiPass, convertit instantanément des prompts en langage naturel en clips vidéo IA cinématographiques. Propulsé par le modèle génératif avancé de xAI, cet endpoint API est relayé via ApiPass pour le prototypage rapide de concepts, la génération automatisée de contenus courts et les workflows de création vidéo en entreprise. Les développeurs peuvent définir par programme des mouvements de sujets complexes, des environnements riches, des mouvements de caméra précis et le timing des scènes.
Transformez instantanément des prompts textuels détaillés en clips vidéo IA cinématographiques via le modèle Grok Imagine. Décrivez vos sujets, l’environnement, le travail de caméra et l’ambiance : le pipeline Grok sous-jacent se charge du rendu et fournit une tâche traçable optimisée pour les workflows de production via ApiPass.
Choisissez parmi les modes natifs fun, normal ou spicy de Grok pour contrôler la manière dont le modèle interprète le mouvement et l’énergie visuelle. fun offre une interprétation plus créative et ludique, normal fournit une qualité de mouvement équilibrée, et spicy crée des effets de mouvement plus dynamiques et intenses.
La plateforme ApiPass fournit un workflow de tâches asynchrones pour le modèle Grok. Envoyez une requête à l’endpoint ApiPass /api/v1/jobs/createTask, stockez le taskId retourné, puis interrogez /api/v1/jobs/recordInfo ou fournissez callBackUrl pour recevoir des notifications automatiques de fin de traitement.
Transformez des descriptions textuelles en vidéos cinématographiques en spécifiant les actions, les mouvements de caméra et la dynamique de la scène. Des prompts détaillés guident directement le pipeline grok-imagine pour capturer avec précision votre rythme visuel, votre séquence et votre timing.
Adaptez l’intensité du mouvement au ton de votre projet. L’API Grok Imagine propose trois modes de génération distincts : Normal pour des sorties stables et équilibrées ; Fun pour des interprétations ludiques et imaginatives ; et Spicy pour des effets d’action très dynamiques et expressifs.
Créez des clips en format portrait, paysage, carré, widescreen ou vertical haut. Définissez une durée de 6 à 30 secondes et choisissez une résolution 480p ou 720p pour répondre à vos besoins de prototype, d’aperçu ou de production.
Créez rapidement des clips animés partageables à partir de prompts textuels simples. Utilisez des formats verticaux comme 9:16 pour des contenus pensés d’abord pour le mobile, ou des formats widescreen comme 16:9 pour des publicités, des aperçus et des visuels de landing page.
Intégrez les vidéos générées dans des plateformes de développement ou des solutions logicielles pour des bannières dynamiques, des aperçus animés, des arrière-plans d’assets automatisés et des outils créatifs interactifs qui s’adaptent par programme aux prompts des utilisateurs.
Testez rapidement des concepts visuels, des mouvements de personnages, des transitions de scènes et des idées de caméra avant de passer à la production complète. Le workflow API asynchrone rend pratique l’automatisation de lots d’expériences de prompts.
Configurez les paramètres natifs de l’API Grok Imagine afin d’optimiser le style de mouvement, le cadrage et la vitesse de traitement pour votre pipeline de production.
Utilisez normal pour des résultats équilibrés, fun pour des mouvements ludiques et imaginatifs, et spicy pour des mouvements plus intenses, énergiques ou expressifs. Le paramètre mode prend par défaut la valeur normal lorsqu’il est omis.
Choisissez 2:3 pour le portrait, 3:2 pour le paysage, 1:1 pour le carré, 16:9 pour le widescreen ou 9:16 pour du contenu vertical haut. duration accepte des valeurs entières de 6 à 30 secondes avec un pas de 1.
Utilisez 480p pour des aperçus plus rapides et 720p lorsque vous avez besoin d’une sortie Grok en plus haute résolution. Pour les intégrations en production, fournissez callBackUrl afin que la passerelle proxy ApiPass puisse notifier votre service lorsque la tâche asynchrone est terminée.
Les nouveaux utilisateurs d’ApiPass peuvent tester les workflows de génération pris en charge avec des crédits gratuits, ce qui facilite l’évaluation du comportement des prompts, de la qualité du mouvement, des formats d’image, des modes et du flux d’intégration avant la montée en charge.
Le paramètre facultatif channel prend en charge auto, starter, regular et official. auto permet à ApiPass de répartir les tâches entre les canaux disponibles selon les tarifs et les métriques de stabilité en temps réel.
Chaque requête crée une tâche de génération et retourne un taskId. Cette conception rend les générations longues plus fiables et permet aux développeurs de consulter la progression ou de recevoir des callbacks de fin de traitement sans bloquer les workflows applicatifs.
Ouvrez le playground ApiPass, saisissez un prompt détaillé et testez les paramètres pris en charge tels que aspect_ratio, mode, duration et resolution. Commencez avec les valeurs par défaut : aspect_ratio 2:3, mode normal, duration 6 et resolution 480p.
Envoyez une requête POST à /api/v1/jobs/createTask avec model défini sur grok-imagine/text-to-video et votre objet input. Incluez callBackUrl pour les systèmes de production qui doivent recevoir des notifications automatiques de fin de traitement.
Utilisez le taskId retourné pour interroger /api/v1/jobs/recordInfo lorsque le polling est acceptable, ou appuyez-vous sur les notifications de callback lorsque callBackUrl est configuré. Lorsque la tâche réussit, le résultat contient la sortie vidéo générée.
Toutes les API nécessitent une authentification via un token Bearer.
Authorization: Bearer
Créez une tâche asynchrone de génération Grok Imagine de texte vers vidéo à partir d’un prompt textuel.
1{
2 "model": "grok-imagine/text-to-video",
3 "channel": "auto",
4 "callBackUrl": "https://your-domain.com/api/callback",
5 "input": {
6 "prompt": "A couple of doors open to the right one by one randomly and stay open, to show the inside, each is either a living room, or a kitchen, or a bedroom or an office, with little people living inside.",
7 "aspect_ratio": "2:3",
8 "mode": "normal",
9 "duration": 6,
10 "resolution": "480p"
11 }
12}modelRequisstringNom de l’endpoint du modèle. Utilisez grok-imagine/text-to-video pour cette API.
grok-imagine/text-to-video
channelOptionnelstringLe channel par défaut est auto. APIPASS répartit automatiquement les tâches entre les fournisseurs disponibles en fonction des tarifs en temps réel et des métriques de stabilité ; starter est à très faible coût, avec des quotas limités et une stabilité moindre ; regular est standard et beaucoup moins cher que les API officielles, avec une stabilité modérée ; official utilise l’API native du modèle, avec une stabilité élevée, une exécution rapide des tâches et la tarification officielle.
Le channel par défaut est auto. APIPASS répartit automatiquement les tâches entre les fournisseurs disponibles en fonction des tarifs en temps réel et des métriques de stabilité ; starter est à très faible coût, avec des quotas limités et une stabilité moindre ; regular est standard et beaucoup moins cher que les API officielles, avec une stabilité modérée ; official utilise l’API native du modèle, avec une stabilité élevée, une exécution rapide des tâches et la tarification officielle.
Options disponibles :
auto
callBackUrlOptionnelstringURL de callback facultative pour recevoir automatiquement les notifications de fin de tâche. Pour une utilisation en production, il est recommandé d’utiliser les notifications de callback plutôt que d’interroger l’endpoint de requête.
https://your-domain.com/api/callback
promptRequisstringPrompt textuel décrivant le mouvement vidéo souhaité. Soyez détaillé et précis concernant les visuels souhaités, le mouvement, la séquence d’actions, le travail de caméra, le timing, les sujets, les environnements et la dynamique du mouvement. Longueur maximale : 5000 caractères. Les prompts en anglais sont pris en charge.
Obligatoire. Décrivez clairement le mouvement, les actions, les mouvements de caméra et la dynamique de la scène pour obtenir de meilleurs résultats.
A couple of doors open to the right one by one randomly and stay open, to show the inside, each is either a living room, or a kitchen, or a bedroom or an office, with little people living inside.
aspect_ratioOptionnelstringSpécifie le rapport largeur/hauteur de la vidéo générée. Par défaut : 2:3.
2:3 correspond au format portrait, 3:2 au format paysage, 1:1 au format carré, 16:9 au format écran large et 9:16 au format vertical haut.
Options disponibles :
2:3
modeOptionnelstringMode de génération qui influence le style et l’intensité du mouvement. Par défaut : normal.
fun donne une interprétation plus créative et ludique ; normal fournit une approche équilibrée avec une bonne qualité de mouvement ; spicy produit des effets de mouvement plus dynamiques et intenses.
Options disponibles :
normal
durationOptionnelnumberDurée de la vidéo générée en secondes. Minimum : 6, maximum : 30, pas : 1.
Utilisez une valeur entière comprise entre 6 et 30.
6
resolutionOptionnelstringRésolution de la vidéo générée. Par défaut : 480p.
Options disponibles :
480p
1curl -X POST "https://api.apipass.dev/api/v1/jobs/createTask" \
2 -H "Authorization: Bearer YOUR_API_KEY" \
3 -H "Content-Type: application/json" \
4 -d '{
5 "model": "grok-imagine/text-to-video",
6 "channel": "auto",
7 "callBackUrl": "https://your-domain.com/api/callback",
8 "input": {
9 "aspect_ratio": "2:3",
10 "mode": "normal",
11 "duration": 6,
12 "resolution": "480p",
13 "prompt": "A couple of doors open to the right one by one randomly and stay open, to show the inside, each is either a living room, or a kitchen, or a bedroom or an office, with little people living inside."
14 }
15}'1{
2 "taskId": "task_44e091a72fa8424b",
3 "status": "queued"
4}taskIdIdentifiant unique de la tâche. Utilisez cette valeur pour interroger le statut et les résultats de la tâche.
statusStatut actuel de la tâche après sa création.

ByteDance
ByteDance
À partir de
0 crédits
ByteDance
ByteDance
À partir de
0 crédits
ByteDance
ByteDance
Turn text, images, video clips, and audio into cinematic, audio-synced videos with a single API call.
À partir de
0 crédits
MiniMax
MiniMax
À partir de
0 crédits
ByteDance
ByteDance
Generate cinematic 4K AI videos up to 30 seconds with Seedance 2.5's multimodal power.
À partir de
0 crédits
Google Veo 3.1 is the latest state-of-the-art generative video model designed to transform text and image prompts into high-fidelity cinematic visuals. Building upon its predecessors, Veo 3.1 features significant upgrades in prompt adherence, visual realism, and native audio generation, creating 8-second clips with synchronized sound effects and dialogue.
À partir de
0 crédits
wan
wan
À partir de
0 crédits
Runway
Runway
À partir de
0 crédits
Kling
Kling
Transform text prompts and images into high-quality videos with advanced AI. Generate cinematic content with customizable duration, aspect ratio, and audio capabilities.
À partir de
0 crédits
MiniMax
MiniMax
Generate high-quality AI videos from text prompts or images with MiniMax's Hailuo 2.3 model. Support for both 6s and 10s durations, 768p and 1080p resolutions, with intelligent prompt optimization.
À partir de
0 crédits
Luma
Luma
À partir de
0 crédits
Kling
Kling
Kling v3 video generation model, supports text-to-video and image-to-video, up to 15 seconds, 1080p pro mode
À partir de
0 crédits
wan
wan
Generate videos with cinematic consistency by reimagining existing footage through high-fidelity visual transformation and structural control.
À partir de
0 crédits
À partir de
0 crédits
grok
grok
À partir de
0 crédits
kling
kling
À partir de
0 crédits