Grok Imagine Video 1.5
Modèle vidéo actuel de SpaceXAI pour transformer du texte, des images ou des références en courts clips avec voix et son générés en option.
Modèle vidéo actuel de SpaceXAI pour transformer du texte, des images ou des références en courts clips avec voix et son générés en option.
Présentation de l'anglais simple
Le Grok Imagine Video 1.5 crée des clips d'une durée d'une à quinze secondes et peut produire des vidéos jusqu'à 1080p. Il prend en charge la conversion texte-vidéo, l'animation d'images, la génération basée sur des références, l'édition et les voix prédéfinies, ce qui en fait un point de terminaison multimédia étendu pour les équipes utilisant déjà l'API Grok.
Les requêtes s'exécutent de manière asynchrone et les prix augmentent avec la résolution du résultat. Le modèle peut générer du son avec la vidéo ou renvoyer un clip silencieux lorsque l'audio n'est pas nécessaire.
Comparaison des catégories
Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.
Tarifs et comparaisons
Indiquez votre utilisation. L’estimation se met à jour à chaque modification.
Exemple : clips de 8 secondes en 720p avec audio. Aucun prix estimé pour les modèles incompatibles avec ces paramètres.
Grok Imagine Video 1.5
SpaceXAI
Total estimé (USD)
Pour l’utilisation indiquée · USD · Tarif API, hors abonnement
Les estimations excluent taxes, outils, stockage/écriture du cache, quotas gratuits et remises personnalisées. Pour les images, seule la sortie est incluse, pas le prompt ni les références. Les modes de qualité varient. Un paramètre non répertorié n’est pas gratuit.
Accès API et fournisseur
Disponibilité
Généralement disponible via l'API Imagine SpaceXAI avec prise en charge par lots.
La page modèle répertorie us-east-1 et us-west-2. Les URL de sortie sont temporaires et doivent être enregistrées rapidement.
Vérifier la disponibilité en directDonnées et formation
SpaceXAI indique que les entrées et sorties de l'API ne sont pas utilisées pour la formation sans autorisation explicite. La conservation chiffrée par défaut est de 30 jours ; La conservation zéro des données au niveau de l’équipe est disponible avec des compromis en termes de fonctionnalités.
Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.
Lire la politique du fournisseurQuestions fréquemment posées
Modèle vidéo actuel de SpaceXAI pour transformer du texte, des images ou des références en courts clips avec voix et son générés en option. Le Grok Imagine Video 1.5 crée des clips d'une durée d'une à quinze secondes et peut produire des vidéos jusqu'à 1080p. Il prend en charge la conversion texte-vidéo, l'animation d'images, la génération basée sur des références, l'édition et les voix prédéfinies, ce qui en fait un point de terminaison multimédia étendu pour les équipes utilisant déjà l'API Grok.
Grok Imagine Video 1.5 a été publié sur 16 juin 2026 selon les documents du fournisseur cités.
Généralement disponible via l'API Imagine SpaceXAI avec prise en charge par lots. Les voies d'accès répertoriées dans ce guide sont SpaceXAI.
0,08 $ à 0,25 $/seconde générée. SpaceXAI indique 0,08 $/s à 480p, 0,14 $/s à 720p et 0,25 $/s à 1080p. Une image d'entrée ajoute 0,01 $ ; L'entrée audio vocale prédéfinie est gratuite.
Généralement disponible via l'API Imagine SpaceXAI avec prise en charge par lots. La page modèle répertorie us-east-1 et us-west-2. Les URL de sortie sont temporaires et doivent être enregistrées rapidement.
SpaceXAI indique que les entrées et sorties de l'API ne sont pas utilisées pour la formation sans autorisation explicite. La conservation chiffrée par défaut est de 30 jours ; La conservation zéro des données au niveau de l’équipe est disponible avec des compromis en termes de fonctionnalités. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.
Comparaisons associées
L'ancien modèle audio-vidéo synchronisé de OpenAI pour les courts clips guidés par du texte ou des images, toujours documenté, mais sur le point d'un arrêt permanent de l'API.
Ouvrir la comparaison complèteModèle vidéo d'aperçu du Google pour la génération guidée de texte, d'images et de vidéo avec des options audio et de sortie natives jusqu'à 4K.
Ouvrir la comparaison complèteVariante Veo 3.1 moins coûteuse du Google pour créer rapidement de courts clips vidéo avec des options audio natives et de sortie jusqu'à 4K.
Ouvrir la comparaison complèteLe modèle vidéo de développement phare de Runway pour les clips guidés par texte et par image, avec des formats professionnels et un taux de base de crédit par seconde prévisible.
Ouvrir la comparaison complèteModèle vidéo Pro de Kuaishou fourni via fal pour la génération de texte/image multi-prises, audio natif en option, références et clips jusqu'à 15 secondes.
Ouvrir la comparaison complèteUn modèle Kling économique sur fal pour des clips fluides de cinq ou dix secondes générés à partir de texte ou d'une image de départ.
Ouvrir la comparaison complèteLe modèle audiovisuel actuel de ByteDance pour des clips cohérents jusqu'à 30 secondes, avec un son natif, une narration longue, des références riches et un montage ciblé.
Ouvrir la comparaison complèteFamille vidéo unifiée Alibaba pour créer de courts clips avec du son à partir de texte, d'une image de départ ou d'une vidéo de référence.
Ouvrir la comparaison complèteModèle vidéo Lightricks axé sur la qualité pour créer des clips 720p ou 1080p à partir de texte, d'images ou d'audio avec un son natif.
Ouvrir la comparaison complèteModèle vidéo à vitesse optimisée du LTX pour l'entrée de texte, d'image ou audio, le son natif, la durée automatique et la sortie jusqu'à 4K.
Ouvrir la comparaison complèteModèle vidéo de flux de travail complet et mature de LTX pour la génération, avec reprise, extension, recadrage, audio natif et contrôle de la première à la dernière image.
Ouvrir la comparaison complète