Grok Imagine Video 1.5
El modelo de vídeo actual de SpaceXAI para convertir texto, imágenes o referencias en clips cortos con voz y sonido generados opcionalmente.
El modelo de vídeo actual de SpaceXAI para convertir texto, imágenes o referencias en clips cortos con voz y sonido generados opcionalmente.
Descripción general en inglés sencillo
Grok Imagine Video 1.5 crea clips de uno a quince segundos de duración y puede producir vídeos de hasta 1080p. Admite conversión de texto a video, animación de imágenes, generación basada en referencias, edición y voces preestablecidas, lo que lo convierte en un punto final de medios amplio para los equipos que ya utilizan la API de Grok.
Las solicitudes se ejecutan de forma asincrónica y los precios aumentan con la resolución de salida. El modelo puede generar sonido con el vídeo o devolver un clip silencioso cuando no se necesita audio.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Precios y comparaciones
Indica tu uso. La estimación se actualiza al escribir.
Ejemplo: clips de 8 segundos a 720p con audio. Los modelos incompatibles con estos ajustes no tendrán estimación.
Grok Imagine Video 1.5
SpaceXAI
Total estimado (USD)
Para el uso indicado · USD · Precio de API, no de suscripción
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
Acceso a API y proveedores
Disponibilidad
Generalmente disponible a través de la API Imagine SpaceXAI con soporte por lotes.
La página del modelo enumera us-east-1 y us-west-2. Las URL de salida son temporales y deben guardarse lo antes posible.
Consultar disponibilidad en vivoDatos y entrenamiento
SpaceXAI dice que las entradas y salidas de la API no se utilizan para la capacitación sin un permiso explícito. La retención cifrada predeterminada es de 30 días; La retención de datos cero a nivel de equipo está disponible con compensaciones de funciones.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
El modelo de vídeo actual de SpaceXAI para convertir texto, imágenes o referencias en clips cortos con voz y sonido generados opcionalmente. Grok Imagine Video 1.5 crea clips de uno a quince segundos de duración y puede producir vídeos de hasta 1080p. Admite conversión de texto a video, animación de imágenes, generación basada en referencias, edición y voces preestablecidas, lo que lo convierte en un punto final de medios amplio para los equipos que ya utilizan la API de Grok.
Grok Imagine Video 1.5 se lanzó en 16 de junio de 2026 según los materiales del proveedor citados.
Generalmente disponible a través de la API Imagine SpaceXAI con soporte por lotes. Las rutas de acceso enumeradas en esta guía son SpaceXAI.
$0.08–$0.25 / segundo generado. SpaceXAI lista $0.08/s a 480p, $0.14/s a 720p y $0.25/s a 1080p. Una imagen de entrada agrega $0,01; La entrada de audio de voz preestablecida es gratuita.
Generalmente disponible a través de la API Imagine SpaceXAI con soporte por lotes. La página del modelo enumera us-east-1 y us-west-2. Las URL de salida son temporales y deben guardarse lo antes posible.
SpaceXAI dice que las entradas y salidas de la API no se utilizan para la capacitación sin un permiso explícito. La retención cifrada predeterminada es de 30 días; La retención de datos cero a nivel de equipo está disponible con compensaciones de funciones. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
El modelo heredado de video y audio sincronizado de OpenAI para clips cortos guiados por texto o imágenes, aún documentado, pero acercándose a un cierre permanente de la API.
Abrir comparación completaModelo de video de vista previa de Google para generación guiada de texto, imágenes y video con audio nativo y opciones de salida de hasta 4K.
Abrir comparación completaLa variante Veo 3.1 de menor costo de Google para crear rápidamente clips de video cortos con audio nativo y opciones de salida de hasta 4K.
Abrir comparación completaEl modelo de video para desarrolladores insignia de Runway para clips guiados por texto e imágenes, con formatos profesionales y una tasa base de crédito por segundo predecible.
Abrir comparación completaEl modelo de video Pro de Kuaishou se entrega a través de fal para generación de texto/imagen de tomas múltiples, audio nativo opcional, referencias y clips de hasta 15 segundos.
Abrir comparación completaUn modelo Kling económico en fal para clips fluidos de cinco o diez segundos generados a partir de texto o una imagen inicial.
Abrir comparación completaEl modelo audiovisual actual de ByteDance para clips coherentes de hasta 30 segundos, con sonido nativo, narración extensa, referencias ricas y edición específica.
Abrir comparación completaFamilia de videos unificada de Alibaba para crear clips cortos con sonido a partir de texto, una imagen inicial o un video de referencia.
Abrir comparación completaModelo de vídeo centrado en la calidad Lightricks para crear clips de 720p o 1080p a partir de texto, imágenes o audio con sonido nativo.
Abrir comparación completaModelo de video de velocidad optimizada de LTX para entrada de texto, imagen o audio, sonido nativo, duración automática y salida de hasta 4K.
Abrir comparación completaEl modelo maduro de video de flujo de trabajo completo de LTX para generación más retomar, extender, reencuadrar, audio nativo y control del primero al último fotograma.
Abrir comparación completa