Sora 2
El modelo heredado de video y audio sincronizado de OpenAI para clips cortos guiados por texto o imágenes, aún documentado, pero acercándose a un cierre permanente de la API.
El modelo heredado de video y audio sincronizado de OpenAI para clips cortos guiados por texto o imágenes, aún documentado, pero acercándose a un cierre permanente de la API.
Descripción general en inglés sencillo
Sora 2 genera videos cortos en formato horizontal o vertical con audio sincronizado a partir de texto y guía de imagen opcional. Su simple precio por segundo hace que los pequeños experimentos sean fáciles de estimar.
Ahora se trata principalmente de una entrada de migración, no de una recomendación para una nueva versión de producción. OpenAI programó el cierre permanente de la API de Sora el 24 de septiembre de 2026.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Precios y comparaciones
Indica tu uso. La estimación se actualiza al escribir.
Ejemplo: clips de 8 segundos a 720p con audio. Los modelos incompatibles con estos ajustes no tendrán estimación.
Sora 2
OpenAI
Total estimado (USD)
Para el uso indicado · USD · Precio de API, no de suscripción
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
Acceso a API y proveedores
Disponibilidad
El acceso a la API de videos Legacy OpenAI permanece disponible temporalmente, pero las nuevas integraciones deberían tener en cuenta el cierre anunciado.
El acceso directo sigue la lista de países admitidos de OpenAI mientras la API permanece activa.
Consultar disponibilidad en vivoDatos y entrenamiento
OpenAI dice que las entradas y salidas de API no se utilizan para la capacitación de forma predeterminada. Se aplican controles de almacenamiento estándar de monitoreo de abuso y funciones específicas hasta que se cierra el servicio.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
El modelo heredado de video y audio sincronizado de OpenAI para clips cortos guiados por texto o imágenes, aún documentado, pero acercándose a un cierre permanente de la API. Sora 2 genera videos cortos en formato horizontal o vertical con audio sincronizado a partir de texto y guía de imagen opcional. Su simple precio por segundo hace que los pequeños experimentos sean fáciles de estimar.
Sora 2 se lanzó en 8 de diciembre de 2025 según los materiales del proveedor citados.
Está previsto que la API de Sora se cierre permanentemente el 24 de septiembre de 2026. No comience una nueva integración de larga duración sin un plan de migración.
El acceso a la API de videos Legacy OpenAI permanece disponible temporalmente, pero las nuevas integraciones deberían tener en cuenta el cierre anunciado. Las rutas de acceso enumeradas en esta guía son OpenAI.
$0.10 / segundo generado. OpenAI precio de lista para salida 720×1280 vertical o 1280×720 horizontal Sora 2.
El acceso a la API de videos Legacy OpenAI permanece disponible temporalmente, pero las nuevas integraciones deberían tener en cuenta el cierre anunciado. El acceso directo sigue la lista de países admitidos de OpenAI mientras la API permanece activa.
OpenAI dice que las entradas y salidas de API no se utilizan para la capacitación de forma predeterminada. Se aplican controles de almacenamiento estándar de monitoreo de abuso y funciones específicas hasta que se cierra el servicio. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
Modelo de video de vista previa de Google para generación guiada de texto, imágenes y video con audio nativo y opciones de salida de hasta 4K.
Abrir comparación completaLa variante Veo 3.1 de menor costo de Google para crear rápidamente clips de video cortos con audio nativo y opciones de salida de hasta 4K.
Abrir comparación completaLa versión post-entrenada centrada en la velocidad de fal de MiniMax H3 para videos cortos con audio nativo, iteración rápida de 768p y entrada de texto, imagen o referencia multimodal.
Abrir comparación completaEl modelo de video para desarrolladores insignia de Runway para clips guiados por texto e imágenes, con formatos profesionales y una tasa base de crédito por segundo predecible.
Abrir comparación completaEl modelo de video Pro de Kuaishou se entrega a través de fal para generación de texto/imagen de tomas múltiples, audio nativo opcional, referencias y clips de hasta 15 segundos.
Abrir comparación completaUn modelo Kling económico en fal para clips fluidos de cinco o diez segundos generados a partir de texto o una imagen inicial.
Abrir comparación completaEl modelo de vídeo actual de SpaceXAI para convertir texto, imágenes o referencias en clips cortos con voz y sonido generados opcionalmente.
Abrir comparación completaEl modelo audiovisual actual de ByteDance para clips coherentes de hasta 30 segundos, con sonido nativo, narración extensa, referencias ricas y edición específica.
Abrir comparación completaFamilia de videos unificada de Alibaba para crear clips cortos con sonido a partir de texto, una imagen inicial o un video de referencia.
Abrir comparación completaModelo de vídeo centrado en la calidad Lightricks para crear clips de 720p o 1080p a partir de texto, imágenes o audio con sonido nativo.
Abrir comparación completaModelo de video de velocidad optimizada de LTX para entrada de texto, imagen o audio, sonido nativo, duración automática y salida de hasta 4K.
Abrir comparación completaEl modelo maduro de video de flujo de trabajo completo de LTX para generación más retomar, extender, reencuadrar, audio nativo y control del primero al último fotograma.
Abrir comparación completa