MiniMax H3 Max
La versión post-entrenada centrada en la velocidad de fal de MiniMax H3 para videos cortos con audio nativo, iteración rápida de 768p y entrada de texto, imagen o referencia multimodal.
La versión post-entrenada centrada en la velocidad de fal de MiniMax H3 para videos cortos con audio nativo, iteración rápida de 768p y entrada de texto, imagen o referencia multimodal.
Descripción general en inglés sencillo
H3 Max comienza a partir de la base H3 de peso abierto de MiniMax, luego agrega los datos posteriores al entrenamiento de fal y una pila de inferencia diseñada en torno a la rápida adherencia, el atractivo visual y el rendimiento. El resultado es un modelo fal alojado en lugar de un nuevo punto de control lanzado por el propio MiniMax.
El modelo puede crear clips de cinco a quince segundos a partir de un mensaje, animar un primer fotograma o un final, o utilizar referencias de imagen, vídeo y audio. Su resolución de trabajo nativa es 768p; la opción de 1080p utiliza un refinamiento latente, mientras que el sistema H3 completo independiente del MiniMax es la ruta asociada con una etapa de regeneración de 2K.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Precios y comparaciones
Indica tu uso. La estimación se actualiza al escribir.
Ejemplo: clips de 8 segundos a 768p con audio. Los modelos incompatibles con estos ajustes no tendrán estimación.
MiniMax H3 Max
fal
Total estimado (USD)
Para el uso indicado · USD · Precio de API, no de suscripción
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
Acceso a API y proveedores
Disponibilidad
Disponible a través de la experiencia web de fal y rutas API en cola para texto a video, imagen a video y referencia a video.
fal no publica una lista de países de procesamiento específicos de endpoints en las páginas H3 Max. Consulte los términos del servicio en vivo y los requisitos de cuenta para su región.
Consultar disponibilidad en vivoDatos y entrenamiento
fal almacena las entradas y salidas de solicitudes de forma predeterminada. El encabezado X-Fal-Store-IO: 0 evita el almacenamiento de la carga útil, pero las entradas CDN cargadas por separado pueden permanecer accesibles y necesitan su propia eliminación o manejo del ciclo de vida.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
La versión post-entrenada centrada en la velocidad de fal de MiniMax H3 para videos cortos con audio nativo, iteración rápida de 768p y entrada de texto, imagen o referencia multimodal. H3 Max comienza a partir de la base H3 de peso abierto de MiniMax, luego agrega los datos posteriores al entrenamiento de fal y una pila de inferencia diseñada en torno a la rápida adherencia, el atractivo visual y el rendimiento. El resultado es un modelo fal alojado en lugar de un nuevo punto de control lanzado por el propio MiniMax.
MiniMax H3 Max se lanzó en 27 de agosto de 2026 según los materiales del proveedor citados.
Disponible a través de la experiencia web de fal y rutas API en cola para texto a video, imagen a video y referencia a video. Las rutas de acceso enumeradas en esta guía son fal.
$0,05 480p · $0,08 768p · $0,16 1080p / segundo. Estas son las tarifas H3 Max estándar de fal a partir del 15 de septiembre de 2026. Una promoción de lanzamiento las descontó en un 75 % hasta el 14 de septiembre. La referencia a video también puede facturar tokens de referencia más allá de la asignación incluida.
Disponible a través de la experiencia web de fal y rutas API en cola para texto a video, imagen a video y referencia a video. fal no publica una lista de países de procesamiento específicos de endpoints en las páginas H3 Max. Consulte los términos del servicio en vivo y los requisitos de cuenta para su región.
fal almacena las entradas y salidas de solicitudes de forma predeterminada. El encabezado X-Fal-Store-IO: 0 evita el almacenamiento de la carga útil, pero las entradas CDN cargadas por separado pueden permanecer accesibles y necesitan su propia eliminación o manejo del ciclo de vida. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
El modelo heredado de video y audio sincronizado de OpenAI para clips cortos guiados por texto o imágenes, aún documentado, pero acercándose a un cierre permanente de la API.
Abrir comparación completaModelo de video de vista previa de Google para generación guiada de texto, imágenes y video con audio nativo y opciones de salida de hasta 4K.
Abrir comparación completaLa variante Veo 3.1 de menor costo de Google para crear rápidamente clips de video cortos con audio nativo y opciones de salida de hasta 4K.
Abrir comparación completaEl modelo de video para desarrolladores insignia de Runway para clips guiados por texto e imágenes, con formatos profesionales y una tasa base de crédito por segundo predecible.
Abrir comparación completaEl modelo de video Pro de Kuaishou se entrega a través de fal para generación de texto/imagen de tomas múltiples, audio nativo opcional, referencias y clips de hasta 15 segundos.
Abrir comparación completaUn modelo Kling económico en fal para clips fluidos de cinco o diez segundos generados a partir de texto o una imagen inicial.
Abrir comparación completaEl modelo de vídeo actual de SpaceXAI para convertir texto, imágenes o referencias en clips cortos con voz y sonido generados opcionalmente.
Abrir comparación completaEl modelo audiovisual actual de ByteDance para clips coherentes de hasta 30 segundos, con sonido nativo, narración extensa, referencias ricas y edición específica.
Abrir comparación completaFamilia de videos unificada de Alibaba para crear clips cortos con sonido a partir de texto, una imagen inicial o un video de referencia.
Abrir comparación completaModelo de vídeo centrado en la calidad Lightricks para crear clips de 720p o 1080p a partir de texto, imágenes o audio con sonido nativo.
Abrir comparación completaModelo de video de velocidad optimizada de LTX para entrada de texto, imagen o audio, sonido nativo, duración automática y salida de hasta 4K.
Abrir comparación completaEl modelo maduro de video de flujo de trabajo completo de LTX para generación más retomar, extender, reencuadrar, audio nativo y control del primero al último fotograma.
Abrir comparación completa