Genie 3
Modelo mundial de investigación de Google DeepMind para generar entornos fotorrealistas y controlables que se pueden explorar en tiempo real a partir de una descripción de texto.
Modelo mundial de investigación de Google DeepMind para generar entornos fotorrealistas y controlables que se pueden explorar en tiempo real a partir de una descripción de texto.
Descripción general en inglés sencillo
Genie 3 genera un mundo visual a medida que el usuario se mueve a través de él en lugar de reproducir un vídeo fijo de antemano. DeepMind informa una salida de 720p, de 20 a 24 fotogramas por segundo y coherencia durante unos pocos minutos de interacción.
Se entiende mejor como un importante producto experimental y de investigación, no como una API mundial. El acceso se realiza a través de Project Genie y no incluye precios de API públicos ni un contrato de integración general.
Comparación de categorías
Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.
Acceso a API y proveedores
Disponibilidad
Acceso a investigación/experimental a través del Proyecto Genie; no está documentada ninguna API de desarrollador general.
La elegibilidad del proyecto y la disponibilidad del país pueden cambiar y no se enumeran en la página del modelo.
Consultar disponibilidad en vivoDatos y entrenamiento
No se publica ninguna política general de datos de API para desarrolladores para esta entrada de acceso a la investigación. Revise los términos de Project Genie antes de cargar indicaciones confidenciales o material de referencia.
Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.
Lea la política del proveedor.Preguntas frecuentes
Modelo mundial de investigación de Google DeepMind para generar entornos fotorrealistas y controlables que se pueden explorar en tiempo real a partir de una descripción de texto. Genie 3 genera un mundo visual a medida que el usuario se mueve a través de él en lugar de reproducir un vídeo fijo de antemano. DeepMind informa una salida de 720p, de 20 a 24 fotogramas por segundo y coherencia durante unos pocos minutos de interacción.
Genie 3 se lanzó en 5 de agosto de 2025 según los materiales del proveedor citados.
Acceso a investigación/experimental a través del Proyecto Genie; no está documentada ninguna API de desarrollador general. Las rutas de acceso enumeradas en esta guía son Google DeepMind.
No publicado. Genie 3 se presenta a través de Project Genie en lugar de una API de desarrollador medida disponible de forma general.
Acceso a investigación/experimental a través del Proyecto Genie; no está documentada ninguna API de desarrollador general. La elegibilidad del proyecto y la disponibilidad del país pueden cambiar y no se enumeran en la página del modelo.
No se publica ninguna política general de datos de API para desarrolladores para esta entrada de acceso a la investigación. Revise los términos de Project Genie antes de cargar indicaciones confidenciales o material de referencia. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.
Comparaciones relacionadas
Modelo de API pública World Labs para convertir texto, imágenes, panoramas, conjuntos de vistas múltiples o videos en grandes mundos 3D explorables y activos espaciales.
Abrir comparación completaModelo mundial condicionado a la acción de Decart para entrenamiento físico de IA, que genera vistas de simulación sincronizadas y controlables en tiempo real.
Abrir comparación completaEl modelo mundial general más grande de Odyssey, centrado en la simulación del siguiente estado en tiempo real, precisión física, futuros abiertos e implementaciones interactivas más largas.
Abrir comparación completaLa superficie pública de personajes conversacionales del modelo mundial general de Runway, que crea personajes visuales en tiempo real a partir de una imagen de referencia.
Abrir comparación completa