Volver a Texto y razonamiento

Comparación de modelos

Gemini 3.8 Flash y Inkling

Compare Gemini 3.8 Flash y Inkling utilizando la misma rúbrica texto y razonamiento del proveedor. Sin puntuación misteriosa ni clasificación de referencia inventada.

Hechos comprobados 4 de septiembre de 2026

Calcula tu coste

Indica tu uso. La estimación se actualiza al escribir.

Ejemplo: 6.000 tokens de entrada para 10 páginas y 500 para el resumen. La longitud varía; ajusta los valores.

Una ejecución envía tu entrada al modelo una vez y recibe una respuesta. Los tokens son fragmentos de texto: la entrada es lo que envías y la salida es la respuesta que recibes.

Opciones avanzadas
Cómo funciona esta estimación

Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.

Calcula tu coste
modeloTotal estimado (USD)
Gemini 3.8 FlashGoogle0,0064 US$
InklingThinking Machines LabSin tarifa revisada

Toma rápida

Gemini 3.8 Flash

El modelo multimodal estable y de alta eficiencia de Google para agentes, trabajo de software y grandes entradas de medios mixtos a un precio introductorio de nivel Flash.

Lo mejor para

  • Agentes multimodales de alto volumen
  • Entradas largas de vídeo, audio, PDF y código
  • Equipos que optimizan la capacidad por costo de token

cuidado con

Los servicios gratuitos y de pago de Gemini tienen términos de uso de datos sustancialmente diferentes. Verifique el estado de facturación y la disponibilidad regional para el proyecto exacto.

Inkling

El gran modelo de pesos abiertos de Thinking Machines Lab para flujos de trabajo de razonamiento, codificación, herramientas, visión y audio personalizables.

Lo mejor para

  • Equipos que quieren un modelo de base adaptable de peso abierto
  • Experimentos de codificación agente y uso de herramientas.
  • Implementaciones privadas o especializadas con insumos multimodales.

cuidado con

Un modelo 975B es un proyecto de servicio serio incluso con escasa activación. Compare la ruta exacta alojada o autohospedada y no asuma que el contexto máximo de 1 millón del modelo está disponible en todos los proveedores.

Compara los hechos publicados

Gemini 3.8 Flash vs Inkling

Los valores utilizan las unidades y límites publicados de cada proveedor. Un espacio en blanco significa que el proveedor no publicó un valor directamente comparable en las fuentes revisadas.

Texto y razonamientoGemini 3.8 FlashInkling
ventana contextualMáximo contexto de trabajo y aviso combinado documentado por el proveedor.1.048.576 fichasHasta 1 millón de tokens; Tinker ofrece 64K y 256K
Salida máximaLímite de respuestas publicado por el proveedor, cuando esté disponible.65.536 fichasNo publicado por separado
límite de conocimientoÚltima fecha de conocimiento confiable publicada explícitamente por el proveedor del modelo. Las herramientas de búsqueda y conectadas pueden recuperar información más reciente pero no cambian el límite integrado del modelo.marzo de 2026; algunos dominios pueden retrasarse hasta enero de 2025No publicado
Precio de entradaPrecio de lista estándar actual por millón de tokens de entrada, a menos que se indique lo contrario.Promoción de $0,75 / 1 millónDepende del alojamiento
Precio de salidaPrecio de lista estándar actual por millón de tokens de salida, a menos que se indique lo contrario.Promoción de $3,75 / 1 millónDepende del alojamiento
EntradasTipos de medios aceptados por el punto final del modelo enumerado.Texto, imagen, vídeo, audio, PDFTexto, imagen, audio.
Herramientas y agentesHerramientas nativas seleccionadas y capacidades de creación de agentes, no una lista exhaustiva.Funciones, búsqueda, ejecución de código, búsqueda de archivos.Codificación agente, herramientas, visión asistida por Python, pensamiento controlable.

como elegir

Compare el trabajo, no las exageraciones.

Comience con el trabajo que necesita completar y luego valide los detalles del costo, el acceso y la política en la ruta exacta de su proveedor.

Gemini 3.8 Flash

Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región.

Inkling

Los pesos abiertos pueden autohospedarse, por lo que los datos de la solicitud permanecen en la infraestructura que usted controla. Tinker y las rutas alojadas por socios tienen términos de retención y uso de capacitación separados que se deben verificar con el proveedor seleccionado.

Preguntas frecuentes

Preguntas frecuentes sobre Gemini 3.8 Flash y Inkling

¿Cuál es la principal diferencia entre Gemini 3.8 Flash y Inkling?

Gemini 3.8 Flash: El modelo multimodal estable y de alta eficiencia de Google para agentes, trabajo de software y grandes entradas de medios mixtos a un precio introductorio de nivel Flash. Inkling: El gran modelo de pesos abiertos de Thinking Machines Lab para flujos de trabajo de razonamiento, codificación, herramientas, visión y audio personalizables.

¿Debo elegir Gemini 3.8 Flash o Inkling?

Considere Gemini 3.8 Flash cuando su prioridad sea Agentes multimodales de alto volumen. Considere Inkling cuando su prioridad sea Equipos que quieren un modelo de base adaptable de peso abierto. Pruebe ambos con sus propios datos y la ruta del proveedor antes de comprometerse.

¿Esta comparación entre Gemini 3.8 Flash y Inkling se basa en los puntos de referencia de Cody?

No. Esta comparación alinea los datos publicados por el proveedor para la categoría Texto y razonamiento. No reclama un ganador universal ni combina puntuaciones de referencia de terceros incompatibles.