Comparación de modelos
Inkling y NVIDIA Nemotron 3.5 Lightning
Compare Inkling y NVIDIA Nemotron 3.5 Lightning utilizando la misma rúbrica texto y razonamiento del proveedor. Sin puntuación misteriosa ni clasificación de referencia inventada.
Comparación de modelos
Compare Inkling y NVIDIA Nemotron 3.5 Lightning utilizando la misma rúbrica texto y razonamiento del proveedor. Sin puntuación misteriosa ni clasificación de referencia inventada.
Indica tu uso. La estimación se actualiza al escribir.
Ejemplo: 6.000 tokens de entrada para 10 páginas y 500 para el resumen. La longitud varía; ajusta los valores.
Una ejecución envía tu entrada al modelo una vez y recibe una respuesta. Los tokens son fragmentos de texto: la entrada es lo que envías y la salida es la respuesta que recibes.
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
| modelo | Acceso | Total estimado (USD) |
|---|---|---|
| InklingThinking Machines Lab | Thinking Machines Lab | Sin tarifa revisada |
| NVIDIA Nemotron 3.5 LightningNVIDIA | NVIDIA | Sin tarifa revisada |
Toma rápida
El gran modelo de pesos abiertos de Thinking Machines Lab para flujos de trabajo de razonamiento, codificación, herramientas, visión y audio personalizables.
Un modelo 975B es un proyecto de servicio serio incluso con escasa activación. Compare la ruta exacta alojada o autohospedada y no asuma que el contexto máximo de 1 millón del modelo está disponible en todos los proveedores.
El modelo compacto de combinación de expertos 30B de NVIDIA para agentes especializados eficientes y flujos de trabajo de texto de gran volumen.
La versión actual está etiquetada como vista previa. Valide las necesidades exactas de precisión, idioma, plantilla de herramientas, ruta del proveedor y memoria de contexto largo antes de estandarizar una flota de producción.
Compara los hechos publicados
Los valores utilizan las unidades y límites publicados de cada proveedor. Un espacio en blanco significa que el proveedor no publicó un valor directamente comparable en las fuentes revisadas.
| Texto y razonamiento | Inkling | NVIDIA Nemotron 3.5 Lightning |
|---|---|---|
| ventana contextualMáximo contexto de trabajo y aviso combinado documentado por el proveedor. | Hasta 1 millón de tokens; Tinker ofrece 64K y 256K | Hasta 1 millón de tokens |
| Salida máximaLímite de respuestas publicado por el proveedor, cuando esté disponible. | No publicado por separado | No publicado por separado |
| límite de conocimientoÚltima fecha de conocimiento confiable publicada explícitamente por el proveedor del modelo. Las herramientas de búsqueda y conectadas pueden recuperar información más reciente pero no cambian el límite integrado del modelo. | No publicado | Preformación hasta septiembre de 2025; después de la capacitación hasta mayo de 2026 |
| Precio de entradaPrecio de lista estándar actual por millón de tokens de entrada, a menos que se indique lo contrario. | Depende del alojamiento | Costo de implementación o prototipo gratuito |
| Precio de salidaPrecio de lista estándar actual por millón de tokens de salida, a menos que se indique lo contrario. | Depende del alojamiento | Costo de implementación o prototipo gratuito |
| EntradasTipos de medios aceptados por el punto final del modelo enumerado. | Texto, imagen, audio. | Texto |
| Herramientas y agentesHerramientas nativas seleccionadas y capacidades de creación de agentes, no una lista exhaustiva. | Codificación agente, herramientas, visión asistida por Python, pensamiento controlable. | Herramientas agentes y flujos de trabajo de larga duración |
como elegir
Comience con el trabajo que necesita completar y luego valide los detalles del costo, el acceso y la política en la ruta exacta de su proveedor.
Los pesos abiertos pueden autohospedarse, por lo que los datos de la solicitud permanecen en la infraestructura que usted controla. Tinker y las rutas alojadas por socios tienen términos de retención y uso de capacitación separados que se deben verificar con el proveedor seleccionado.
Los pesos autohospedados mantienen los datos solicitados bajo los controles del operador. Las pruebas de API NVIDIA, OpenRouter y los socios de nube aplican políticas de registro, retención y uso de capacitación independientes.
Enlaces de proveedores y API
Preguntas frecuentes
Inkling: El gran modelo de pesos abiertos de Thinking Machines Lab para flujos de trabajo de razonamiento, codificación, herramientas, visión y audio personalizables. NVIDIA Nemotron 3.5 Lightning: El modelo compacto de combinación de expertos 30B de NVIDIA para agentes especializados eficientes y flujos de trabajo de texto de gran volumen.
Considere Inkling cuando su prioridad sea Equipos que quieren un modelo de base adaptable de peso abierto. Considere NVIDIA Nemotron 3.5 Lightning cuando su prioridad sea Subtareas de agentes de gran volumen. Pruebe ambos con sus propios datos y la ruta del proveedor antes de comprometerse.
No. Esta comparación alinea los datos publicados por el proveedor para la categoría Texto y razonamiento. No reclama un ganador universal ni combina puntuaciones de referencia de terceros incompatibles.