Comparación de modelos
Mistral Small 4 y NVIDIA Nemotron 3 Ultra
Compare Mistral Small 4 y NVIDIA Nemotron 3 Ultra utilizando la misma rúbrica texto y razonamiento del proveedor. Sin puntuación misteriosa ni clasificación de referencia inventada.
Comparación de modelos
Compare Mistral Small 4 y NVIDIA Nemotron 3 Ultra utilizando la misma rúbrica texto y razonamiento del proveedor. Sin puntuación misteriosa ni clasificación de referencia inventada.
Indica tu uso. La estimación se actualiza al escribir.
Ejemplo: 6.000 tokens de entrada para 10 páginas y 500 para el resumen. La longitud varía; ajusta los valores.
Una ejecución envía tu entrada al modelo una vez y recibe una respuesta. Los tokens son fragmentos de texto: la entrada es lo que envías y la salida es la respuesta que recibes.
Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.
| modelo | Acceso | Total estimado (USD) |
|---|---|---|
| Mistral Small 4Mistral AI | Mistral AI | 0,0012 US$ |
| NVIDIA Nemotron 3 UltraNVIDIA | NVIDIA | Sin tarifa revisada |
Toma rápida
El modelo abierto de menor costo de Mistral que combina el seguimiento de instrucciones normales, el razonamiento, la codificación, la visión y las herramientas del agente en un solo punto final.
La activación escasa reduce el trabajo de inferencia pero no reduce el punto de control 119B completo. Dimensione el hardware según la cuantificación y el contexto reales que planea ofrecer.
El modelo de razonamiento Nemotron 3 más grande de NVIDIA para agentes complejos, codificación, planificación, herramientas, RAG y análisis de millones de tokens.
Ultra autohospedado es un proyecto de hardware importante. Dimensione los requisitos de caché de contexto real, simultaneidad, precisión y disponibilidad antes de tratar los pesos abiertos como la ruta más económica.
Compara los hechos publicados
Los valores utilizan las unidades y límites publicados de cada proveedor. Un espacio en blanco significa que el proveedor no publicó un valor directamente comparable en las fuentes revisadas.
| Texto y razonamiento | Mistral Small 4 | NVIDIA Nemotron 3 Ultra |
|---|---|---|
| ventana contextualMáximo contexto de trabajo y aviso combinado documentado por el proveedor. | 256.000 tokens combinados | Hasta 1 millón de tokens |
| Salida máximaLímite de respuestas publicado por el proveedor, cuando esté disponible. | No publicado por separado | No publicado por separado |
| límite de conocimientoÚltima fecha de conocimiento confiable publicada explícitamente por el proveedor del modelo. Las herramientas de búsqueda y conectadas pueden recuperar información más reciente pero no cambian el límite integrado del modelo. | No publicado | Preformación hasta septiembre de 2025; después de la capacitación hasta mayo de 2026 |
| Precio de entradaPrecio de lista estándar actual por millón de tokens de entrada, a menos que se indique lo contrario. | $0,15 / 1 millón | Costo de implementación o prototipo gratuito |
| Precio de salidaPrecio de lista estándar actual por millón de tokens de salida, a menos que se indique lo contrario. | $0,60 / 1 millón | Costo de implementación o prototipo gratuito |
| EntradasTipos de medios aceptados por el punto final del modelo enumerado. | Texto, imagen | Texto |
| Herramientas y agentesHerramientas nativas seleccionadas y capacidades de creación de agentes, no una lista exhaustiva. | Funciones, agentes, herramientas integradas, resultados estructurados y previstos | Llamada de herramientas, agentes, presupuesto de razonamiento configurable. |
como elegir
Comience con el trabajo que necesita completar y luego valide los detalles del costo, el acceso y la política en la ruta exacta de su proveedor.
Los términos comerciales de Mistral excluyen la capacitación de modelos de forma predeterminada, excepto cuando un cliente opta por participar o utiliza laboratorios designados o modelos de vista previa. El autohospedaje mantiene los datos de inferencia bajo los controles del operador; La retención de API alojada es generalmente de 30 días a menos que se habilite la retención de datos cero.
Enlaces de proveedores y API
Los pesos descargados pueden ejecutarse en la infraestructura que controla el operador. El prototipo alojado de NVIDIA y los puntos finales de los socios se rigen por sus propios términos de prueba, registro, retención e implementación.
Enlaces de proveedores y API
Preguntas frecuentes
Mistral Small 4: El modelo abierto de menor costo de Mistral que combina el seguimiento de instrucciones normales, el razonamiento, la codificación, la visión y las herramientas del agente en un solo punto final. NVIDIA Nemotron 3 Ultra: El modelo de razonamiento Nemotron 3 más grande de NVIDIA para agentes complejos, codificación, planificación, herramientas, RAG y análisis de millones de tokens.
Considere Mistral Small 4 cuando su prioridad sea Asistentes de producción sensibles a los costos. Considere NVIDIA Nemotron 3 Ultra cuando su prioridad sea Agentes complejos de larga duración. Pruebe ambos con sus propios datos y la ruta del proveedor antes de comprometerse.
No. Esta comparación alinea los datos publicados por el proveedor para la categoría Texto y razonamiento. No reclama un ganador universal ni combina puntuaciones de referencia de terceros incompatibles.