Tous les modèles
NVIDIA

NVIDIA Nemotron 3.5 Lightning

Modèle compact de mélange d'experts 30B du NVIDIA pour des agents spécialisés efficaces et des flux de travail de texte à volume élevé.

Présentation de l'anglais simple

Qu'est-ce que NVIDIA Nemotron 3.5 Lightning ?

Nemotron 3.5 Lightning possède 30 milliards de paramètres au total mais en active environ trois milliards pour chaque jeton. NVIDIA l'a conçu comme un outil de travail rapide pour les tâches spécialisées au sein de systèmes d'agents plus importants, tout en conservant une fenêtre contextuelle pouvant atteindre un million de jetons.

L'aperçu est disponible sous forme de poids téléchargeables et sur NVIDIA, OpenRouter et l'infrastructure partenaire. Son empreinte active plus petite rend les déploiements contrôlés plus accessibles que Ultra, même si le contexte long et la concurrence peuvent toujours dominer l'utilisation de la mémoire.

Bon ajustement pour

  • Sous-tâches d'agent à volume élevé
  • Raisonnement auto-hébergé efficace
  • RAG à contexte long et workflows d'instructions

Comparaison des catégories

Les faits importants pour les modèles texte

Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.

Fenêtre contextuelle
Jusqu'à 1 million de jetonsContexte combiné maximum d'invite et de travail documenté par le fournisseur.
Sortie maximale
Non publié séparémentLimite de réponse publiée par le fournisseur, le cas échéant.
Seuil de connaissances
Préformation jusqu'en septembre 2025 ; post-formation jusqu’en mai 2026Dernière date de connaissance fiable publiée explicitement par le fournisseur du modèle. Les outils de recherche et connectés peuvent récupérer des informations plus récentes mais ne modifient pas le seuil intégré du modèle.
Prix d'entrée
Coût de prototype ou de déploiement gratuitPrix ​​catalogue standard actuel par million de jetons d'entrée, sauf indication contraire.
Prix de sortie
Coût de prototype ou de déploiement gratuitPrix ​​catalogue standard actuel par million de jetons de sortie, sauf indication contraire.
Entrées
TexteTypes de médias acceptés par le point de terminaison du modèle répertorié.
Outils et agents
Outils agents et workflows de longue duréeOutils natifs sélectionnés et capacités de création d'agents, liste non exhaustive.

Tarifs et comparaisons

Estimez votre coût

Indiquez votre utilisation. L’estimation se met à jour à chaque modification.

Exemple : 6 000 tokens d’entrée pour 10 pages et 500 pour le résumé. La longueur varie ; ajustez les valeurs.

Une exécution envoie votre entrée au modèle une fois et reçoit une réponse. Les tokens sont des fragments de texte : l’entrée est ce que vous envoyez, la sortie est la réponse reçue.

Options avancées

NVIDIA Nemotron 3.5 Lightning

NVIDIA

Total estimé (USD)

Aucun tarif vérifié

Pour l’utilisation indiquée · USD · Tarif API, hors abonnement

Comprendre cette estimation

Les estimations excluent taxes, outils, stockage/écriture du cache, quotas gratuits et remises personnalisées. Pour les images, seule la sortie est incluse, pas le prompt ni les références. Les modes de qualité varient. Un paramètre non répertorié n’est pas gratuit.

Accès API et fournisseur

Où obtenir NVIDIA Nemotron 3.5 Lightning

Disponibilité

Régions et étape d'accès

Disponible sur la version NVIDIA, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM et les partenaires cloud ou d'inférence.

La fiche modèle décrit le déploiement mondial ; la région de traitement réelle dépend du fournisseur sélectionné ou de l'infrastructure auto-hébergée.

Vérifier la disponibilité en direct

Données et formation

L'itinéraire compte.

Les pesées auto-hébergées conservent les données de demande sous le contrôle de l'opérateur. Les essais d'API NVIDIA, OpenRouter et les partenaires cloud appliquent chacun des politiques distinctes de journalisation, de conservation et d'utilisation de la formation.

Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.

Lire la politique du fournisseur

Questions fréquemment posées

FAQ NVIDIA Nemotron 3.5 Lightning

Qu'est-ce que NVIDIA Nemotron 3.5 Lightning ?

Modèle compact de mélange d'experts 30B du NVIDIA pour des agents spécialisés efficaces et des flux de travail de texte à volume élevé. Nemotron 3.5 Lightning possède 30 milliards de paramètres au total mais en active environ trois milliards pour chaque jeton. NVIDIA l'a conçu comme un outil de travail rapide pour les tâches spécialisées au sein de systèmes d'agents plus importants, tout en conservant une fenêtre contextuelle pouvant atteindre un million de jetons.

Quand NVIDIA Nemotron 3.5 Lightning est-il sorti ?

NVIDIA Nemotron 3.5 Lightning a été publié sur 11 août 2026 selon les documents du fournisseur cités.

Où puis-je accéder à NVIDIA Nemotron 3.5 Lightning ?

Disponible sur la version NVIDIA, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM et les partenaires cloud ou d'inférence. Les voies d'accès répertoriées dans ce guide sont NVIDIA NIM et NVIDIA.

Combien coûte NVIDIA Nemotron 3.5 Lightning ?

Point de terminaison prototype NVIDIA gratuit ; le coût de production et d'auto-hébergement varie. L'aperçu est disponible sous forme de poids téléchargeables et via NVIDIA et les itinéraires partenaires. Les tarifs du matériel, du NIM et du fournisseur sont distincts.

Où le NVIDIA Nemotron 3.5 Lightning est-il disponible ?

Disponible sur la version NVIDIA, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM et les partenaires cloud ou d'inférence. La fiche modèle décrit le déploiement mondial ; la région de traitement réelle dépend du fournisseur sélectionné ou de l'infrastructure auto-hébergée.

Mes données API NVIDIA Nemotron 3.5 Lightning sont-elles utilisées pour la formation ?

Les pesées auto-hébergées conservent les données de demande sous le contrôle de l'opérateur. Les essais d'API NVIDIA, OpenRouter et les partenaires cloud appliquent chacun des politiques distinctes de journalisation, de conservation et d'utilisation de la formation. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.

Comparaison des prix

USD par million de tokens pour les API indiquées avec un contexte standard. Les tarifs de cache et de contexte long peuvent varier. Les modèles sans prix vérifiés compatibles sont omis ; un coût inférieur n’indique pas une meilleure qualité.

Coût des tokens d’entréepar million de tokens · USD
  1. 0,15 $US
    Mistral Small 4

    Mistral AI

  2. 0,75 $US
    Gemini 3.8 Flash

    Google

  3. 4,00 $US
    GPT-5.6 Sol

    OpenAI

  4. 10,00 $US
    GPT-6 Astra

    OpenAI

  5. 10,00 $US
    Claude Fable 5.1

    Anthropic

Coût des tokens de sortiepar million de tokens · USD
  1. 0,60 $US
    Mistral Small 4

    Mistral AI

  2. 3,75 $US
    Gemini 3.8 Flash

    Google

  3. 20,00 $US
    GPT-5.6 Sol

    OpenAI

  4. 50,00 $US
    GPT-6 Astra

    OpenAI

  5. 50,00 $US
    Claude Fable 5.1

    Anthropic

Comparaisons associées

Comparaisons face à face

  1. NVIDIA Nemotron 3.5 Lightning vs GPT-6 Astra

    Le modèle OpenAI le plus performant pour les travaux difficiles de bout en bout, combinant le raisonnement aux frontières avec une fenêtre contextuelle d'un million de jetons et un large ensemble d'outils d'agent.

    Ouvrir la comparaison complète
  2. NVIDIA Nemotron 3.5 Lightning vs GPT-5.6 Sol

    Le modèle général phare de OpenAI pour le codage, l'analyse et le travail professionnel difficiles, avec une très grande fenêtre contextuelle et un large ensemble d'outils natifs.

    Ouvrir la comparaison complète
  3. NVIDIA Nemotron 3.5 Lightning vs Claude Fable 5.1

    Le modèle pionnier de Anthropic pour un travail d'agent et de codage ambitieux et de longue durée, avec une vision forte et une disponibilité sur le marché des entreprises.

    Ouvrir la comparaison complète
  4. NVIDIA Nemotron 3.5 Lightning vs Gemini 3.8 Flash

    Le modèle multimodal stable et à haute efficacité de Google pour les agents, le travail logiciel et les grandes entrées multimédias à un prix de lancement de niveau Flash.

    Ouvrir la comparaison complète
  5. NVIDIA Nemotron 3.5 Lightning vs Grok 4.6

    Modèle texte et image frontalier de SpaceXAI pour le codage, les tâches agents et le travail de connaissances, avec des outils directs Web, X et de code.

    Ouvrir la comparaison complète
  6. NVIDIA Nemotron 3.5 Lightning vs Grok 4.20 Multi-Agent Beta

    Un modèle Grok spécialisé qui envoie plusieurs agents d'IA enquêter en parallèle sur une question difficile, puis combine leur travail en une seule réponse recherchée.

    Ouvrir la comparaison complète
  7. NVIDIA Nemotron 3.5 Lightning vs Inkling

    Grand modèle à pondérations ouvertes de Thinking Machines Lab pour des flux de travail personnalisables de raisonnement, de codage, d'outils, de vision et d'audio.

    Ouvrir la comparaison complète
  8. NVIDIA Nemotron 3.5 Lightning vs Mistral Medium 3.5

    Le modèle frontière ouvert de Mistral pour les flux de travail multimodaux, de codage, de raisonnement et d'agent exigeants, avec une fenêtre contextuelle de 256 Ko.

    Ouvrir la comparaison complète
  9. NVIDIA Nemotron 3.5 Lightning vs Mistral Small 4

    Le modèle ouvert à moindre coût de Mistral qui combine les outils normaux de suivi des instructions, de raisonnement, de codage, de vision et d'agent dans un seul point de terminaison.

    Ouvrir la comparaison complète
  10. NVIDIA Nemotron 3.5 Lightning vs Qwen3.8 Max

    Modèle Qwen frontière de Alibaba pour le raisonnement, le codage, les outils et la compréhension de textes, d'images et de vidéos en contexte long.

    Ouvrir la comparaison complète
  11. NVIDIA Nemotron 3.5 Lightning vs MiniMax M3

    Le modèle multimodal à un million de jetons de MiniMax pour le codage, les agents, l'utilisation de l'ordinateur et les projets longs à un faible prix API direct.

    Ouvrir la comparaison complète
  12. NVIDIA Nemotron 3.5 Lightning vs GLM-5.3

    Modèle de raisonnement à contexte long et ouvert de Z.ai pour le codage, les outils et le travail agent sur des routes auto-hébergées et gérées.

    Ouvrir la comparaison complète
  13. NVIDIA Nemotron 3.5 Lightning vs Kimi K3

    Le modèle multimodal frontière de Moonshot AI pour le codage à un million de jetons, le raisonnement, le travail de connaissances et les agents pilotés par des outils.

    Ouvrir la comparaison complète
  14. NVIDIA Nemotron 3.5 Lightning vs Falcon-H1R-7B

    Le modèle de raisonnement ouvert et compact de TII pour les tâches de texte, les contextes longs et les workflows d'appel de fonctions auto-hébergés.

    Ouvrir la comparaison complète
  15. NVIDIA Nemotron 3.5 Lightning vs Falcon-H1-34B-Instruct

    Modèle d'instruction ouvert 34B de TII pour le texte multilingue, le codage et les applications auto-hébergées contrôlées.

    Ouvrir la comparaison complète
  16. NVIDIA Nemotron 3.5 Lightning vs Muse Spark 1.3

    Le dernier modèle de raisonnement multimodal de Meta pour les agents, le codage, les outils et la collaboration utilisateur complexe de longue durée.

    Ouvrir la comparaison complète
  17. NVIDIA Nemotron 3.5 Lightning vs Celeris-1 Magnus

    Modèle de langage de diffusion axé sur les agents de Celeris pour un raisonnement rapide, des boucles d'outils, des actions structurées et une intégration compatible OpenAI.

    Ouvrir la comparaison complète
  18. NVIDIA Nemotron 3.5 Lightning vs NVIDIA Nemotron 3 Ultra

    Le plus grand modèle de raisonnement Nemotron 3 de NVIDIA pour les agents complexes, le codage, la planification, les outils, RAG et l'analyse d'un million de jetons.

    Ouvrir la comparaison complète
  19. NVIDIA Nemotron 3.5 Lightning vs Qwen3.8-Flash

    Le modèle multimodal efficace d'un million de contextes de Alibaba pour des agents rapides, le codage, le travail documentaire, la vision, la compréhension vidéo et l'utilisation d'outils.

    Ouvrir la comparaison complète
  20. NVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Pro

    Le modèle de texte phare d'un million de contextes de DeepSeek pour le raisonnement difficile, le codage, les agents et les outils de longue durée et les résultats de très grande taille.

    Ouvrir la comparaison complète
  21. NVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Flash

    Le modèle V4 à moindre coût de DeepSeek pour les charges de travail de raisonnement, de codage, d'agents et de texte à volume élevé.

    Ouvrir la comparaison complète