모든 모델
NVIDIA

NVIDIA Nemotron 3.5 Lightning

NVIDIA의 효율적인 전문 에이전트 및 대용량 텍스트 워크플로우를 위한 컴팩트한 30B 전문가 혼합 모델입니다.

일반 영어 개요

NVIDIA Nemotron 3.5 Lightning는 실제로 무엇입니까?

Nemotron 3.5 Lightning은 총 300억 개의 매개변수를 가지고 있지만 각 토큰마다 약 30억 개를 활성화합니다. NVIDIA는 최대 100만 개의 토큰에 대한 컨텍스트 창을 유지하면서 대규모 에이전트 시스템 내부의 전문 작업을 위한 빠른 작업 도구로 설계되었습니다.

미리보기는 NVIDIA, OpenRouter 및 파트너 인프라 전반에 걸쳐 다운로드 가능한 가중치로 제공됩니다. 긴 컨텍스트와 동시성이 여전히 메모리 사용을 지배할 수 있지만 활성 공간이 작기 때문에 Ultra보다 제어된 배포에 더 접근하기 쉽습니다.

다음에 적합

  • 대용량 에이전트 하위 작업
  • 효율적인 자체 호스팅 추론
  • 긴 컨텍스트 RAG 및 지침 워크플로

카테고리 비교

텍스트 모델에 중요한 사실

이는 Cody 벤치마크 점수가 아닌 공급자가 게시한 사양입니다. 현재 제한 및 엔드포인트별 예외는 연결된 소스를 따르세요.

컨텍스트 창
최대 100만 개의 토큰공급자가 문서화한 최대 결합 프롬프트 및 작업 컨텍스트입니다.
최대 출력
별도로 공개되지 않음가능한 경우 공급자가 게시한 응답 제한.
지식 차단
2025년 9월까지 사전 훈련 2026년 5월까지 사후 훈련모델 제공자가 명시적으로 게시한 신뢰할 수 있는 최신 지식 날짜입니다. 검색 및 연결된 도구는 최신 정보를 검색할 수 있지만 모델에 내장된 컷오프를 변경하지는 않습니다.
입력 가격
무료 프로토타입 또는 배포 비용별도의 언급이 없는 한 입력 토큰 백만 개당 현재 표준 정가입니다.
출력 가격
무료 프로토타입 또는 배포 비용별도의 언급이 없는 한 백만 출력 토큰당 현재 표준 정가입니다.
입력
텍스트나열된 모델 엔드포인트에서 허용되는 미디어 유형입니다.
도구 및 에이전트
에이전트 도구 및 장기 실행 워크플로전체 목록이 아닌 선택된 기본 도구 및 에이전트 구축 기능입니다.

요금 및 비교

비용 예상하기

사용량을 입력하면 예상 비용이 바로 업데이트됩니다.

예시: 10페이지 입력 6,000토큰과 요약 500토큰. 페이지 길이에 맞게 수치를 조정하세요.

한 번의 실행은 입력을 모델에 보내고 답변을 받는 과정입니다. 토큰은 텍스트를 나눈 단위입니다. 입력은 보내는 내용이고, 출력은 받는 답변입니다.

고급 옵션

NVIDIA Nemotron 3.5 Lightning

NVIDIA

예상 총액 (USD)

검토된 요금 없음

위 사용량 기준 · USD · 구독료가 아닌 API 요금

예상 비용 계산 방식

세금, 도구, 캐시 저장·쓰기, 무료 할당량, 개별 할인은 제외됩니다. 이미지 비용은 출력만 포함하며 프롬프트와 참조 이미지 비용은 제외됩니다. 품질 모드는 모델마다 다릅니다. 미등록 설정은 무료로 간주하지 않습니다.

API 및 공급자 액세스

NVIDIA Nemotron 3.5 Lightning를 얻을 수 있는 곳

가용성

지역 및 액세스 단계

NVIDIA 빌드, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM 및 클라우드 또는 추론 파트너에서 사용할 수 있습니다.

모델 카드는 글로벌 배포를 설명합니다. 실제 처리 지역은 선택한 공급자 또는 자체 호스팅 인프라에 따라 다릅니다.

실시간 가용성 확인

데이터 및 교육

경로가 중요합니다.

자체 호스팅 가중치는 요청 데이터를 운영자의 통제하에 유지합니다. NVIDIA API 평가판, OpenRouter 및 클라우드 파트너는 각각 별도의 로깅, 보존 및 교육 사용 정책을 적용합니다.

이는 법적 조언이 아닌 인용된 제공자 자료에 대한 간략한 설명입니다. 타사 게이트웨이는 모델 제작자의 직접 API와 다른 스토리지, 라우팅, 교육 및 상주 조건을 가질 수 있습니다.

공급자 정책 읽기

자주 묻는 질문

NVIDIA Nemotron 3.5 Lightning FAQ

NVIDIA Nemotron 3.5 Lightning란 무엇입니까?

NVIDIA의 효율적인 전문 에이전트 및 대용량 텍스트 워크플로우를 위한 컴팩트한 30B 전문가 혼합 모델입니다. Nemotron 3.5 Lightning은 총 300억 개의 매개변수를 가지고 있지만 각 토큰마다 약 30억 개를 활성화합니다. NVIDIA는 최대 100만 개의 토큰에 대한 컨텍스트 창을 유지하면서 대규모 에이전트 시스템 내부의 전문 작업을 위한 빠른 작업 도구로 설계되었습니다.

NVIDIA Nemotron 3.5 Lightning는 언제 출시되었나요?

NVIDIA Nemotron 3.5 Lightning는 인용된 공급자 자료에 따라 2026년 8월 11일에서 릴리스되었습니다.

NVIDIA Nemotron 3.5 Lightning에 어디서 접속할 수 있나요?

NVIDIA 빌드, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM 및 클라우드 또는 추론 파트너에서 사용할 수 있습니다. 이 가이드에 나열된 액세스 경로는 NVIDIA NIM 및 NVIDIA입니다.

NVIDIA Nemotron 3.5 Lightning의 가격은 얼마입니까?

무료 NVIDIA 프로토타입 엔드포인트; 생산 및 자체 호스트 비용은 다양함. 미리보기는 다운로드 가능한 가중치와 NVIDIA 및 파트너 경로를 통해 제공됩니다. 하드웨어, NIM 및 공급자 가격은 별도로 책정됩니다.

NVIDIA Nemotron 3.5 Lightning는 어디에서 사용할 수 있나요?

NVIDIA 빌드, Hugging Face, ModelScope, OpenRouter, NVIDIA NIM 및 클라우드 또는 추론 파트너에서 사용할 수 있습니다. 모델 카드는 글로벌 배포를 설명합니다. 실제 처리 지역은 선택한 공급자 또는 자체 호스팅 인프라에 따라 다릅니다.

내 NVIDIA Nemotron 3.5 Lightning API 데이터가 교육에 사용됩니까?

자체 호스팅 가중치는 요청 데이터를 운영자의 통제하에 유지합니다. NVIDIA API 평가판, OpenRouter 및 클라우드 파트너는 각각 별도의 로깅, 보존 및 교육 사용 정책을 적용합니다. 정책은 공급자 경로 및 계정 조건에 속하므로 프로덕션 사용 전에 다시 확인하십시오.

가격 비교

표시된 API 경로의 표준 컨텍스트 기준 100만 토큰당 USD 요금입니다. 캐시 및 긴 컨텍스트 요금은 다를 수 있습니다. 검토된 호환 요금이 없는 모델은 제외하며, 낮은 비용이 높은 품질을 뜻하지 않습니다.

입력 토큰 비용100만 토큰당 · USD
  1. US$0.15
    Mistral Small 4

    Mistral AI

  2. US$0.75
    Gemini 3.8 Flash

    Google

  3. US$4.00
    GPT-5.6 Sol

    OpenAI

  4. US$10.00
    GPT-6 Astra

    OpenAI

  5. US$10.00
    Claude Fable 5.1

    Anthropic

출력 토큰 비용100만 토큰당 · USD
  1. US$0.60
    Mistral Small 4

    Mistral AI

  2. US$3.75
    Gemini 3.8 Flash

    Google

  3. US$20.00
    GPT-5.6 Sol

    OpenAI

  4. US$50.00
    GPT-6 Astra

    OpenAI

  5. US$50.00
    Claude Fable 5.1

    Anthropic

관련 비교

일대일 비교

  1. NVIDIA Nemotron 3.5 Lightning vs GPT-6 Astra

    어려운 엔드투엔드 작업을 위한 OpenAI의 가장 유능한 모델로 개척 추론과 백만 토큰 컨텍스트 창 및 광범위한 에이전트 도구 세트를 결합합니다.

    전체 비교 열기
  2. NVIDIA Nemotron 3.5 Lightning vs GPT-5.6 Sol

    매우 큰 컨텍스트 창과 광범위한 기본 도구 세트를 갖춘 어려운 코딩, 분석 및 전문 작업을 위한 OpenAI의 대표적인 일반 모델입니다.

    전체 비교 열기
  3. NVIDIA Nemotron 3.5 Lightning vs Claude Fable 5.1

    강력한 비전과 엔터프라이즈 시장 가용성을 갖춘 야심차고 장기간 실행되는 에이전트 및 코딩 작업을 위한 Anthropic의 선구적인 모델입니다.

    전체 비교 열기
  4. NVIDIA Nemotron 3.5 Lightning vs Gemini 3.8 Flash

    Google는 초기 플래시 계층 가격으로 에이전트, 소프트웨어 작업 및 대규모 혼합 미디어 입력을 위한 안정적이고 효율적인 고효율 다중 모드 모델입니다.

    전체 비교 열기
  5. NVIDIA Nemotron 3.5 Lightning vs Grok 4.6

    직접 웹, X 및 코드 도구를 사용하여 코딩, 에이전트 작업 및 지식 작업을 위한 SpaceXAI의 최첨단 텍스트 및 이미지 모델입니다.

    전체 비교 열기
  6. NVIDIA Nemotron 3.5 Lightning vs Grok 4.20 Multi-Agent Beta

    여러 AI 에이전트를 보내 어려운 질문을 동시에 조사한 다음 그들의 작업을 하나의 조사 답변으로 결합하는 전문 Grok 모델입니다.

    전체 비교 열기
  7. NVIDIA Nemotron 3.5 Lightning vs Inkling

    사용자 정의 가능한 추론, 코딩, 도구, 비전 및 오디오 워크플로우를 위한 Thinking Machines Lab의 대규모 개방형 가중치 모델입니다.

    전체 비교 열기
  8. NVIDIA Nemotron 3.5 Lightning vs Mistral Medium 3.5

    256K 컨텍스트 창을 갖춘 까다로운 멀티모달, 코딩, 추론 및 에이전트 워크플로를 위한 Mistral의 개방형 프론티어 모델입니다.

    전체 비교 열기
  9. NVIDIA Nemotron 3.5 Lightning vs Mistral Small 4

    일반적인 지시 따르기, 추론, 코딩, 비전 및 에이전트 도구를 하나의 엔드포인트에 결합한 Mistral의 저렴한 개방형 모델입니다.

    전체 비교 열기
  10. NVIDIA Nemotron 3.5 Lightning vs Qwen3.8 Max

    긴 맥락 추론, 코딩, 도구 및 텍스트, 이미지 및 비디오 이해를 위한 Alibaba의 최전선 Qwen 모델입니다.

    전체 비교 열기
  11. NVIDIA Nemotron 3.5 Lightning vs MiniMax M3

    저렴한 직접 API 가격으로 코딩, 에이전트, 컴퓨터 사용 및 장기 프로젝트를 위한 MiniMax의 백만 토큰 다중 모드 모델입니다.

    전체 비교 열기
  12. NVIDIA Nemotron 3.5 Lightning vs GLM-5.3

    자체 호스팅 및 관리 경로 전반의 코딩, 도구 및 에이전트 작업을 위한 Z.ai의 개방형 장기 컨텍스트 추론 모델입니다.

    전체 비교 열기
  13. NVIDIA Nemotron 3.5 Lightning vs Kimi K3

    백만 토큰 코딩, 추론, 지식 작업 및 도구 기반 에이전트를 위한 Moonshot AI의 최전선 다중 모달 모델입니다.

    전체 비교 열기
  14. NVIDIA Nemotron 3.5 Lightning vs Falcon-H1R-7B

    텍스트 작업, 긴 컨텍스트 및 자체 호스팅 함수 호출 워크플로를 위한 TII의 컴팩트 개방형 추론 모델입니다.

    전체 비교 열기
  15. NVIDIA Nemotron 3.5 Lightning vs Falcon-H1-34B-Instruct

    다국어 텍스트, 코딩 및 제어된 자체 호스팅 애플리케이션을 위한 TII의 34B 개방형 명령 모델입니다.

    전체 비교 열기
  16. NVIDIA Nemotron 3.5 Lightning vs Muse Spark 1.3

    장기 실행 에이전트, 코딩, 도구 및 복잡한 사용자 협업을 위한 Meta의 최신 다중 모달 추론 모델입니다.

    전체 비교 열기
  17. NVIDIA Nemotron 3.5 Lightning vs Celeris-1 Magnus

    빠른 추론, 도구 루프, 구조화된 작업 및 OpenAI 호환 통합을 위한 Celeris' 에이전트 중심 확산 언어 모델입니다.

    전체 비교 열기
  18. NVIDIA Nemotron 3.5 Lightning vs NVIDIA Nemotron 3 Ultra

    복잡한 에이전트, 코딩, 계획, 도구, RAG 및 백만 토큰 분석을 위한 NVIDIA 최대 Nemotron 3 추론 모델입니다.

    전체 비교 열기
  19. NVIDIA Nemotron 3.5 Lightning vs Qwen3.8-Flash

    빠른 에이전트, 코딩, 문서 작업, 비전, 비디오 이해 및 도구 사용을 위한 Alibaba의 효율적인 백만 컨텍스트 다중 모달 모델입니다.

    전체 비교 열기
  20. NVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Pro

    어려운 추론, 코딩, 장기 실행 에이전트, 도구 및 매우 큰 출력을 위한 DeepSeek의 대표적인 백만 컨텍스트 텍스트 모델입니다.

    전체 비교 열기
  21. NVIDIA Nemotron 3.5 Lightning vs DeepSeek-V4-Flash

    대용량 추론, 코딩, 에이전트 및 백만 토큰 텍스트 워크로드를 위한 DeepSeek의 저렴한 V4 모델입니다.

    전체 비교 열기