DeepSeek-V4-Pro
O principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.
O principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.
Visão geral em inglês simples
DeepSeek-V4-Pro é a opção V4 maior, projetada para tarefas em que a confiabilidade do agente e o raciocínio mais profundo são mais importantes do que o preço mais baixo do token. Ele suporta controles de pensamento, chamadas de ferramentas, JSON estruturado, uma interface compatível com respostas e uma saída máxima grande o suficiente para códigos ou documentos substanciais.
DeepSeek publica taxas separadas de pico, fora de pico, armazenadas em cache e não armazenadas em cache. Esse preço pode recompensar cargas de trabalho programadas ou repetitivas, mas torna enganoso um único preço de token de título; estime a taxa de acertos do cache, o comprimento da saída e a combinação de horário do dia para o aplicativo real.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Preços e comparações
Defina seu uso. A estimativa é atualizada enquanto você digita.
Exemplo: 6.000 tokens de entrada para 10 páginas e 500 para o resumo. O tamanho varia; ajuste os valores.
Uma execução envia sua entrada ao modelo uma vez e recebe uma resposta. Tokens são partes de texto: entrada é o que você envia, saída é a resposta que recebe.
DeepSeek-V4-Pro
DeepSeek
Total estimado (USD)
Para o uso indicado · USD · Preço de API, não de assinatura
Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.
Acesso à API e ao provedor
Disponibilidade
Geralmente disponível no aplicativo da web DeepSeek e por meio de APIs compatíveis com OpenAI-, Anthropic- e Responses.
As páginas de modelo público do DeepSeek não enumeram uma lista global de países ou regiões de processamento específicas do modelo; confirmar a elegibilidade da conta e a lei aplicável.
Verifique a disponibilidade ao vivoDados e treinamento
DeepSeek documenta sua API de respostas como sem estado e diz que as respostas e conversas não são armazenadas por esse endpoint. Esta não é uma promessa completa de retenção ou uso de treinamento para toda a conta; revise os termos atuais da plataforma e o comportamento do cache automático para dados confidenciais.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
O principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes. DeepSeek-V4-Pro é a opção V4 maior, projetada para tarefas em que a confiabilidade do agente e o raciocínio mais profundo são mais importantes do que o preço mais baixo do token. Ele suporta controles de pensamento, chamadas de ferramentas, JSON estruturado, uma interface compatível com respostas e uma saída máxima grande o suficiente para códigos ou documentos substanciais.
DeepSeek-V4-Pro foi lançado em 13 de agosto de 2026 de acordo com os materiais do fornecedor citado.
Geralmente disponível no aplicativo da web DeepSeek e por meio de APIs compatíveis com OpenAI-, Anthropic- e Responses. As rotas de acesso listadas neste guia são DeepSeek API e DeepSeek.
Pico: entrada de $ 1,32 · saída de $ 3,96 / 1 milhão de tokens. A entrada e a saída sem cache fora do horário de pico custam US$ 0,66 e US$ 1,98 por milhão. A entrada em cache é mais barata e DeepSeek pode alterar a programação e os preços de pico.
Geralmente disponível no aplicativo da web DeepSeek e por meio de APIs compatíveis com OpenAI-, Anthropic- e Responses. As páginas de modelo público do DeepSeek não enumeram uma lista global de países ou regiões de processamento específicas do modelo; confirmar a elegibilidade da conta e a lei aplicável.
DeepSeek documenta sua API de respostas como sem estado e diz que as respostas e conversas não são armazenadas por esse endpoint. Esta não é uma promessa completa de retenção ou uso de treinamento para toda a conta; revise os termos atuais da plataforma e o comportamento do cache automático para dados confidenciais. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
USD por milhão de tokens nas APIs indicadas com contexto padrão. Tarifas de cache e contexto longo podem variar. Modelos sem preços revisados compatíveis são omitidos; menor custo não significa melhor qualidade.
Mistral AI
OpenAI
OpenAI
Anthropic
Mistral AI
OpenAI
OpenAI
Anthropic
Comparações relacionadas
O modelo mais capaz do OpenAI para trabalhos difíceis de ponta a ponta, combinando raciocínio de fronteira com uma janela de contexto de um milhão de tokens e um amplo conjunto de ferramentas de agente.
Abrir comparação completaO principal modelo geral do OpenAI para codificação, análise e trabalho profissional difíceis, com uma janela de contexto muito grande e um amplo conjunto de ferramentas nativas.
Abrir comparação completaO modelo de fronteira do Anthropic para trabalho ambicioso e de longa duração de agente e codificação, com forte visão e disponibilidade de mercado empresarial.
Abrir comparação completaModelo multimodal estável e de alta eficiência do Google para agentes, trabalho de software e grandes entradas de mídia mista a um preço introdutório de nível Flash.
Abrir comparação completaModelo de texto e imagem de fronteira do SpaceXAI para codificação, tarefas de agente e trabalho de conhecimento, com web direta, X e ferramentas de código.
Abrir comparação completaUm modelo Grok especializado que envia vários agentes de IA para investigar uma questão difícil em paralelo e depois combina seu trabalho em uma resposta pesquisada.
Abrir comparação completaModelo de grandes pesos abertos do Thinking Machines Lab para raciocínio, codificação, ferramentas, visão e fluxos de trabalho de áudio personalizáveis.
Abrir comparação completaO modelo de fronteira aberta da Mistral para fluxos de trabalho multimodais, de codificação, de raciocínio e de agentes exigentes, com uma janela de contexto de 256K.
Abrir comparação completaO modelo aberto de baixo custo da Mistral que combina acompanhamento normal de instruções, raciocínio, codificação, visão e ferramentas de agente em um único endpoint.
Abrir comparação completaModelo Qwen de fronteira do Alibaba para raciocínio de longo contexto, codificação, ferramentas e compreensão de texto, imagens e vídeo.
Abrir comparação completaModelo multimodal de um milhão de tokens do MiniMax para codificação, agentes, uso de computador e projetos longos a um baixo preço direto de API.
Abrir comparação completaModelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas.
Abrir comparação completaModelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.
Abrir comparação completaModelo de raciocínio aberto e compacto do TII para tarefas de texto, contextos longos e fluxos de trabalho de chamada de função auto-hospedados.
Abrir comparação completaModelo de instrução aberta 34B da TII para texto multilíngue, codificação e aplicativos auto-hospedados controlados.
Abrir comparação completaO mais recente modelo de raciocínio multimodal do Meta para agentes de longa execução, codificação, ferramentas e colaboração complexa de usuários.
Abrir comparação completaModelo de linguagem de difusão focado em agente Celeris para raciocínio rápido, loops de ferramentas, ações estruturadas e integração compatível com OpenAI.
Abrir comparação completaO maior modelo de raciocínio Nemotron 3 do NVIDIA para agentes complexos, codificação, planejamento, ferramentas, RAG e análise de milhões de tokens.
Abrir comparação completaModelo compacto de mistura de especialistas de 30B do NVIDIA para agentes especializados eficientes e fluxos de trabalho de texto de alto volume.
Abrir comparação completaModelo multimodal eficiente de um milhão de contextos do Alibaba para agentes rápidos, codificação, trabalho documental, visão, compreensão de vídeo e uso de ferramentas.
Abrir comparação completaModelo V4 de baixo custo do DeepSeek para raciocínio, codificação, agentes e cargas de trabalho de texto de milhões de tokens de alto volume.
Abrir comparação completa