Claude Sonnet 5
Uma opção Claude de menor preço para programação, escrita e trabalho cotidiano com ferramentas.
Uma opção Claude de menor preço para programação, escrita e trabalho cotidiano com ferramentas.
Visão geral em inglês simples
O Sonnet 5 combina uma ampla janela de contexto com pensamento adaptativo e ferramentas. Suas tarifas padrão por token são inferiores às do Opus, sendo uma opção a avaliar para trabalhos recorrentes que não precisam da faixa mais cara.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Preços e comparações
Defina seu uso. A estimativa é atualizada enquanto você digita.
Exemplo: 6.000 tokens de entrada para 10 páginas e 500 para o resumo. O tamanho varia; ajuste os valores.
Uma execução envia sua entrada ao modelo uma vez e recebe uma resposta. Tokens são partes de texto: entrada é o que você envia, saída é a resposta que recebe.
Claude Sonnet 5
Anthropic
Total estimado (USD)
Para o uso indicado · USD · Preço de API, não de assinatura
Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.
Acesso à API e ao provedor
Disponibilidade
Disponível através da plataforma Claude, AWS, Google Cloud, Microsoft Foundry e mercados suportados.
O acesso direto depende da lista de países suportados do Anthropic; as regiões de nuvem e a elegibilidade do mercado variam.
Verifique a disponibilidade ao vivoDados e treinamento
A Anthropic não treina com dados da API sem permissão expressa. A retenção depende do recurso da API, do contrato da conta e do provedor de nuvem.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
Uma opção Claude de menor preço para programação, escrita e trabalho cotidiano com ferramentas. O Sonnet 5 combina uma ampla janela de contexto com pensamento adaptativo e ferramentas. Suas tarifas padrão por token são inferiores às do Opus, sendo uma opção a avaliar para trabalhos recorrentes que não precisam da faixa mais cara.
Claude Sonnet 5 foi lançado em 30 de junho de 2026 de acordo com os materiais do fornecedor citado.
Disponível através da plataforma Claude, AWS, Google Cloud, Microsoft Foundry e mercados suportados. As rotas de acesso listadas neste guia são Anthropic e AWS, Google Cloud, Microsoft.
$2 entrada · $10 saída / 1M de tokens. Tarifas padrão da Claude API. Gravações de cache, ferramentas e acréscimos regionais podem aumentar a conta.
Disponível através da plataforma Claude, AWS, Google Cloud, Microsoft Foundry e mercados suportados. O acesso direto depende da lista de países suportados do Anthropic; as regiões de nuvem e a elegibilidade do mercado variam.
A Anthropic não treina com dados da API sem permissão expressa. A retenção depende do recurso da API, do contrato da conta e do provedor de nuvem. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
Um preço por modelo com a mesma proporção de entrada e saída. Ponderamos cada tarifa da API por sua participação em um milhão de tokens totais e usamos a rota revisada compatível mais barata. É uma tarifa comparativa, não um custo por tarefa nem uma nota de qualidade. Tokenização, cache, raciocínio e contexto longo podem alterar sua conta.
75% entrada + 25% saída · sem descontos de cache
Mistral AI
OpenAI
Anthropic
Anthropic
Este modelo
OpenAI
OpenAI
Anthropic
Anthropic
OpenAI
Anthropic
Comparações relacionadas
Uma opção GPT-5.6 de menor custo para programação, análise e assistentes que usam ferramentas.
Abrir comparação completaA faixa econômica do GPT-5.6 para processar muitas tarefas curtas e repetitivas.
Abrir comparação completaO modelo Fable original para programação complexa e trabalho em várias etapas, mantido para integrações existentes.
Abrir comparação completaUm modelo Claude para mudanças significativas de código, raciocínio e fluxos de negócios com várias etapas.
Abrir comparação completaUm modelo Claude compacto para respostas rápidas, classificação e assistentes com funções delimitadas.
Abrir comparação completaO modelo mais capaz do OpenAI para trabalhos difíceis de ponta a ponta, combinando raciocínio de fronteira com uma janela de contexto de um milhão de tokens e um amplo conjunto de ferramentas de agente.
Abrir comparação completaO principal modelo geral do OpenAI para codificação, análise e trabalho profissional difíceis, com uma janela de contexto muito grande e um amplo conjunto de ferramentas nativas.
Abrir comparação completaO modelo de fronteira do Anthropic para trabalho ambicioso e de longa duração de agente e codificação, com forte visão e disponibilidade de mercado empresarial.
Abrir comparação completaModelo multimodal estável e de alta eficiência do Google para agentes, trabalho de software e grandes entradas de mídia mista a um preço introdutório de nível Flash.
Abrir comparação completaModelo de texto e imagem de fronteira do SpaceXAI para codificação, tarefas de agente e trabalho de conhecimento, com web direta, X e ferramentas de código.
Abrir comparação completaUm modelo Grok especializado que envia vários agentes de IA para investigar uma questão difícil em paralelo e depois combina seu trabalho em uma resposta pesquisada.
Abrir comparação completaModelo de grandes pesos abertos do Thinking Machines Lab para raciocínio, codificação, ferramentas, visão e fluxos de trabalho de áudio personalizáveis.
Abrir comparação completaO modelo de fronteira aberta da Mistral para fluxos de trabalho multimodais, de codificação, de raciocínio e de agentes exigentes, com uma janela de contexto de 256K.
Abrir comparação completaO modelo aberto de baixo custo da Mistral que combina acompanhamento normal de instruções, raciocínio, codificação, visão e ferramentas de agente em um único endpoint.
Abrir comparação completaModelo Qwen de fronteira do Alibaba para raciocínio de longo contexto, codificação, ferramentas e compreensão de texto, imagens e vídeo.
Abrir comparação completaModelo multimodal de um milhão de tokens do MiniMax para codificação, agentes, uso de computador e projetos longos a um baixo preço direto de API.
Abrir comparação completaModelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas.
Abrir comparação completaModelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.
Abrir comparação completaModelo de raciocínio aberto e compacto do TII para tarefas de texto, contextos longos e fluxos de trabalho de chamada de função auto-hospedados.
Abrir comparação completaModelo de instrução aberta 34B da TII para texto multilíngue, codificação e aplicativos auto-hospedados controlados.
Abrir comparação completaO mais recente modelo de raciocínio multimodal do Meta para agentes de longa execução, codificação, ferramentas e colaboração complexa de usuários.
Abrir comparação completaModelo de linguagem de difusão focado em agente Celeris para raciocínio rápido, loops de ferramentas, ações estruturadas e integração compatível com OpenAI.
Abrir comparação completaO maior modelo de raciocínio Nemotron 3 do NVIDIA para agentes complexos, codificação, planejamento, ferramentas, RAG e análise de milhões de tokens.
Abrir comparação completaModelo compacto de mistura de especialistas de 30B do NVIDIA para agentes especializados eficientes e fluxos de trabalho de texto de alto volume.
Abrir comparação completaModelo multimodal eficiente de um milhão de contextos do Alibaba para agentes rápidos, codificação, trabalho documental, visão, compreensão de vídeo e uso de ferramentas.
Abrir comparação completaO principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.
Abrir comparação completaModelo V4 de baixo custo do DeepSeek para raciocínio, codificação, agentes e cargas de trabalho de texto de milhões de tokens de alto volume.
Abrir comparação completa