GPT-5.6 Luna
A faixa econômica do GPT-5.6 para processar muitas tarefas curtas e repetitivas.
A faixa econômica do GPT-5.6 para processar muitas tarefas curtas e repetitivas.
Visão geral em inglês simples
O Luna aceita texto e imagens e oferece saída estruturada e ferramentas. Comece com tarefas delimitadas, como etiquetar, extrair campos e encaminhar solicitações; verifique a precisão antes de ampliar suas responsabilidades.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Preços e comparações
Defina seu uso. A estimativa é atualizada enquanto você digita.
Exemplo: 6.000 tokens de entrada para 10 páginas e 500 para o resumo. O tamanho varia; ajuste os valores.
Uma execução envia sua entrada ao modelo uma vez e recebe uma resposta. Tokens são partes de texto: entrada é o que você envia, saída é a resposta que recebe.
GPT-5.6 Luna
OpenAI
Total estimado (USD)
Para o uso indicado · USD · Preço de API, não de assinatura
Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.
Acesso à API e ao provedor
Disponibilidade
Acesso direto à API nos países atendidos; aplicam-se restrições de conta e região.
Verifique a lista de países com suporte ativo do OpenAI antes da implantação.
Verifique a disponibilidade ao vivoDados e treinamento
OpenAI diz que as entradas e saídas da API não são usadas para treinamento de modelo por padrão. Os registros padrão de monitoramento de abuso podem ser retidos por até 30 dias; as organizações qualificadas podem solicitar outros controles.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
A faixa econômica do GPT-5.6 para processar muitas tarefas curtas e repetitivas. O Luna aceita texto e imagens e oferece saída estruturada e ferramentas. Comece com tarefas delimitadas, como etiquetar, extrair campos e encaminhar solicitações; verifique a precisão antes de ampliar suas responsabilidades.
GPT-5.6 Luna foi lançado em 9 de julho de 2026 de acordo com os materiais do fornecedor citado.
Acesso direto à API nos países atendidos; aplicam-se restrições de conta e região. As rotas de acesso listadas neste guia são OpenAI.
$0.2 entrada · $1.2 saída / 1M de tokens. Tarifas padrão da API. Prompts acima de 272K tokens de entrada custam mais; cache e ferramentas são cobrados separadamente.
Acesso direto à API nos países atendidos; aplicam-se restrições de conta e região. Verifique a lista de países com suporte ativo do OpenAI antes da implantação.
OpenAI diz que as entradas e saídas da API não são usadas para treinamento de modelo por padrão. Os registros padrão de monitoramento de abuso podem ser retidos por até 30 dias; as organizações qualificadas podem solicitar outros controles. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
Um preço por modelo com a mesma proporção de entrada e saída. Ponderamos cada tarifa da API por sua participação em um milhão de tokens totais e usamos a rota revisada compatível mais barata. É uma tarifa comparativa, não um custo por tarefa nem uma nota de qualidade. Tokenização, cache, raciocínio e contexto longo podem alterar sua conta.
75% entrada + 25% saída · sem descontos de cache
Mistral AI
OpenAI
Este modelo
Anthropic
Anthropic
OpenAI
OpenAI
Anthropic
Anthropic
OpenAI
Anthropic
Comparações relacionadas
Uma opção GPT-5.6 de menor custo para programação, análise e assistentes que usam ferramentas.
Abrir comparação completaO modelo Fable original para programação complexa e trabalho em várias etapas, mantido para integrações existentes.
Abrir comparação completaUm modelo Claude para mudanças significativas de código, raciocínio e fluxos de negócios com várias etapas.
Abrir comparação completaUma opção Claude de menor preço para programação, escrita e trabalho cotidiano com ferramentas.
Abrir comparação completaUm modelo Claude compacto para respostas rápidas, classificação e assistentes com funções delimitadas.
Abrir comparação completaO modelo mais capaz do OpenAI para trabalhos difíceis de ponta a ponta, combinando raciocínio de fronteira com uma janela de contexto de um milhão de tokens e um amplo conjunto de ferramentas de agente.
Abrir comparação completaO principal modelo geral do OpenAI para codificação, análise e trabalho profissional difíceis, com uma janela de contexto muito grande e um amplo conjunto de ferramentas nativas.
Abrir comparação completaO modelo de fronteira do Anthropic para trabalho ambicioso e de longa duração de agente e codificação, com forte visão e disponibilidade de mercado empresarial.
Abrir comparação completaModelo multimodal estável e de alta eficiência do Google para agentes, trabalho de software e grandes entradas de mídia mista a um preço introdutório de nível Flash.
Abrir comparação completaModelo de texto e imagem de fronteira do SpaceXAI para codificação, tarefas de agente e trabalho de conhecimento, com web direta, X e ferramentas de código.
Abrir comparação completaUm modelo Grok especializado que envia vários agentes de IA para investigar uma questão difícil em paralelo e depois combina seu trabalho em uma resposta pesquisada.
Abrir comparação completaModelo de grandes pesos abertos do Thinking Machines Lab para raciocínio, codificação, ferramentas, visão e fluxos de trabalho de áudio personalizáveis.
Abrir comparação completaO modelo de fronteira aberta da Mistral para fluxos de trabalho multimodais, de codificação, de raciocínio e de agentes exigentes, com uma janela de contexto de 256K.
Abrir comparação completaO modelo aberto de baixo custo da Mistral que combina acompanhamento normal de instruções, raciocínio, codificação, visão e ferramentas de agente em um único endpoint.
Abrir comparação completaModelo Qwen de fronteira do Alibaba para raciocínio de longo contexto, codificação, ferramentas e compreensão de texto, imagens e vídeo.
Abrir comparação completaModelo multimodal de um milhão de tokens do MiniMax para codificação, agentes, uso de computador e projetos longos a um baixo preço direto de API.
Abrir comparação completaModelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas.
Abrir comparação completaModelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.
Abrir comparação completaModelo de raciocínio aberto e compacto do TII para tarefas de texto, contextos longos e fluxos de trabalho de chamada de função auto-hospedados.
Abrir comparação completaModelo de instrução aberta 34B da TII para texto multilíngue, codificação e aplicativos auto-hospedados controlados.
Abrir comparação completaO mais recente modelo de raciocínio multimodal do Meta para agentes de longa execução, codificação, ferramentas e colaboração complexa de usuários.
Abrir comparação completaModelo de linguagem de difusão focado em agente Celeris para raciocínio rápido, loops de ferramentas, ações estruturadas e integração compatível com OpenAI.
Abrir comparação completaO maior modelo de raciocínio Nemotron 3 do NVIDIA para agentes complexos, codificação, planejamento, ferramentas, RAG e análise de milhões de tokens.
Abrir comparação completaModelo compacto de mistura de especialistas de 30B do NVIDIA para agentes especializados eficientes e fluxos de trabalho de texto de alto volume.
Abrir comparação completaModelo multimodal eficiente de um milhão de contextos do Alibaba para agentes rápidos, codificação, trabalho documental, visão, compreensão de vídeo e uso de ferramentas.
Abrir comparação completaO principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.
Abrir comparação completaModelo V4 de baixo custo do DeepSeek para raciocínio, codificação, agentes e cargas de trabalho de texto de milhões de tokens de alto volume.
Abrir comparação completa