Todos os modelos
Z.ai

GLM-5.3

Modelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas.

Visão geral em inglês simples

O que GLM-5.3 realmente é

GLM-5.3 é um grande modelo aberto projetado para raciocínio e codificação de longo horizonte. Ele pode ser baixado e servido diretamente ou acessado por provedores hospedados que adicionam seus próprios limites de contexto, configurações de raciocínio, interfaces de ferramentas e preços de tokens.

Essa flexibilidade é seu principal atrativo: uma equipe pode começar por OpenRouter ou QwenCloud e depois passar para uma infraestrutura controlada. Isso também torna as comparações mais complicadas porque o mesmo nome de modelo pode ficar atrás de pilhas de serviços muito diferentes.

Bom ajuste para

  • Agentes de codificação de contexto longo
  • Experimentos empresariais abertos
  • Equipes que desejam diversas opções de provedores de inferência

Comparação de categorias

Os fatos que importam para os modelos texto

Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.

Janela de contexto
Até 1,31M em OpenRouter; 1 milhão em QwenCloudMáximo combinado de prompt e contexto de trabalho documentado pelo provedor.
Saída máxima
Até 262.144 tokens em OpenRouterLimite de resposta publicado pelo provedor, quando disponível.
Corte de conhecimento
Não publicadoÚltima data de conhecimento confiável publicada explicitamente pelo fornecedor do modelo. As ferramentas de pesquisa e conectadas podem recuperar informações mais recentes, mas não alteram o corte integrado do modelo.
Preço de entrada
A partir de US$ 1,15/1 milhão em OpenRouterPreço de lista padrão atual por milhão de tokens de entrada, salvo indicação em contrário.
Preço de saída
A partir de US$ 3,50/1 milhão em OpenRouterPreço de lista padrão atual por milhão de tokens de saída, salvo indicação em contrário.
Entradas
TextoTipos de mídia aceitos pelo endpoint do modelo listado.
Ferramentas e agentes
Ferramentas, resultados estruturados, raciocínio controlável em rotas suportadasFerramentas nativas selecionadas e recursos de criação de agentes, não uma lista exaustiva.

Preços e comparações

Estime seu custo

Defina seu uso. A estimativa é atualizada enquanto você digita.

Exemplo: 6.000 tokens de entrada para 10 páginas e 500 para o resumo. O tamanho varia; ajuste os valores.

Uma execução envia sua entrada ao modelo uma vez e recebe uma resposta. Tokens são partes de texto: entrada é o que você envia, saída é a resposta que recebe.

Opções avançadas

GLM-5.3

Z.ai

Total estimado (USD)

Sem preço revisado

Para o uso indicado · USD · Preço de API, não de assinatura

Como funciona esta estimativa

Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.

Acesso à API e ao provedor

Onde obter GLM-5.3

Disponibilidade

Regiões e estágio de acesso

Os pesos abertos estão disponíveis em Z.ai, com acesso hospedado por meio de QwenCloud, OpenRouter e outros provedores de inferência.

A auto-hospedagem dá ao operador controle de localização. As regiões hospedadas e o acesso ao país dependem do provedor selecionado.

Verifique a disponibilidade ao vivo

Dados e treinamento

A rota é importante.

Os pesos auto-hospedados mantêm avisos dentro da infraestrutura que você controla. QwenCloud afirma que não retém entradas ou saídas de API para treinamento; OpenRouter e outros provedores aplicam suas próprias políticas de rota.

Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.

Leia a política do provedor

Perguntas frequentes

Perguntas frequentes sobre GLM-5.3

O que é GLM-5.3?

Modelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas. GLM-5.3 é um grande modelo aberto projetado para raciocínio e codificação de longo horizonte. Ele pode ser baixado e servido diretamente ou acessado por provedores hospedados que adicionam seus próprios limites de contexto, configurações de raciocínio, interfaces de ferramentas e preços de tokens.

Quando o GLM-5.3 foi lançado?

GLM-5.3 foi lançado em 18 de agosto de 2026 de acordo com os materiais do fornecedor citado.

Onde posso acessar GLM-5.3?

Os pesos abertos estão disponíveis em Z.ai, com acesso hospedado por meio de QwenCloud, OpenRouter e outros provedores de inferência. As rotas de acesso listadas neste guia são Hugging Face, QwenCloud e OpenRouter.

Quanto custa GLM-5.3?

A partir de $ 1,15 de entrada · $ 3,50 de saída / 1 milhão de tokens em OpenRouter. Os preços e fornecedores de OpenRouter podem mudar. Os pesos abertos transferem o custo para o hardware e a pilha de serviços; QwenCloud tem sua própria taxa de mercado.

Onde o GLM-5.3 está disponível?

Os pesos abertos estão disponíveis em Z.ai, com acesso hospedado por meio de QwenCloud, OpenRouter e outros provedores de inferência. A auto-hospedagem dá ao operador controle de localização. As regiões hospedadas e o acesso ao país dependem do provedor selecionado.

Os dados da minha API GLM-5.3 são usados ​​para treinamento?

Os pesos auto-hospedados mantêm avisos dentro da infraestrutura que você controla. QwenCloud afirma que não retém entradas ou saídas de API para treinamento; OpenRouter e outros provedores aplicam suas próprias políticas de rota. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.

Comparação de preços

Um preço por modelo com a mesma proporção de entrada e saída. Ponderamos cada tarifa da API por sua participação em um milhão de tokens totais e usamos a rota revisada compatível mais barata. É uma tarifa comparativa, não um custo por tarefa nem uma nota de qualidade. Tokenização, cache, raciocínio e contexto longo podem alterar sua conta.

Custo combinado de tokenspor 1M de tokens no total · USD

75% entrada + 25% saída · sem descontos de cache

  1. US$ 0,20
    GPT-6 Luna

    OpenAI

  2. US$ 0,2625
    Mistral Small 4

    Mistral AI

  3. US$ 0,45
    GPT-5.6 Luna

    OpenAI

  4. US$ 1,50
    Gemini 3.8 Flash

    Google

  5. US$ 2,00
    Claude Haiku 4.5

    Anthropic

  6. US$ 4,00
    GPT-6 Sol

    OpenAI

  7. US$ 4,00
    Claude Sonnet 5

    Anthropic

  8. US$ 4,50
    GPT-5.6 Terra

    OpenAI

  9. US$ 8,00
    Daybreak Blue

    OpenAI

  10. US$ 8,00
    Claude Opus 5.5

    Anthropic

  11. US$ 8,00
    GPT-5.6 Sol

    OpenAI

  12. US$ 10,00
    Claude Opus 5

    Anthropic

  13. US$ 20,00
    Claude Fable 5

    Anthropic

  14. US$ 20,00
    GPT-6 Astra

    OpenAI

  15. US$ 20,00
    Claude Fable 5.1

    Anthropic

Comparações relacionadas

Comparações lado a lado

  1. GLM-5.3 vs Claude Opus 5.5

    Um modelo Claude para grandes alterações de código, pesquisas detalhadas e tarefas de negócios com várias etapas.

    Abrir comparação completa
  2. GLM-5.3 vs GPT-5.6 Terra

    Uma opção GPT-5.6 de menor custo para programação, análise e assistentes que usam ferramentas.

    Abrir comparação completa
  3. GLM-5.3 vs GPT-5.6 Luna

    A faixa econômica do GPT-5.6 para processar muitas tarefas curtas e repetitivas.

    Abrir comparação completa
  4. GLM-5.3 vs Claude Fable 5

    O modelo Fable original para programação complexa e trabalho em várias etapas, mantido para integrações existentes.

    Abrir comparação completa
  5. GLM-5.3 vs Claude Opus 5

    Um modelo Claude para mudanças significativas de código, raciocínio e fluxos de negócios com várias etapas.

    Abrir comparação completa
  6. GLM-5.3 vs Claude Sonnet 5

    Uma opção Claude de menor preço para programação, escrita e trabalho cotidiano com ferramentas.

    Abrir comparação completa
  7. GLM-5.3 vs Claude Haiku 4.5

    Um modelo Claude compacto para respostas rápidas, classificação e assistentes com funções delimitadas.

    Abrir comparação completa
  8. GLM-5.3 vs GPT-6 Astra

    O modelo mais capaz do OpenAI para trabalhos difíceis de ponta a ponta, combinando raciocínio de fronteira com uma janela de contexto de um milhão de tokens e um amplo conjunto de ferramentas de agente.

    Abrir comparação completa
  9. GLM-5.3 vs GPT-5.6 Sol

    O principal modelo geral do OpenAI para codificação, análise e trabalho profissional difíceis, com uma janela de contexto muito grande e um amplo conjunto de ferramentas nativas.

    Abrir comparação completa
  10. GLM-5.3 vs Claude Fable 5.1

    O modelo de fronteira do Anthropic para trabalho ambicioso e de longa duração de agente e codificação, com forte visão e disponibilidade de mercado empresarial.

    Abrir comparação completa
  11. GLM-5.3 vs Gemini 3.8 Flash

    Modelo multimodal estável e de alta eficiência do Google para agentes, trabalho de software e grandes entradas de mídia mista a um preço introdutório de nível Flash.

    Abrir comparação completa
  12. GLM-5.3 vs Grok 4.6

    Modelo de texto e imagem de fronteira do SpaceXAI para codificação, tarefas de agente e trabalho de conhecimento, com web direta, X e ferramentas de código.

    Abrir comparação completa
  13. GLM-5.3 vs Grok 4.20 Multi-Agent Beta

    Um modelo Grok especializado que envia vários agentes de IA para investigar uma questão difícil em paralelo e depois combina seu trabalho em uma resposta pesquisada.

    Abrir comparação completa
  14. GLM-5.3 vs Inkling

    Modelo de grandes pesos abertos do Thinking Machines Lab para raciocínio, codificação, ferramentas, visão e fluxos de trabalho de áudio personalizáveis.

    Abrir comparação completa
  15. GLM-5.3 vs Mistral Medium 3.5

    O modelo de fronteira aberta da Mistral para fluxos de trabalho multimodais, de codificação, de raciocínio e de agentes exigentes, com uma janela de contexto de 256K.

    Abrir comparação completa
  16. GLM-5.3 vs Mistral Small 4

    O modelo aberto de baixo custo da Mistral que combina acompanhamento normal de instruções, raciocínio, codificação, visão e ferramentas de agente em um único endpoint.

    Abrir comparação completa
  17. GLM-5.3 vs Qwen3.8 Max

    Modelo Qwen de fronteira do Alibaba para raciocínio de longo contexto, codificação, ferramentas e compreensão de texto, imagens e vídeo.

    Abrir comparação completa
  18. GLM-5.3 vs MiniMax M3

    Modelo multimodal de um milhão de tokens do MiniMax para codificação, agentes, uso de computador e projetos longos a um baixo preço direto de API.

    Abrir comparação completa
  19. GLM-5.3 vs Kimi K3

    Modelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.

    Abrir comparação completa
  20. GLM-5.3 vs Falcon-H1R-7B

    Modelo de raciocínio aberto e compacto do TII para tarefas de texto, contextos longos e fluxos de trabalho de chamada de função auto-hospedados.

    Abrir comparação completa
  21. GLM-5.3 vs Falcon-H1-34B-Instruct

    Modelo de instrução aberta 34B da TII para texto multilíngue, codificação e aplicativos auto-hospedados controlados.

    Abrir comparação completa
  22. GLM-5.3 vs Muse Spark 1.3

    O mais recente modelo de raciocínio multimodal do Meta para agentes de longa execução, codificação, ferramentas e colaboração complexa de usuários.

    Abrir comparação completa
  23. GLM-5.3 vs Celeris-1 Magnus

    Modelo de linguagem de difusão focado em agente Celeris para raciocínio rápido, loops de ferramentas, ações estruturadas e integração compatível com OpenAI.

    Abrir comparação completa
  24. GLM-5.3 vs NVIDIA Nemotron 3 Ultra

    O maior modelo de raciocínio Nemotron 3 do NVIDIA para agentes complexos, codificação, planejamento, ferramentas, RAG e análise de milhões de tokens.

    Abrir comparação completa
  25. GLM-5.3 vs NVIDIA Nemotron 3.5 Lightning

    Modelo compacto de mistura de especialistas de 30B do NVIDIA para agentes especializados eficientes e fluxos de trabalho de texto de alto volume.

    Abrir comparação completa
  26. GLM-5.3 vs Qwen3.8-Flash

    Modelo multimodal eficiente de um milhão de contextos do Alibaba para agentes rápidos, codificação, trabalho documental, visão, compreensão de vídeo e uso de ferramentas.

    Abrir comparação completa
  27. GLM-5.3 vs DeepSeek-V4-Pro

    O principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.

    Abrir comparação completa
  28. GLM-5.3 vs DeepSeek-V4-Flash

    Modelo V4 de baixo custo do DeepSeek para raciocínio, codificação, agentes e cargas de trabalho de texto de milhões de tokens de alto volume.

    Abrir comparação completa