Kimi K3
Modelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.
Modelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas.
Visão geral em inglês simples
Kimi K3 pode funcionar com texto e imagens enquanto retém até um milhão de tokens de contexto. Moonshot enfatiza longos fluxos de trabalho de codificação e agente, com níveis de raciocínio e uso de ferramentas disponíveis por meio de sua plataforma direta de desenvolvedor e parceiros selecionados.
O preço direto separa entradas armazenadas em cache e não armazenadas em cache, o que pode tornar os contextos grandes e repetidos muito mais baratos quando um aplicativo é projetado para reutilizá-los. OpenRouter e outros provedores têm suas próprias taxas e políticas operacionais.
Comparação de categorias
Estas são especificações publicadas pelo fornecedor, não pontuações de benchmark Cody. Siga as fontes vinculadas para limites atuais e exceções específicas de endpoint.
Preços e comparações
Defina seu uso. A estimativa é atualizada enquanto você digita.
Exemplo: 6.000 tokens de entrada para 10 páginas e 500 para o resumo. O tamanho varia; ajuste os valores.
Uma execução envia sua entrada ao modelo uma vez e recebe uma resposta. Tokens são partes de texto: entrada é o que você envia, saída é a resposta que recebe.
Kimi K3
Moonshot AI
Total estimado (USD)
Para o uso indicado · USD · Preço de API, não de assinatura
Estimativas sem impostos, ferramentas, armazenamento/gravação de cache, franquias gratuitas e descontos personalizados. Imagens incluem apenas a saída, sem prompt ou referências. Os modos de qualidade variam. Configurações não listadas não são consideradas gratuitas.
Acesso à API e ao provedor
Disponibilidade
Disponível através da plataforma de desenvolvedor Kimi e de fornecedores selecionados, incluindo OpenRouter e QwenCloud.
A plataforma direta Kimi opera sob os termos publicados da Moonshot; o suporte de terceiros para regiões e países depende do provedor escolhido.
Verifique a disponibilidade ao vivoDados e treinamento
Os termos de privacidade e uso do modelo da API da Moonshot permitem que o conteúdo enviado seja armazenado e usado para fornecer, manter, desenvolver e melhorar o serviço. Obtenha os termos empresariais apropriados antes de enviar material confidencial.
Esta é uma leitura concisa do material citado do fornecedor, e não um aconselhamento jurídico. Um gateway de terceiros pode ter diferentes termos de armazenamento, roteamento, treinamento e residência da API direta do criador do modelo.
Leia a política do provedorPerguntas frequentes
Modelo multimodal de fronteira do Moonshot AI para codificação de milhões de tokens, raciocínio, trabalho de conhecimento e agentes orientados por ferramentas. Kimi K3 pode funcionar com texto e imagens enquanto retém até um milhão de tokens de contexto. Moonshot enfatiza longos fluxos de trabalho de codificação e agente, com níveis de raciocínio e uso de ferramentas disponíveis por meio de sua plataforma direta de desenvolvedor e parceiros selecionados.
Kimi K3 foi lançado em 22 de julho de 2026 de acordo com os materiais do fornecedor citado.
Disponível através da plataforma de desenvolvedor Kimi e de fornecedores selecionados, incluindo OpenRouter e QwenCloud. As rotas de acesso listadas neste guia são Moonshot AI, Kimi Platform e OpenRouter.
Entrada sem cache de US$ 3 · Saída de US$ 15/1 milhão de tokens diretos. Moonshot também lista US$ 0,30 por milhão de tokens de entrada em cache. OpenRouter e outras rotas hospedadas usam preços diferentes.
Disponível através da plataforma de desenvolvedor Kimi e de fornecedores selecionados, incluindo OpenRouter e QwenCloud. A plataforma direta Kimi opera sob os termos publicados da Moonshot; o suporte de terceiros para regiões e países depende do provedor escolhido.
Os termos de privacidade e uso do modelo da API da Moonshot permitem que o conteúdo enviado seja armazenado e usado para fornecer, manter, desenvolver e melhorar o serviço. Obtenha os termos empresariais apropriados antes de enviar material confidencial. A política pertence à rota do provedor e aos termos da conta, portanto, verifique-a novamente antes do uso em produção.
USD por milhão de tokens nas APIs indicadas com contexto padrão. Tarifas de cache e contexto longo podem variar. Modelos sem preços revisados compatíveis são omitidos; menor custo não significa melhor qualidade.
Mistral AI
OpenAI
OpenAI
Anthropic
Mistral AI
OpenAI
OpenAI
Anthropic
Comparações relacionadas
O modelo mais capaz do OpenAI para trabalhos difíceis de ponta a ponta, combinando raciocínio de fronteira com uma janela de contexto de um milhão de tokens e um amplo conjunto de ferramentas de agente.
Abrir comparação completaO principal modelo geral do OpenAI para codificação, análise e trabalho profissional difíceis, com uma janela de contexto muito grande e um amplo conjunto de ferramentas nativas.
Abrir comparação completaO modelo de fronteira do Anthropic para trabalho ambicioso e de longa duração de agente e codificação, com forte visão e disponibilidade de mercado empresarial.
Abrir comparação completaModelo multimodal estável e de alta eficiência do Google para agentes, trabalho de software e grandes entradas de mídia mista a um preço introdutório de nível Flash.
Abrir comparação completaModelo de texto e imagem de fronteira do SpaceXAI para codificação, tarefas de agente e trabalho de conhecimento, com web direta, X e ferramentas de código.
Abrir comparação completaUm modelo Grok especializado que envia vários agentes de IA para investigar uma questão difícil em paralelo e depois combina seu trabalho em uma resposta pesquisada.
Abrir comparação completaModelo de grandes pesos abertos do Thinking Machines Lab para raciocínio, codificação, ferramentas, visão e fluxos de trabalho de áudio personalizáveis.
Abrir comparação completaO modelo de fronteira aberta da Mistral para fluxos de trabalho multimodais, de codificação, de raciocínio e de agentes exigentes, com uma janela de contexto de 256K.
Abrir comparação completaO modelo aberto de baixo custo da Mistral que combina acompanhamento normal de instruções, raciocínio, codificação, visão e ferramentas de agente em um único endpoint.
Abrir comparação completaModelo Qwen de fronteira do Alibaba para raciocínio de longo contexto, codificação, ferramentas e compreensão de texto, imagens e vídeo.
Abrir comparação completaModelo multimodal de um milhão de tokens do MiniMax para codificação, agentes, uso de computador e projetos longos a um baixo preço direto de API.
Abrir comparação completaModelo de raciocínio de longo contexto e peso aberto do Z.ai para codificação, ferramentas e trabalho de agente em rotas auto-hospedadas e gerenciadas.
Abrir comparação completaModelo de raciocínio aberto e compacto do TII para tarefas de texto, contextos longos e fluxos de trabalho de chamada de função auto-hospedados.
Abrir comparação completaModelo de instrução aberta 34B da TII para texto multilíngue, codificação e aplicativos auto-hospedados controlados.
Abrir comparação completaO mais recente modelo de raciocínio multimodal do Meta para agentes de longa execução, codificação, ferramentas e colaboração complexa de usuários.
Abrir comparação completaModelo de linguagem de difusão focado em agente Celeris para raciocínio rápido, loops de ferramentas, ações estruturadas e integração compatível com OpenAI.
Abrir comparação completaO maior modelo de raciocínio Nemotron 3 do NVIDIA para agentes complexos, codificação, planejamento, ferramentas, RAG e análise de milhões de tokens.
Abrir comparação completaModelo compacto de mistura de especialistas de 30B do NVIDIA para agentes especializados eficientes e fluxos de trabalho de texto de alto volume.
Abrir comparação completaModelo multimodal eficiente de um milhão de contextos do Alibaba para agentes rápidos, codificação, trabalho documental, visão, compreensão de vídeo e uso de ferramentas.
Abrir comparação completaO principal modelo de texto de um milhão de contexto do DeepSeek para raciocínio difícil, codificação, agentes de longa execução, ferramentas e resultados muito grandes.
Abrir comparação completaModelo V4 de baixo custo do DeepSeek para raciocínio, codificação, agentes e cargas de trabalho de texto de milhões de tokens de alto volume.
Abrir comparação completa