Kimi K3: A IA Chinesa que Diz Competir com o Claude (Review 2026)

Última atualização: 29 de agosto de 2026.

O Kimi K3, da chinesa Moonshot AI, tornou-se viral em julho de 2026 por uma razão concreta: 2,8 biliões de parâmetros, o maior modelo open-weight já lançado. À sua volta apareceram três alegações que circulam sem grande escrutínio: que corre “localmente” via Ollama, que é código aberto sem restrições, e que bate o Claude e o GPT.

Nenhuma das três é totalmente verdadeira, e a própria Moonshot admite isso no seu blog oficial. Esta review separa o que é facto verificável do que é marketing.

O que é o Kimi K3?

É o modelo mais recente da Moonshot AI, empresa de Pequim apoiada pela Alibaba, lançado a 16 de julho de 2026. Tem 2,8 biliões de parâmetros (arquitetura Mixture of Experts, ativando 16 de 896 “especialistas” por tarefa), janela de contexto de 1 milhão de tokens, e é nativamente multimodal (texto, imagem e vídeo na mesma rede).

A Moonshot chama-lhe “o primeiro modelo aberto da classe 3T”. A empresa prepara também uma entrada em bolsa em Hong Kong, no mesmo movimento já visto na MiniMax e na z.ai.

Três alegações a separar do facto

“Corre no Ollama, no meu computador”: mito

A entrada do Kimi K3 na biblioteca do Ollama usa o sufixo kimi-k3:cloud. Isso significa que os pedidos são enviados para servidores da Ollama, não para a tua máquina, e consomem créditos pagos. O ficheiro de pesos original ocupa cerca de 1,56 TB.

Mesmo em quantizações mais agressivas (a comunidade já publicou versões de ~600 GB), a Moonshot recomenda 64 ou mais aceleradores para servir o modelo, e as próprias equipas do vLLM afirmam que o K3 “mal cabe” num único nó DGX B300.

Não há cenário realista em que isto corre num portátil ou numa GPU de consumidor, ao contrário, por exemplo, do MiniMax H3 (já coberto neste site), que corre numa RTX 3060 com quantização.

“É open-source, tipo MIT”: parcialmente verdade

Os pesos foram mesmo publicados (27 de julho de 2026), o que é raro num modelo desta escala. Mas a licença mudou: os modelos anteriores da linha K2 usavam uma licença Modified MIT, bastante permissiva; o Kimi K3 vem sob uma licença própria, a “Kimi K3 License”, com gatilhos comerciais (obrigação de acordo separado com a Moonshot acima de $20 milhões de receita em 12 meses consecutivos, ou acima de 100 milhões de utilizadores mensais).

Ou seja, é aberto no sentido de “podes descarregar e inspecionar”, mas não é permissivo sem condições como o MIT clássico.

“Bate o Claude e o GPT”: parcial, e a Moonshot é a primeira a dizer isso

No seu próprio blog técnico, a Moonshot escreve textualmente que o desempenho geral do Kimi K3 “ainda fica atrás dos modelos proprietários mais poderosos, o Claude Fable 5 e o GPT 5.6 Sol”, e reconhece nas limitações oficiais “uma diferença notável na experiência de utilização” face a esses dois modelos.

O que é real: em tarefas específicas (por exemplo, otimização de kernels GPU), o Kimi K3 teve desempenho competitivo com o Fable 5 e superou claramente o Claude Opus 4.8 e o GPT 5.5. É uma vitória real, mas pontual, não uma vitória geral. A cobertura na imprensa (a Fortune, entre outros) resumiu isto como “K3 aproxima a IA chinesa do nível Fable”, uma leitura razoável dos dados, mas não o mesmo que “o K3 é melhor que o Claude”.

Como experimentar o Kimi K3 na prática

  1. Chat gratuito: em kimi.ai (atenção: kimi.com redireciona para a versão chinesa do produto; a versão internacional em inglês está em kimi.ai).
  2. Nota sobre o plano gratuito: o plano Adagio (€0) dá chat básico ilimitado, mas a Moonshot não confirma publicamente que o modelo servido por defeito no plano gratuito é mesmo o K3, a única garantia documentada é que o K2.6 não consome créditos. Se o K3 é o que importa para ti, confirma diretamente na conta antes de assumir que está incluído de graça.
  3. Para programação: Kimi Code, selecionando o Kimi K3 com o comando /model no terminal.
  4. Via API: em platform.kimi.ai, chave de API e o modelo kimi-k3.
  5. Nota de timing: em julho/agosto de 2026 a Moonshot pausou temporariamente novas subscrições pagas por excesso de procura, com reabertura por lotes sem data anunciada. Confirma disponibilidade antes de planear à volta disto.

Vantagens e Desvantagens

Vantagens

  • Maior modelo open-weight já lançado, com pesos publicamente descarregáveis
  • Janela de contexto de 1 milhão de tokens, rara mesmo entre modelos proprietários
  • Desempenho pontualmente competitivo com os melhores modelos do mercado em tarefas de código e agentes de longa duração
  • Cache de prompt com desconto de 90% no preço de entrada, o que reduz bastante o custo real em cargas de trabalho de programação

Desvantagens

  • Impossível de correr localmente em hardware de consumidor, apesar de “open-weight” sugerir isso a muita gente
  • Licença própria com gatilhos comerciais, não é MIT/Apache sem condições
  • A própria empresa admite uma “diferença notável” de experiência face ao Claude Fable 5 e ao GPT 5.6 Sol
  • Pensa sempre em modo “thinking” (não pode ser desligado), o que encarece a fatura por tokens de saída
  • Sinais de instabilidade comercial recentes: pausa de novas subscrições, reestruturação de planos ainda em curso

Para quem é indicado?

Faz sentido para equipas técnicas com necessidade real de contexto muito longo (1M tokens) ou que já usam a API a pensar em custo por token, aproveitando o desconto de cache. Faz sentido também para quem já corre modelos abertos em infraestrutura própria (cluster multi-GPU real, não um portátil) e quer avaliar o estado da arte chinesa.

Não faz sentido para quem leu “corre no Ollama” e espera usar isto na sua própria máquina, nem para quem procura uma alternativa gratuita estável ao ChatGPT ou Claude sem surpresas de disponibilidade.

Preços (2026)

  • Chat em kimi.ai: plano gratuito (Adagio) disponível; planos pagos reportados entre $19 e $199/mês (nomes Moderato, Allegretto, Allegro, Vivace)
  • API oficial: $3,00 por milhão de tokens de entrada, $15,00 por milhão de saída, $0,30 por milhão em cache-hit (confirmado na fonte oficial)
  • Auto-hospedagem dos pesos: sem custo de licença dentro dos limites de receita, mas exige cluster multi-GPU de nível empresarial, não é uma opção “grátis” na prática para a esmagadora maioria dos leitores

Nota: a Moonshot pausou novas subscrições pagas em julho de 2026 e sinalizou uma reestruturação de planos ainda em curso. Os valores acima podem já estar desatualizados. Confirma sempre em kimi.ai/membership/pricing antes de decidir.

Kimi K3 vs DeepSeek

O DeepSeek continua a ser o modelo chinês mais testado e discutido fora da China, com preços de API historicamente mais baixos e sem o mesmo nível de instabilidade comercial recente. O Kimi K3 aposta tudo na escala (2,8T parâmetros, contexto de 1M tokens) e em tarefas de longa duração para agentes de código, um nicho mais específico.

Para quem só quer texto e raciocínio ao menor custo possível, o DeepSeek continua a ser o ponto de comparação mais direto; para quem precisa mesmo de contexto muito longo ou está a explorar o limite superior dos modelos abertos, o K3 é o mais avançado disponível hoje.

Perguntas Frequentes

O Kimi K3 corre no meu computador via Ollama?

Não. O tag kimi-k3:cloud do Ollama envia os pedidos para servidores remotos e consome créditos pagos. O modelo real precisa de um cluster com dezenas de GPUs de nível empresarial.

O Kimi K3 é gratuito?

O chat em kimi.ai tem um plano gratuito, mas não há confirmação pública de que esse plano gratuito serve mesmo o K3 por defeito. Via API, é sempre pago por token.

O Kimi K3 é mesmo melhor que o Claude?

Não de forma geral. A própria Moonshot afirma que o Kimi K3 fica atrás do Claude Fable 5 e do GPT 5.6 Sol no desempenho global, com vitórias pontuais em tarefas específicas de código.

Posso usar o Kimi K3 numa empresa europeia?

Como qualquer modelo chinês, implica processar dados fora da União Europeia via API oficial, ou exige infraestrutura própria significativa para auto-hospedar os pesos com controlo total dos dados. Vale a pena avaliar caso a caso, sobretudo em contextos sujeitos a RGPD.

Conclusão

O Kimi K3 é um marco técnico real, não é só hype: é genuinamente o maior modelo open-weight já lançado, com resultados pontuais que rivalizam com o topo do mercado. Mas várias das alegações que circulam à sua volta (correr localmente via Ollama, ser “open-source sem restrições”, “bater o Claude”) não resistem à verificação direta na própria documentação da Moonshot.

Vale a pena testar o chat gratuito em kimi.ai para perceber a qualidade, mas sem esperar que isto substitua um cluster de GPUs por um Ollama no teu portátil.

→ Experimenta o Kimi K3 em kimi.ai

Featured on Wired Business
Scroll to Top