A startup chinesa Moonshot AI anunciou no domingo (19) que pausou temporariamente novas assinaturas do Kimi K3, seu modelo de linguagem mais avançado. Em apenas 48 horas após o lançamento, a demanda por GPU chegou perto do limite da capacidade computacional da empresa.
“O Kimi K3 recebeu muito mais amor do que esperávamos, e nossas GPUs estão sentindo”, disse a Moonshot em publicação no X (antigo Twitter). A empresa afirmou que está expandindo a infraestrutura o mais rápido possível e reabrirá novas vagas em lotes.
Assinantes atuais não foram afetados pela pausa. Para distribuir melhor os recursos de processamento, a Moonshot também anunciou que vai dividir o plano de assinatura em dois: o Kimi Membership, para uso web, app e trabalho, e o Kimi Code Membership, focado em programação.

O modelo que superou as expectativas
Lançado em 16 de julho, o Kimi K3 é um modelo mixture-of-experts (MoE) com 2,8 trilhões de parâmetros e janela de contexto de 1 milhão de tokens. É o maior modelo open-weight já lançado, superando o DeepSeek V4, que tem 1,6 trilhão. Os pesos completos serão liberados até 27 de julho.
Nos primeiros testes independentes, o K3 alcançou o primeiro lugar no Frontend Code Arena do LMArena, com 1.679 pontos, superando o Claude Fable 5, da Anthropic, e o GPT-5.6 Sol, da OpenAI. O modelo também se destacou em benchmarks de codificação de longa duração, como o SWE Marathon (42% contra 35% do Fable 5), e em navegação web (BrowseComp, com 91,2%).
O sucesso do K3 reflete uma tendência mais ampla: modelos chineses open-source estão cada vez mais competitivos com os equivalentes fechados do Ocidente. A Moonshot AI, que registrou receita recorrente anual de US$ 300 milhões em junho, também prepara um IPO em Hong Kong, segundo fontes ouvidas pelo The Globe and Mail.
Custos e posicionamento
O Kimi K3 custa US$ 3 por milhão de tokens de entrada (US$ 0,30 com cache hit) e US$ 15 por milhão de tokens de saída. O preço é bem mais alto que o do K2.6 (US$ 0,95 entrada, US$ 4 saída), mas ainda fica abaixo dos principais concorrentes ocidentais.
| Modelo | Entrada (1M tokens) | Saída (1M tokens) |
|---|---|---|
| Kimi K3 | US$ 3,00 | US$ 15,00 |
| Claude Fable 5 | US$ 10,00 | US$ 50,00 |
| GPT-5.6 Sol | US$ 5,00 | US$ 30,00 |
| Kimi K2.6 | US$ 0,95 | US$ 4,00 |
Na prática, o custo efetivo por tarefa do K3 fica em torno de US$ 0,94, segundo o Artificial Analysis, contra US$ 1,04 do GPT-5.6 Sol e US$ 2,75 do Fable 5. A diferença é menor do que os preços de tabela sugerem, porque o K3 usa menos tokens de saída para chegar ao resultado.
Fontes: The Decoder, TechNode, CNN Brasil, The Globe and Mail




