For AI agents: the public content index is available at https://we0.ai/llms.txt, and the English article bundle is available at https://we0.ai/llms-full.txt.
For AI agents: the complete content index is available at https://we0.ai/llms.txt, the full English article bundle is available at https://we0.ai/llms-full.txt, and this page is available as Markdown at https://we0.ai/pt/articles/kimi-k3-pauses-new-subscriptions-after.md.
O Kimi K3 estava disponível há apenas cerca de 48 horas quando a Moonshot AI anunciou que interromperia temporariamente a aceitação de novas...

O Kimi K3 estava disponível há apenas cerca de 48 horas quando a Moonshot AI anunciou que interromperia temporariamente a aceitação de novas assinaturas de consumidores.
O motivo não foi uma mudança planejada no produto ou falta de demanda. Foi o oposto. De acordo com a Moonshot, as solicitações pelo Kimi K3 superaram em muito suas previsões e se aproximaram do limite de capacidade de seus clusters de computação existentes.
Os usuários pagantes existentes puderam continuar usando o serviço. A Moonshot afirmou que direcionaria os recursos de computação disponíveis para os assinantes atuais enquanto expandia a capacidade e, em seguida, reabriria novas vagas de assinatura em lotes.

Aviso da Moonshot em 19 de julho explicando a escassez de computação e a pausa temporária nas assinaturas.
O problema repentino de capacidade veio após um lançamento excepcionalmente forte do Kimi K3, um modelo multimodal nativo de 2,8 trilhões de parâmetros projetado para codificação de longo prazo, criação visual, trabalho de conhecimento e tarefas baseadas em agentes.
A Moonshot descreve o K3 como o primeiro modelo aberto da classe 3T. Seu artigo de lançamento também afirma que os pesos completos do modelo estão programados para serem lançados até 27 de julho de 2026, portanto, "aberto" no lançamento deve ser entendido no contexto desse cronograma de lançamento anunciado.
O aumento na demanda é mais fácil de entender quando visto ao lado do desempenho inicial do modelo e do volume de demonstrações de usuários que surgiram logo após o lançamento.
O Kimi K3 entrou no mercado com uma janela de contexto de 1 milhão de tokens, capacidades de visão nativas e uma arquitetura esparsa de Mistura de Especialistas com 2,8 trilhões de parâmetros totais. Ele é voltado para tarefas que podem continuar por longos períodos e exigem chamadas repetidas de ferramentas, execução de código, inspeção visual ou raciocínio de múltiplas etapas.
O próprio blog técnico da Moonshot reconhece que o K3 ainda fica atrás do Claude Fable 5 e do GPT-5.6 Sol em desempenho geral. Ao mesmo tempo, o modelo obteve resultados fortes em várias avaliações de codificação e orientadas a agentes.
No momento coberto pelo relatório original, o Kimi K3 ocupava o primeiro lugar no ranking preliminar do WebDev da Arena com uma pontuação de aproximadamente 1.679.
O ranking ao vivo em 21 de julho mostrou o Kimi K3 em primeiro lugar com uma pontuação preliminar de 1.678, à frente do Claude Fable 5 e do GPT-5.6 Sol.

Resultado preliminar de primeiro lugar do Kimi K3 no ranking de desenvolvimento frontend da Arena.
As avaliações de frontend são úteis porque testam mais do que se um modelo pode produzir código válido. Um resultado forte geralmente exige que o modelo entenda um objetivo visual, crie uma interface funcional, inspecione a saída renderizada e revise o
implementação.
O Kimi K3 foi projetado para esse tipo de fluxo de trabalho "visão no loop". Ele pode transitar entre código-fonte e capturas de tela ao vivo, usando o resultado renderizado como feedback para outra iteração de desenvolvimento.
Como o leaderboard é baseado em votação contínua, suas pontuações e posições podem mudar. A página ao vivo da Arena deve ser considerada a fonte atual, em vez de qualquer gráfico estático de lançamento.
O relatório original também destacou três avaliações de engenharia de software:
| Benchmark | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol |
|---|---|---|---|
| DeepSWE | 67,5 | 70,0 | 73,0 |
| Program Bench | 77,8 | 76,8 | 77,6 |
| SWE Marathon | 42,0 | 35,0 | 39,0 |

Resultados reportados do Kimi K3 em benchmarks de codificação e engenharia de software de longo horizonte.
Os resultados mostram um quadro mais equilibrado do que uma simples alegação de "melhor modelo".
O K3 ficou atrás do Claude Fable 5 e do GPT-5.6 Sol no DeepSWE, avançou ligeiramente no Program Bench e alcançou a pontuação mais alta reportada na comparação SWE Marathon da Moonshot.
A metodologia do benchmark é importante aqui. A Moonshot usou diferentes harnesses de agente dependendo do modelo e observa que sua avaliação SWE Marathon usou um branch calibrado para H20 das tarefas oficiais. Ela também relata que o Claude Fable 5 encontrou comportamento de fallback em parte dessa avaliação.
Essas diferenças não tornam os resultados inúteis, mas significam que pontuações de diferentes harnesses não devem ser tratadas como condições perfeitamente idênticas de laboratório.
Os leaderboards foram apenas uma parte do lançamento. Os desenvolvedores também começaram a publicar sites, ferramentas interativas, jogos, cenas 3D e experimentos visuais criados com o K3.
Um exemplo apresentou um jogo de mundo aberto que um usuário disse que teria sido difícil imaginar gerar a partir de um prompt apenas alguns meses antes.

Demonstração de um usuário de um jogo de mundo aberto criado com o Kimi K3.
Outro usuário comparou o Kimi K3 e o Claude Opus 4.8 na tarefa de gerar um ambiente de armazém virtual. Na comparação publicada, o resultado do Kimi continha mais iluminação, objetos, estrutura ambiental e detalhes visíveis.

Comparação publicada por um usuário de cenas de armazém virtual geradas por dois modelos.
Esses exemplos são demonstrações anedóticas, e não benchmarks controlados. A formulação do prompt, a configuração do agente, o acesso a ferramentas, os limites de tempo e a intervenção manual podem influenciar a saída.
Ainda assim, o rápido aparecimento
Esses projetos ajudaram a impulsionar o interesse. Os usuários não estavam apenas fazendo perguntas ao K3; muitos realizavam longas sessões de codificação que envolviam criar, renderizar, testar e revisar projetos substanciais.
Essa distinção é importante para a infraestrutura.
Uma resposta curta de chatbot pode exigir uma solicitação ao modelo. Um agente de codificação pode ler arquivos repetidamente, planejar, escrever código, chamar ferramentas, executar comandos, inspecionar resultados e iniciar outro ciclo de raciocínio. Uma única tarefa do usuário pode, portanto, consumir muito mais capacidade de inferência do que uma conversa convencional.
Em 19 de julho, a Moonshot afirmou que o Kimi K3 havia recebido muito mais interesse do que o esperado.
Nas 48 horas anteriores, as solicitações dos usuários excederam drasticamente as previsões e estavam se aproximando do limite de capacidade dos clusters existentes da empresa.

Moonshot disse que a demanda se aproximou do limite de sua capacidade computacional atual.
Quando muitas solicitações de inferência chegam a um cluster ao mesmo tempo, vários problemas podem surgir:
O Kimi K3 torna o problema mais difícil devido à sua escala e foco no produto.
O modelo contém 2,8 trilhões de parâmetros no total, e muitos de seus casos de uso mais atraentes envolvem contextos longos, raciocínio repetido, capturas de tela, operações de arquivos e chamadas de ferramentas. Embora sua arquitetura esparsa ative apenas parte do modelo completo para cada token, atendê-lo em alto volume ainda exige uma infraestrutura substancial.
Portanto, a Moonshot anunciou três medidas imediatas:
Não se esperava que os assinantes atuais perdessem seus benefícios existentes devido à pausa temporária.
Nota de status: A pausa se aplicou a novas assinaturas de consumidores, não necessariamente a toda conta gratuita, produto de API, acordo empresarial ou assinatura existente. A disponibilidade do produto pode mudar rapidamente, então os usuários devem verificar a página oficial de preços e assinaturas do Kimi para obter o status atual.
A Moonshot também afirmou que sua futura estrutura de assinaturas mudaria.
A empresa planeja separar os benefícios principais do Kimi — incluindo Kimi Web, o aplicativo Kimi e Kimi Work — dos benefícios do Kimi Code.
Isso aponta para duas categorias de uso diferentes.
A assinatura principal do Kimi é destinada à produtividade pessoal mais ampla, incluindo:
Descreva sua ideia uma vez e o We0 AI pode gerar um site de apresentacao, paginas e CMS, alem de ajudar a atrair clientes e trafego apos o lancamento.
Uma geração completa de projetos para registro gratuito
Melhor para experimentar um fluxo de geração completo e ver rapidamente um primeiro rascunho do projeto.
O Kimi Code é construído para tarefas sustentadas de engenharia de software,
incluindo:
O perfil computacional desses produtos pode ser muito diferente.
Um desenvolvedor pode deixar um agente de codificação em execução enquanto ele explora um repositório, modifica vários arquivos, executa testes, investiga falhas e repete o ciclo. Separar os planos dá à Moonshot mais controle sobre limites de taxa, precificação e alocação de recursos para usuários com cargas de trabalho substancialmente diferentes.
O anúncio não forneceu precificação final, cotas ou uma data confirmada para o novo sistema de assinaturas.
A paralisação das assinaturas ilustra um problema mais amplo para provedores de IA de ponta: o lançamento de um modelo bem-sucedido pode criar demanda mais rapidamente do que a infraestrutura física pode ser expandida.
Aumentar a capacidade não é tão simples quanto atualizar uma configuração de software. Os provedores podem precisar obter aceleradores, implantar servidores, conectar rede e armazenamento, configurar software de inferência, validar a confiabilidade e reequilibrar o tráfego entre clusters.
A Kimi publicou anteriormente pesquisas sobre o Mooncake, sua arquitetura de serviço centrada em cache KV. O sistema separa cargas de trabalho de preenchimento e decodificação e usa recursos de CPU distribuída, DRAM e SSD para melhorar a eficiência do serviço de contexto longo.
O artigo do Mooncake relata que a arquitetura permitiu que a Kimi lidasse com 75% mais solicitações sob as cargas de trabalho reais testadas na época.
O Kimi K3 cria um desafio novo e maior. Um serviço mais eficiente pode aumentar o trabalho realizado pelo hardware existente, mas não elimina a necessidade de computação física adicional quando a demanda aumenta de forma suficientemente acentuada.
É por isso que a pausa temporária é melhor compreendida como uma decisão de gerenciamento de capacidade. A Moonshot optou por limitar a nova demanda paga em vez de continuar vendendo assinaturas que seus clusters atuais poderiam não atender de forma confiável.
O relatório original conecta a popularidade do K3 com o impulso comercial mais amplo da Moonshot AI.
De acordo com relatos da mídia citando pessoas familiarizadas com a empresa, as vendas diárias da Moonshot aumentaram pelo menos seis vezes após o lançamento do K3.
Reportagens da Bloomberg também disseram que a receita recorrente anual da Moonshot atingiu aproximadamente US$ 300 milhões em junho de 2026**, acima dos US$ 200 milhões em abril.
Receita recorrente anual não é o mesmo que receita anual auditada. É uma métrica de taxa de execução prospectiva baseada na receita atual de assinaturas e contratos.
Relatos também disseram que a Moonshot distribuiu uma resolução de acionistas buscando apoio para uma listagem em Hong Kong e poderia buscar um IPO dentro de aproximadamente seis meses.
A Reuters reportou separadamente que:
Esses detalhes foram
reportado por meio de fontes anônimas ou materiais de captação de recursos, e não por um registro oficial do Moonshot. A empresa se recusou a comentar sobre o processo de IPO à Reuters.
Reportagens subsequentes, com base na Bloomberg, afirmaram que a Moonshot estava discutindo uma rodada de financiamento pré-IPO com uma avaliação de até US$ 50 bilhões. Esse valor representa uma meta relatada em discussão, e não um financiamento concluído ou uma avaliação confirmada no mercado público.
Desempenho do modelo, demanda dos usuários, crescimento de receita, captação de recursos e preparativos para listagem chegaram quase ao mesmo tempo.
Para uma startup de IA, essa combinação pode fortalecer a história apresentada aos investidores:
Ao mesmo tempo, a escassez de capacidade computacional revela o custo desse crescimento.
Um modelo de codificação forte é caro para manter. Quanto mais bem-sucedidos seus recursos de agente se tornarem, mais usuários provavelmente iniciarão cargas de trabalho de longa duração em vez de bate-papos curtos.
Isso cria um equilíbrio difícil. A Moonshot precisa de capacidade suficiente para preservar a experiência do usuário, mas também precisa gerenciar o custo de capital para adicionar hardware rapidamente.
A decisão de interromper a venda de novas assinaturas de consumo, pelo menos temporariamente, sugere que a confiabilidade para os usuários existentes teve prioridade sobre a maximização do crescimento imediato de assinaturas.
Para os membros pagantes existentes, a Moonshot disse que os benefícios do serviço continuariam disponíveis e que a escassez atual não removeria seus direitos de assinatura.
Para pessoas que ainda não haviam assinado, a situação prática era diferente:
Os desenvolvedores que precisam de acesso programático ainda podem verificar a plataforma Kimi API. A disponibilidade, os preços e os limites de taxa da API são gerenciados separadamente da assinatura de consumo e podem seguir regras de capacidade diferentes.
A Kimi API atualmente lista o K3 em:
| Tipo de Uso | Preço por Milhão de Tokens |
|---|---|
| Entrada em cache | $0,30 |
| Entrada sem cache | $3,00 |
| Saída | $15,00 |
Esses preços são as listagens atuais da plataforma no momento da preparação deste arquivo e podem mudar posteriormente.
A Moonshot disse que a demanda pelo Kimi K3 superou suas previsões e se aproximou do limite de capacidade de seus clusters computacionais existentes. A empresa pausou novas assinaturas de consumo para priorizar a experiência dos membros pagantes atuais.
A Moonshot disse que os assinantes existentes manteriam seus benefícios e não seriam afetados pela pausa nas assinaturas. A velocidade real do serviço ainda pode variar durante períodos de demanda excepcionalmente alta.
Nenhuma data fixa de reabertura foi anunciada. A Moonshot disse que adicionaria capacidade computacional e liberaria novos
assinaturas são colocadas em lotes até que as assinaturas normais possam ser retomadas.
A pausa afetou novas assinaturas de consumidores, não necessariamente todas as formas de acesso. O acesso gratuito, a API do Kimi, os produtos empresariais e as assinaturas existentes podem ter limites e regras de disponibilidade separados.
O K3 é um modelo de 2,8 trilhões de parâmetros projetado para contextos longos, entrada multimodal, agentes de codificação e uso repetido de ferramentas. Fluxos de trabalho de codificação podem gerar várias chamadas sequenciais de modelo durante uma única tarefa do usuário, aumentando a demanda total de inferência.
A Moonshot disse que planeja separar os benefícios gerais do Kimi dos benefícios do Kimi Code. Isso permitiria que a empresa atribuísse preços, limites de uso e recursos computacionais diferentes para usuários gerais e usuários intensivos de agentes de codificação.
O Kimi K3 ocupou o primeiro lugar no ranking preliminar WebDev da Arena no momento da publicação. Os resultados da Arena são atualizados continuamente, portanto, o ranking ao vivo deve ser verificado para obter a classificação mais recente.
Nenhum IPO final foi confirmado. Relatos da mídia dizem que a Moonshot está se preparando para uma possível listagem em Hong Kong e discutiu um prazo de aproximadamente seis meses, mas a Reuters observou que o cronograma permanece incerto.
Classificação atual do frontend do Kimi K3 e contagem de votos.
O lançamento do Kimi K3 gerou demanda suficiente para levar os clusters de GPU existentes da Moonshot AI perto do limite de sua capacidade em aproximadamente 48 horas. A empresa respondeu pausando temporariamente novas assinaturas de consumidores e priorizando os membros pagantes existentes.
O aumento ocorreu após fortes resultados de codificação, uma primeira colocação preliminar no ranking de frontend do Arena e uma onda de sites, jogos e aplicativos 3D criados por usuários. Tarefas de codificação e agente de longa duração também consomem consideravelmente mais capacidade de inferência do que sessões de chat comuns.
A Moonshot planeja separar a associação geral do Kimi dos benefícios do Kimi Code, dando a ela mais controle sobre a alocação de computação e preços futuros. Ao mesmo tempo, relatos da mídia indicam rápido crescimento de receita, novas discussões de captação de recursos e preparativos para um possível IPO em Hong Kong, embora esses detalhes financeiros ainda se baseiem amplamente em fontes anônimas.
O lançamento demonstrou ambos os lados da demanda por IA de fronteira: o Kimi K3 atraiu usuários rapidamente, mas atender esses usuários de forma confiável tornou-se um desafio imediato de infraestrutura.
Comece com uma frase e tenha um site completo em minutos.