Kimi K3 Hugging Face: download dos pesos open source no ar
Hub Kimi K3: Specs, preço, id da API → /kimi-k3. Timeline → /kimi-k3-status. Caminho self-host → /blog/38-kimi-k3-self-host-vllm-day0. Calendário pré-drop → /blog/31-kimi-k3-open-weights-july-27.
Você buscou kimi k3 huggingface, kimi k3 download ou kimi k3 open source—porque o feed disse que o modelo é open, e você quer uma aba Files de verdade, não mais uma página de countdown.
Boa notícia: em 27 de julho de 2026, os pesos open source do Kimi K3 estão no ar. A Moonshot publicou os pesos do modelo + technical report. O repo oficial no Hugging Face moonshotai/Kimi-K3 tem shards reais de safetensors, um LICENSE e model card completa—não um teaser de “Upcoming release”.
Este site é independente da Moonshot. Abaixo, uma leitura prática do dia: de onde baixar, o que “open source / open weights” significa de fato para licença e GPUs, e o que fazer esta semana sem queimar um rack por FOMO.
Resposta curta (leia isto primeiro)
- Sim—você já pode baixar o Kimi K3 no Hugging Face. Link canônico: huggingface.co/moonshotai/Kimi-K3. PDF do tech report: MoonshotAI/Kimi-K3 no GitHub. Narrativa de lançamento: blog Kimi K3.
- Pesos open source ≠ chat local grátis e infinito. O K3 completo ainda tem ~2.8T de parâmetros (MoE; ~104B ativos por token). Fantasia de Ollama no notebook continua fantasia—veja nosso honesty check de VRAM / Ollama e o guia day-0 de vLLM.
- Leia a Kimi K3 License antes de productizar. Pesquisa, uso interno e embeds comerciais menores em geral ficam liberados. Hospedar o K3 como API paga / Model-as-a-Service acima do limiar de US$ 20M de receita anual exige acordo separado com a Moonshot. Detalhes abaixo—não assuma “Modified MIT do K2.x.”
- A maioria ainda não deveria baixar primeiro. Quer inteligência hoje? Produto + id de API
kimi-k3. Quer pesos para VPC / fine-tune / audit? Labs e times de infra com plano de serving.
Uma frase: o drop de arquivos open source de 27 de julho é real; trate como evento de Hugging Face + cluster + licença, não como install de app de chat grátis.

Fonte: anúncio de open-weights @Kimi_Moonshot, 27 de julho de 2026.
O que mudou agora (open source deixou de ser teaser de calendário)
| Tema | Antes de hoje (nossos guias anteriores) | Em 27 de julho de 2026 |
|---|---|---|
| Aba Files no Hugging Face | Vazia / countdown “Upcoming” | Download ao vivo em moonshotai/Kimi-K3 (dezenas de model-*-of-000096.safetensors + configs) |
| Arquivo de licença | Chute a partir do Modified MIT do K2.x | Kimi K3 License no repo—leia, não assuma |
| Tech report | “Vem junto com os pesos” | Publicado (PDF no GitHub linkado na model card) |
| História de serving | vLLM preview | Model card aponta vLLM recipes, SGLang cookbook, TokenSpeed |
| Seu movimento padrão | API / produto | Continua API / produto para a maioria dos times; self-host só se você precisa dos arquivos |
Se você salvou “Open Weights July 27: o que dá para usar hoje” quando o HF ainda estava vazio—aquele post estava certo na época. Esta página é a atualização do dia para quem busca Hugging Face / download / open source agora.
O que de fato saiu (drop open source do Kimi K3)
A partir da model card oficial e do anúncio da Moonshot:
Formato do modelo (em português claro)
| Spec | Número / fato | Por que importa |
|---|---|---|
| Parâmetros totais | 2.8T | O marketing de “maior open da classe 3T” é sobre essa escala |
| Ativos por token | ~104B | Você não roda 2.8T densos—é MoE esparso |
| Experts | 16 de 896 selecionados (+ 2 shared) | A esparsidade é a aposta de eficiência inteira |
| Camadas / attention | 93 camadas; 69 KDA + 24 Gated MLA | Stacks de serving precisam de código ciente de KDA, não receita vanilla de Llama |
| Contexto | 1.048.576 tokens | Jobs long-repo / long-agent—não é motivo para maxar todo chat |
| Visão | MoonViT-V2 (~401M) multimodal nativo | Os mesmos pesos entendem texto + imagens |
| Quantização | MXFP4 weights / MXFP8 activations (QAT) | Formatos day-0 são estilo compressed-tensor—não GGUF aleatório de desconhecido |
| Claim oficial de eficiência | ~2.5× inteligência por unidade de compute vs scaling da era K2 (enquadramento deles) | Leia como história de arquitetura, não passe livre na conta de luz |
A Moonshot também está abrindo mais da stack ao redor do modelo—kernels de attention, biblioteca de comunicação MoE e infra de agent-environment (ex.: AgentENV destacado no canal deles). Pesos sozinhos não viram fazenda de agentes em produção; o código ao redor é a segunda metade do “open.”
Download Kimi K3 no Hugging Face — só links oficiais
| Asset | URL |
|---|---|
| Pesos + model card (baixe aqui) | huggingface.co/moonshotai/Kimi-K3 |
| Tech report (PDF) | github.com/MoonshotAI/Kimi-K3/…/k3_tech_report.pdf |
| Narrativa de produto / post de lançamento anterior | kimi.com/blog/kimi-k3 |
| API hospedada (se você não vai self-hostar) | model id kimi-k3 em platform.kimi.ai |
Fixe um commit hash antes de plugar qualquer coisa com cara de produção. Repos day-0 se mexem. Prefira a org moonshotai a mirrors aleatórios de “Kimi-K3” que vão inundar a busca esta semana.

Fonte: mídia oficial de lançamento do K3 / blog Kimi K3, 16 de julho de 2026; mesma classe de gráficos que a card de open-weight aponta de volta.
Licença do Kimi K3 (o que “open source” ainda restringe)
O Hugging Face lista a licença como other / kimi-k3, não um MIT SPDX de prateleira. A Kimi K3 License no repo é MIT-like com portões comerciais. Em linguagem clara (sempre releia o arquivo—isto não é aconselhamento jurídico):
| Situação | Leitura aproximada |
|---|---|
| Pesquisa, fine-tunes, experimentos | Em geral permitido |
| Uso interno (sem oferecer o modelo/capacidade a terceiros) | Carve-out—portões comerciais estilo Seções 2–3 não se aplicam da mesma forma |
| Embutir o K3 dentro de uma feature de produto (não “alugar o modelo cru como API”) | Em geral tratado diferente de Model-as-a-Service puro—leia as definições com cuidado |
| Você roda Model as a Service (terceiros controlam prompts / fine-tunes via seu K3 hospedado) e a receita do grupo > US$ 20M em quaisquer 12 meses consecutivos | Você precisa negociar um acordo separado com a Moonshot antes desse tipo de uso comercial |
| Produtos consumer muito grandes (>100M MAU ou > US$ 20M de receita mensal) | “Kimi K3” deve aparecer de forma proeminente na UI desse produto/serviço |
| Acesso só por produtos oficiais da Moonshot ou parceiros certificados | Carve-outs dos portões comerciais também se aplicam |
Nossa leitura para builders: se você é startup abaixo do limiar de receita entregando um app com K3 dentro, isso fica mais perto de “open com regras de marca + MaaS” do que de “Apache liberado geral.” Se o plano é competir com a própria API da Moonshot, orce uma conversa de licença, não só banda larga.
Linhas open anteriores do Kimi (K2.5 / K2.6 / K2.7 Code) acostumaram a galera a dizer “Modified MIT.” O K3 é documento próprio. Cite o arquivo, não o tweet.
Quem deve baixar os pesos do Kimi K3 (e quem não deve)
| Você é… | Faça esta semana | Pule |
|---|---|---|
| Indie / hobbyist que googled “kimi k3 free” ou “open source” pra chat | Use kimi.com ou caminhos de produto free-tier (opções free honestas) | Pull de centenas de GB no Hugging Face “só pra testar chat” |
| App / agent builder entregando features | API kimi-k3 + controle de custo | Self-host até a unit economics forçar |
| Infra / platform com GPUs multi-node | Verifique arquivos HF → recipes vLLM / SGLang → load test | Mirrors GGUF aleatórios da comunidade |
| Lab de pesquisa que precisa de pesos para audit / fine-tune | Clone o repo oficial, fixe commit, leia o LICENSE | Confiar em re-uploads com pastas renomeadas |
| Time que vive no IDE | Fique no K2.7 Code / Kimi Code para PRs do dia a dia (qual modelo) | Forçar o K3 completo em todo autocomplete |
Julgamento de seleção (nosso, não da Moonshot): open weights mudam a história de ownership e audit. Não mudam a história de produto para a maioria dos leitores. Se a dor era “conta de API” ou “assinatura pausada,” baixar shards classe 2.8T é um remédio estranho—o problema de capacidade só sai das GPUs da Moonshot e vai para as suas.

Fonte: materiais oficiais de lançamento do K3 / blog Kimi K3, 16 de julho de 2026.
Como usar os pesos open sem se enganar
Caminho A — Hospedado (ainda o padrão)
- Chat / Work / Code em kimi.com
- API:
kimi-k3, compatível com OpenAI/Anthropic em platform.kimi.ai - Preço de lista público que acompanhamos antes: cerca de US$ 0,30 cache-hit / US$ 3 cache-miss / US$ 15 output por 1M tokens—confirme na página de preço ao vivo (deep dive de pricing)
O thinking default é esforço max e devolve reasoning_content. Ótimo para jobs difíceis e caro para chat casual—disciplina vence slogan.
Caminho B — Self-host (agora que a aba Files é real)
A model card hoje aponta o serving day-0 para:
Checklist que ainda vale do nosso guia de self-host:
- Confirme Files + LICENSE de
moonshotai/Kimi-K3(não mirror de fã). - Fixe a versão do engine que declara suporte a K3 / KDA.
- Planeje capacidade multi-acelerador—não uma GPU consumer sozinha.
- Faça load-test de prefix cache / long context antes de prometer 1M tokens em prod.
- Mantenha um fallback para a API hospedada quando o cluster der ruim no segundo dia.
Caminho C — “Open” para compliance / procurement
Se o jurídico perguntou “existe um artefato de peso baixável que dá para colocar na VPC?”—sim, a partir de hoje. Esse é o ganho de procurement. Isso não significa automaticamente mais barato ou melhor que a API nos primeiros 90 dias de ops.
Mitos para matar no dia do open source
| Mito | Realidade |
|---|---|
| “Open source significa grátis pra sempre no meu notebook” | A escala é de datacenter; só os params ativos já são classe ~104B |
| “A licença é MIT puro” | Kimi K3 License com regras de MaaS + US$ 20M e atribuição em produtos grandes |
| “Preciso migrar todo workflow para self-host esta noite” | Qualidade de produto/API já está no ar; pesos desbloqueiam controle, não IQ mágico |
| “Qualquer upload no Hugging Face chamado Kimi-K3 serve” | Prefira moonshotai + pin de commit; mirrors GGUF da comunidade vão explodir—verifique a linhagem |
| “Open weights resolvem a pausa de assinatura” | A pausa era sobre capacidade hospedada (contexto); suas próprias GPUs são outra fila |
| “Download = API grátis pra sempre” | Pesos são para sua infra; a API hospedada continua cobrando em platform.kimi.ai (guia de preço) |
O que fazer esta semana (árvore de decisão)
Se você só precisa de respostas ou ajuda de código: abra o app ou a API. Pronto.
Se precisa de offline / VPC / direitos de fine-tune: comece o download oficial, leia o LICENSE, reserve tempo de GPU, siga docs de vLLM/SGLang—não um zip aleatório de Discord.
Se você vende inference: rode o teste de receita contra a Seção 2 da licença antes de colocar kimi-k3 numa página de preço.
Se você escreve agentes de IDE o dia inteiro: mantenha K2.7 Code como default; roteie jobs difíceis, longos, multi-domínio para o K3 (guia de switch no release).
Para onde ir a seguir
- Hub com specs ao vivo: /kimi-k3
- Status / timeline: /kimi-k3-status
- Profundidade de self-host: /blog/38-kimi-k3-self-host-vllm-day0
- Disciplina de dinheiro na API: /blog/37-kimi-k3-api-pricing-cost-control
- Escolha da família K2.6 / K2.7 / K3: /blog/29-kimi-which-model-k26-k27-k3
Resumo final: 27 de julho entregou o que o post de lançamento prometeu—open weights em escala frontier, não install one-click de consumidor. Baixe se tiver motivo; caso contrário use o modelo do jeito fácil e deixe outra pessoa cuidar do cluster.