Kimi K3 Hugging Face-download: open source weights live
Kimi K3-hub: Specs, prijzen, API-id → /kimi-k3. Tijdlijn → /kimi-k3-status. Self-host-pad → /blog/38-kimi-k3-self-host-vllm-day0. Pre-drop-kalender → /blog/31-kimi-k3-open-weights-july-27.
Je zocht kimi k3 huggingface, kimi k3 download of kimi k3 open source—want de feed zei dat het model open is, en jij wilt een echte Files-tab, geen countdown-pagina.
Goed nieuws: per 27 juli 2026 staan de Kimi K3 open source weights live. Moonshot publiceerde de modelweights + technical report. De officiële Hugging Face-repo moonshotai/Kimi-K3 heeft echte safetensors-shards, een LICENSE en een volledige model card—geen “Upcoming release”-teaser.
Deze site is onafhankelijk van Moonshot. Hieronder een praktische day-of-lees: waar je downloadt, wat “open source / open weights” écht betekent voor licentie en GPU’s, en wat je deze week moet doen zonder uit FOMO een rack leeg te trekken.
Kort antwoord (lees dit eerst)
- Ja—je kunt Kimi K3 nu van Hugging Face downloaden. Canonieke link: huggingface.co/moonshotai/Kimi-K3. Tech report PDF: MoonshotAI/Kimi-K3 op GitHub. Launch-verhaal: Kimi K3-blog.
- Open source weights ≠ gratis oneindige lokale chat. Full K3 blijft ~2.8T parameters (MoE; ~104B actief per token). Laptop-Ollama-fantasieën blijven fantasieën—zie onze VRAM / Ollama-eerlijkheidscheck en vLLM day-0-gids.
- Lees de Kimi K3 License voordat je productiseert. Onderzoek, intern gebruik en kleinere commerciële embeds zijn grotendeels ruim open. K3 hosten als betaalde API / Model-as-a-Service boven een $20M jaaromzet-drempel vraagt een aparte deal met Moonshot. Details hieronder—ga er niet van uit dat dit “Modified MIT van K2.x” is.
- De meeste mensen moeten nog steeds niet eerst downloaden. Wil je intelligence vandaag? Product + API-id
kimi-k3. Wil je weights voor VPC / fine-tune / audit? Labs en infra-teams met een serving-plan.
Eén zin: de open-source file drop van 27 juli is echt; behandel hem als een Hugging Face + cluster + licentie-event, niet als een gratis chat-app-install.

Bron: @Kimi_Moonshot open-weights-aankondiging, 27 juli 2026.
Wat er net is veranderd (open source is geen kalenderteaser meer)
| Onderwerp | Voor vandaag (onze eerdere gidsen) | Per 27 juli 2026 |
|---|---|---|
| Hugging Face Files-tab | Leeg / “Upcoming”-countdown | Live download onder moonshotai/Kimi-K3 (tientallen model-*-of-000096.safetensors + configs) |
| Licentiebestand | Geraden vanuit K2.x Modified MIT | Kimi K3 License op de repo—lees hem, ga niet uit van aannames |
| Tech report | “Komt mee met de weights” | Gepubliceerd (GitHub-PDF gelinkt vanaf de model card) |
| Serving-verhaal | vLLM preview | Model card wijst naar vLLM recipes, SGLang cookbook, TokenSpeed |
| Jouw default-stap | API / product | Nog steeds API / product voor de meeste teams; self-host alleen als je de bestanden nodig hebt |
Had je “Open Weights 27 juli: wat je vandaag al kunt gebruiken” gebookmarkt toen HF nog leeg was—die post klopte toen. Deze pagina is de day-of-update voor wie nu Hugging Face / download / open source zoekt.
Wat er écht is geland (Kimi K3 open source drop)
Uit de officiële model card en Moonshots aankondiging:
Modelvorm (in gewone taal)
| Spec | Getal / feit | Waarom jij dit wilt weten |
|---|---|---|
| Totale parameters | 2.8T | “Largest open 3T-class”-marketing gaat over deze schaal |
| Geactiveerd per token | ~104B | Je draait geen dense 2.8T—het is een sparse MoE |
| Experts | 16 van 896 geselecteerd (+ 2 shared) | Sparsity is de hele efficiëntiewed |
| Layers / attention | 93 layers; 69 KDA + 24 Gated MLA | Serving-stacks hebben KDA-bewuste code nodig, geen vanilla Llama-recepten |
| Context | 1,048,576 tokens | Lange-repo / lange-agent-jobs—geen reden om elke chat te maxen |
| Vision | MoonViT-V2 (~401M) native multimodaal | Dezelfde weights begrijpen tekst + beelden |
| Quantization | MXFP4 weights / MXFP8 activations (QAT) | Day-0-formats zijn compressed-tensor-stijl—niet random GGUF van een vreemde |
| Officiële efficiëntieclaim | ~2.5× intelligence per unit compute vs K2-era scaling (hun framing) | Lees dit als architectuurverhaal, niet als vrijbrief op je stroomrekening |
Moonshot opent ook meer van de stack rond het model—attention-kernels, MoE-communicatiebibliotheek en agent-environment-infra (bijv. AgentENV op hun kanaal). Weights alleen maken nog geen productie-agentenboerderij; de omliggende code is de tweede helft van “open.”
Kimi K3 Hugging Face-download — alleen officiële links
| Asset | URL |
|---|---|
| Weights + model card (hier downloaden) | huggingface.co/moonshotai/Kimi-K3 |
| Tech report (PDF) | github.com/MoonshotAI/Kimi-K3/…/k3_tech_report.pdf |
| Productverhaal / eerdere launch-post | kimi.com/blog/kimi-k3 |
| Hosted API (als je niet self-host) | model-id kimi-k3 op platform.kimi.ai |
Pin een commit hash voordat je iets productie-achtigs aansluit. Day-0-repos bewegen. Kies de moonshotai-org boven random “Kimi-K3”-mirrors die deze week de zoekresultaten overspoelen.

Bron: Officiële K3-launchmedia / Kimi K3-blog, 16 juli 2026; dezelfde klasse grafieken waar de open-weight card naar terugwijst.
Kimi K3-licentie (wat “open source” nog steeds beperkt)
Hugging Face list de licentie als other / kimi-k3, niet als stock SPDX MIT. De Kimi K3 License op de repo is MIT-achtig met commerciële poorten. In gewone taal (lees het bestand altijd opnieuw—dit is geen juridisch advies):
| Situatie | Ruwe lezing |
|---|---|
| Onderzoek, fine-tunes, experimenten | Over het algemeen toegestaan |
| Intern gebruik (het model/de capability niet aan derden aanbieden) | Carve-out—commerciële poorten in de stijl van Sections 2–3 gelden niet op dezelfde manier |
| K3 in een productfeature inbouwen (niet “de rauwe model als API verhuren”) | Vaak anders behandeld dan pure Model-as-a-Service—lees de definities zorgvuldig |
| Je draait Model as a Service (derden sturen prompts / fine-tunes via jouw gehoste K3) en de omzet van je groep > $20M over enige aaneengesloten 12 maanden | Je moet een aparte overeenkomst met Moonshot sluiten vóór commercieel gebruik van dat type |
| Zeer grote consumer-producten (>100M MAU of >$20M maandelijkse omzet) | “Kimi K3” moet prominent zichtbaar zijn in de UI van dat product/die dienst |
| Toegang alleen via officiële Moonshot-producten of gecertificeerde partners | Commerciële carve-outs gelden ook |
Onze take voor builders: ben je een startup onder de omzetdrempel die een app met K3 erin shippt, dan zit je dichter bij “open met brand + MaaS-regels” dan bij “Apache free-for-all.” Plan je te concurreren met Moonshots eigen API, begroot een licentiegesprek, niet alleen bandbreedte.
Eerdere open Kimi-lijnen (K2.5 / K2.6 / K2.7 Code) leerden mensen “Modified MIT” te zeggen. K3 is een eigen document. Citeer het bestand, niet de tweet.
Wie Kimi K3-weights moet downloaden (en wie niet)
| Jij bent… | Doe dit deze week | Sla over |
|---|---|---|
| Indie / hobbyist die “kimi k3 free” of “open source” googelde voor chat | Gebruik kimi.com of free-tier productpaden (eerlijke gratis opties) | Multi-honderd-GB Hugging Face-pull “om even te chatten” |
| App- / agent-builder die features shippt | API kimi-k3 + kostenbeheer | Self-host tot unit economics het forceren |
| Infra / platform met multi-node GPU’s | Verifieer HF-bestanden → vLLM / SGLang-recipes → load test | Random community-GGUF-mirrors |
| Research lab die weights nodig heeft voor audit / fine-tune | Clone officiële repo, pin commit, lees LICENSE | Re-uploads met hernoemde mappen vertrouwen |
| Team dat in de IDE leeft | Blijf bij K2.7 Code / Kimi Code voor dagelijkse PR’s (welk model) | Full K3 forceren voor elke autocomplete |
Selectieoordeel (van ons, niet van Moonshot): open weights veranderen het ownership- en audit-verhaal. Ze veranderen niet het product-verhaal voor de meeste lezers. Was je pijn “API-rekening” of “subscribe gepauzeerd,” dan is 2.8T-class shards downloaden een rare fix—capaciteitsproblemen verhuizen van Moonshots GPU’s naar de jouwe.

Bron: Officiële K3-launchmaterialen / Kimi K3-blog, 16 juli 2026.
Open weights gebruiken zonder jezelf voor de gek te houden
Pad A — Hosted (nog steeds de default)
- Chat / Work / Code op kimi.com
- API:
kimi-k3, OpenAI/Anthropic-compatible op platform.kimi.ai - Publieke lijstprijs die we eerder volgden: grofweg $0.30 cache-hit / $3 cache-miss / $15 output per 1M tokens—bevestig op de live pricing-pagina (pricing deep dive)
Thinking staat standaard op max effort en retourneert reasoning_content. Dat is top voor zware jobs en duur voor casual chat—discipline wint van de slogan.
Pad B — Self-host (nu Files echt zijn)
De model card stuurt day-0 serving momenteel naar:
Checklist die nog steeds geldt uit onze self-host-gids:
- Bevestig
moonshotai/Kimi-K3Files + LICENSE (geen fan-mirror). - Pin een engine-versie die K3 / KDA-support claimt.
- Plan multi-accelerator-capaciteit—niet één consumer-GPU.
- Load-test prefix cache / long context voordat je 1M tokens in prod belooft.
- Houd een fallback naar de hosted API klaar wanneer je cluster op dag twee smelt.
Pad C — “Open” voor compliance / procurement
Als legal vroeg “is er een downloadbaar weight-artifact dat we in een VPC kunnen zetten?”—ja, per vandaag. Dat is de procurement-winst. Het betekent niet automatisch goedkoper of beter dan de API in de eerste 90 dagen ops.
Mythes om te slachten op open-source-dag
| Mythe | Realiteit |
|---|---|
| “Open source betekent gratis voor altijd op mijn laptop” | Schaal is datacenter-vormig; actieve params alleen al zijn ~104B-class |
| “Licentie is plain MIT” | Kimi K3 License met MaaS + $20M en big-product attribution-regels |
| “Ik moet vannacht elk workflow naar self-host switchen” | Product/API-kwaliteit is al live; weights unlocken controle, geen magische IQ |
| “Elke Hugging Face-upload genaamd Kimi-K3 is prima” | Kies moonshotai + commit-pin; community-GGUF-mirrors exploderen—verifieer lineage |
| “Open weights lossen de subscription pause op” | De pause ging over hosted capaciteit (achtergrond); je eigen GPU’s zijn een andere queue |
| “Download = gratis API voor altijd” | Weights zijn voor jouw infra; de hosted API factureert nog steeds op platform.kimi.ai (pricing-gids) |
Wat te doen deze week (beslisboom)
Als je alleen antwoorden of codehulp nodig hebt: open de app of API. Klaar.
Als je offline / VPC / fine-tune-rechten nodig hebt: start de officiële download, lees LICENSE, boek GPU-tijd, volg vLLM/SGLang-docs—niet een random Discord-zip.
Als je inference verkoopt: run de omzettest tegen Section 2 van de licentie vóór je kimi-k3 op een prijslijst zet.
Als je de hele dag IDE-agents schrijft: houd K2.7 Code als default; route zware, lange, multi-domain jobs naar K3 (release switch-gids).
Waar nu naartoe
- Hub met live specs: /kimi-k3
- Status / tijdlijn: /kimi-k3-status
- Self-host-diepte: /blog/38-kimi-k3-self-host-vllm-day0
- API-gelddiscipline: /blog/37-kimi-k3-api-pricing-cost-control
- Familiekeuze K2.6 / K2.7 / K3: /blog/29-kimi-which-model-k26-k27-k3
Bottom line: 27 juli leverde wat de launch-post beloofde—frontier-scale open weights, geen consumer one-click-install. Download als je een reden hebt; anders gebruik het model de makkelijke weg en laat iemand anders de cluster oppassen.