Kimi K3 Hugging Face: download pesi open source già live
Hub Kimi K3: Specs, prezzi, id API → /kimi-k3. Timeline → /kimi-k3-status. Percorso self-host → /blog/38-kimi-k3-self-host-vllm-day0. Calendario pre-drop → /blog/31-kimi-k3-open-weights-july-27.
Hai cercato kimi k3 huggingface, kimi k3 download o kimi k3 open source—perché il feed dice che il modello è open e vuoi una tab Files vera, non un’altra pagina con il countdown.
Buone notizie: al 27 luglio 2026 i pesi open source di Kimi K3 sono live. Moonshot ha pubblicato pesi del modello + technical report. Il repo ufficiale su Hugging Face moonshotai/Kimi-K3 ha shard safetensors reali, un file LICENSE e una model card completa—non un teaser “Upcoming release”.
Questo sito è indipendente da Moonshot. Sotto trovi una lettura pratica del giorno zero: dove scaricare, cosa significa davvero “open source / open weights” per licenza e GPU, e cosa fare questa settimana senza bruciare un rack per FOMO.
Risposta breve (leggi prima questa)
- Sì—puoi scaricare Kimi K3 da Hugging Face adesso. Link canonico: huggingface.co/moonshotai/Kimi-K3. Tech report PDF: MoonshotAI/Kimi-K3 su GitHub. Narrazione di lancio: blog Kimi K3.
- Pesi open source ≠ chat locale infinita e gratis. Il K3 pieno resta ~2.8T di parametri (MoE; ~104B attivi per token). Le fantasie Ollama sul laptop restano fantasie—vedi il nostro check onesto VRAM / Ollama e la guida vLLM day-0.
- Leggi la Kimi K3 License prima di productizzare. Ricerca, uso interno e molti embed commerciali “piccoli” restano ampi. Hostare K3 come API a pagamento / Model-as-a-Service sopra la soglia di $20M di revenue annua richiede un accordo separato con Moonshot. Dettagli sotto—non dare per scontato il “Modified MIT” delle linee K2.x.
- Per la maggior parte delle persone scaricare non è il primo passo. Vuoi intelligenza oggi? Prodotto + id API
kimi-k3. Vuoi i pesi per VPC / fine-tune / audit? Lab e team infra con un piano di serving.
Una frase: il drop open-source del 27 luglio è reale; trattalo come evento Hugging Face + cluster + licenza, non come install one-click di un’app di chat gratis.

Fonte: annuncio open-weights di @Kimi_Moonshot, 27 luglio 2026.
Cosa è cambiato (open source non è più un tease da calendario)
| Tema | Prima di oggi (le nostre guide precedenti) | Al 27 luglio 2026 |
|---|---|---|
| Tab Files su Hugging Face | Vuota / countdown “Upcoming” | Download live sotto moonshotai/Kimi-K3 (decine di model-*-of-000096.safetensors + config) |
| File di licenza | Ipotesi dal Modified MIT di K2.x | Kimi K3 License sul repo—leggerla, non assumerla |
| Tech report | “In arrivo con i pesi” | Pubblicato (PDF GitHub linkato dalla model card) |
| Storia di serving | preview vLLM | La model card punta a ricette vLLM, cookbook SGLang, TokenSpeed |
| Mossa di default | API / prodotto | Ancora API / prodotto per la maggior parte dei team; self-host solo se ti servono i file |
Se avevi messo nei preferiti «Open Weights 27 luglio: cosa puoi usare oggi» quando HF era vuoto—quel post era corretto allora. Questa pagina è l’aggiornamento del giorno per chi cerca Hugging Face / download / open source adesso.
Cosa è uscito davvero (drop open source di Kimi K3)
Dalla model card ufficiale e dall’annuncio Moonshot:
Forma del modello (in italiano chiaro)
| Spec | Numero / fatto | Perché ti interessa |
|---|---|---|
| Parametri totali | 2.8T | Il marketing “largest open 3T-class” parla di questa scala |
| Attivati per token | ~104B | Non fai girare 2.8T dense—è un MoE sparso |
| Expert | 16 di 896 selezionati (+ 2 shared) | La sparsità è l’intera scommessa di efficienza |
| Layer / attention | 93 layer; 69 KDA + 24 Gated MLA | Gli stack di serving servono codice KDA-aware, non ricette Llama vanilla |
| Contesto | 1,048,576 token | Job long-repo / long-agent—non un motivo per maxare ogni chat |
| Vision | MoonViT-V2 (~401M) multimodale nativo | Gli stessi pesi capiscono testo + immagini |
| Quantizzazione | pesi MXFP4 / attivazioni MXFP8 (QAT) | I formati day-0 sono stile compressed-tensor—non un GGUF random da sconosciuto |
| Claim ufficiale di efficienza | ~2.5× intelligence per unità di compute vs scaling era K2 (loro framing) | Leggilo come storia architetturale, non come esenzione sulla bolletta elettrica |
Moonshot sta aprendo anche di più dello stack attorno al modello—kernel di attention, libreria di comunicazione MoE e infra agent-environment (es. AgentENV citato sul loro canale). I soli pesi non fanno una farm di agent in produzione; il codice intorno è la seconda metà di “open.”
Download Kimi K3 su Hugging Face — solo link ufficiali
| Asset | URL |
|---|---|
| Pesi + model card (scarica qui) | huggingface.co/moonshotai/Kimi-K3 |
| Tech report (PDF) | github.com/MoonshotAI/Kimi-K3/…/k3_tech_report.pdf |
| Narrazione prodotto / post di lancio precedente | kimi.com/blog/kimi-k3 |
| API hosted (se non self-hosti) | model id kimi-k3 su platform.kimi.ai |
Fissa un commit hash prima di collegare qualsiasi cosa a forma di produzione. I repo day-0 si muovono. Preferisci l’org moonshotai rispetto ai mirror random “Kimi-K3” che invaderanno le ricerche questa settimana.

Fonte: media ufficiali di lancio K3 / blog Kimi K3, 16 luglio 2026; stessa classe di grafici a cui punta la card open-weight.
Licenza Kimi K3 (cosa “open source” continua a limitare)
Hugging Face elenca la licenza come other / kimi-k3, non un MIT SPDX da scaffale. La Kimi K3 License sul repo è MIT-like con gate commerciali. In linguaggio chiaro (rileggi sempre il file—questo non è parere legale):
| Situazione | Lettura approssimativa |
|---|---|
| Ricerca, fine-tune, esperimenti | In generale consentiti |
| Uso interno (non offrire il modello/capacità a terzi) | Carve-out—i gate commerciali stile Sezioni 2–3 non si applicano allo stesso modo |
| Embed di K3 dentro una feature di prodotto (non “affittare il modello grezzo come API”) | Spesso trattato diversamente dal puro Model-as-a-Service—leggi le definizioni con attenzione |
| Gestisci Model as a Service (terzi controllano prompt / fine-tune via il tuo K3 hosted) e il revenue del gruppo è > $20M in un qualsiasi periodo consecutivo di 12 mesi | Devi negoziare un accordo separato con Moonshot prima di un uso commerciale di quel tipo |
| Prodotti consumer molto grandi (>100M MAU o >$20M di revenue mensile) | «Kimi K3» deve comparire in modo evidente sulla UI di quel prodotto/servizio |
| Accesso solo tramite prodotti ufficiali Moonshot o partner certificati | Valgono anche i carve-out sui gate commerciali |
Il nostro take per chi costruisce: se sei una startup sotto la soglia di revenue che spedisce un’app con K3 dentro, sei più vicino a “open con regole di brand + MaaS” che a “Apache free-for-all.” Se intendi competere con l’API di Moonshot, metti a budget una conversazione di licenza, non solo banda.
Le linee open Kimi precedenti (K2.5 / K2.6 / K2.7 Code) avevano abituato a dire “Modified MIT.” K3 è un documento a sé. Cita il file, non il tweet.
Chi dovrebbe scaricare i pesi di Kimi K3 (e chi no)
| Sei… | Fai questa settimana | Salta |
|---|---|---|
| Indie / hobbyist che ha cercato “kimi k3 free” o “open source” per chattare | Usa kimi.com o i path free-tier del prodotto (opzioni free oneste) | Pull multi-centinaia di GB da Hugging Face “solo per provare la chat” |
| Builder di app / agent che spedisce feature | API kimi-k3 + controllo costi | Self-host finché le unit economics non lo impongono |
| Infra / platform con GPU multi-nodo | Verifica file HF → ricette vLLM / SGLang → load test | Mirror GGUF community a caso |
| Lab di ricerca che serve pesi per audit / fine-tune | Clona il repo ufficiale, pin del commit, leggi LICENSE | Fidarsi di re-upload con cartelle rinominate |
| Team che vive nell’IDE | Resta su K2.7 Code / Kimi Code per i PR di tutti i giorni (quale modello) | Forzare il K3 pieno su ogni autocomplete |
Giudizio di selezione (nostro, non di Moonshot): gli open weights cambiano la storia di ownership e audit. Non cambiano la storia di prodotto per la maggior parte dei lettori. Se il dolore era “bolletta API” o “abbonamento in pausa,” scaricare shard da 2.8T-class è una cura strana—il problema di capacità si sposta dalle GPU di Moonshot alle tue.

Fonte: materiali ufficiali di lancio K3 / blog Kimi K3, 16 luglio 2026.
Come usare gli open weights senza mentire a te stesso
Percorso A — Hosted (resta il default)
- Chat / Work / Code su kimi.com
- API:
kimi-k3, compatibile OpenAI/Anthropic su platform.kimi.ai - Listino pubblico che avevamo tracciato: circa $0.30 cache-hit / $3 cache-miss / $15 output per 1M token—conferma sulla pagina prezzi live (deep dive prezzi)
Il thinking di default è max effort e restituisce reasoning_content. Ottimo per job difficili, costoso per la chat casual—disciplina batte slogan.
Percorso B — Self-host (ora che Files è reale)
La model card al momento orienta il serving day-0 verso:
Checklist che resta valida dalla nostra guida self-host:
- Conferma Files + LICENSE di
moonshotai/Kimi-K3(non un fan mirror). - Fissa la versione del motore che dichiara supporto K3 / KDA.
- Pianifica capacità multi-acceleratore—non una singola GPU consumer.
- Load-test di prefix cache / long context prima di promettere 1M token in prod.
- Tieni un fallback sull’API hosted quando il cluster si scioglie il secondo giorno.
Percorso C — “Open” per compliance / procurement
Se legal ha chiesto “c’è un artefatto di pesi scaricabile da mettere in VPC?”—sì, da oggi. Quello è il win di procurement. Non significa automaticamente più economico o migliore dell’API nei primi 90 giorni di ops.
Miti da abbattere nel giorno dell’open source
| Mito | Realtà |
|---|---|
| “Open source significa gratis per sempre sul mio laptop” | La scala è da datacenter; i soli parametri attivi sono già ~classe 104B |
| “La licenza è MIT plain” | Kimi K3 License con regole MaaS + $20M e attribution su prodotti grandi |
| “Stanotte devo spostare ogni workflow sul self-host” | Qualità prodotto/API è già live; i pesi sbloccano controllo, non QI magico |
| “Qualsiasi upload Hugging Face chiamato Kimi-K3 va bene” | Preferisci moonshotai + pin del commit; i mirror GGUF community esploderanno—verifica la lineage |
| “Gli open weights sistemano la pausa abbonamento” | La pausa era sulla capacità hosted (contesto); le tue GPU sono un’altra coda |
| “Download = API gratis per sempre” | I pesi sono per la tua infra; l’API hosted continua a fatturare su platform.kimi.ai (guida prezzi) |
Cosa fare questa settimana (albero decisionale)
Se ti servono solo risposte o aiuto sul codice: apri l’app o l’API. Fatto.
Se ti servono diritti offline / VPC / fine-tune: avvia il download ufficiale, leggi LICENSE, prenota tempo GPU, segui le doc vLLM/SGLang—non uno zip random da Discord.
Se vendi inference: fai il test di revenue contro la Sezione 2 della licenza prima di mettere kimi-k3 su una pagina prezzi.
Se scrivi agent IDE tutto il giorno: tieni K2.7 Code come default; indirizza i job difficili, lunghi, multi-dominio a K3 (guida al passaggio di release).
Dove andare dopo
- Hub con specs live: /kimi-k3
- Status / timeline: /kimi-k3-status
- Self-host in profondità: /blog/38-kimi-k3-self-host-vllm-day0
- Disciplina di spesa API: /blog/37-kimi-k3-api-pricing-cost-control
- Scelta famiglia K2.6 / K2.7 / K3: /blog/29-kimi-which-model-k26-k27-k3
In sintesi: il 27 luglio ha consegnato ciò che il post di lancio aveva promesso—open weights a scala frontier, non un install consumer one-click. Scarica se hai un motivo; altrimenti usa il modello nel modo facile e lascia che qualcun altro babysitti il cluster.