Kimi K3 Hugging Face Download: Open-Source-Weights live
Kimi-K3-Hub: Specs, Preise, API-ID → /kimi-k3. Timeline → /kimi-k3-status. Self-Host-Pfad → /blog/38-kimi-k3-self-host-vllm-day0. Pre-Drop-Kalender → /blog/31-kimi-k3-open-weights-july-27.
Du hast kimi k3 huggingface, kimi k3 download oder kimi k3 open source gesucht—weil der Feed sagt, das Modell sei offen, und du willst einen echten Files-Tab, keine weitere Countdown-Seite.
Gute Nachricht: Stand 27. Juli 2026 sind die Kimi-K3-Open-Source-Weights live. Moonshot hat die Model Weights + den Tech-Report veröffentlicht. Das offizielle Hugging-Face-Repo moonshotai/Kimi-K3 hat echte Safetensors-Shards, eine LICENSE und eine volle Model Card—kein „Upcoming release“-Teaser.
Diese Seite ist unabhängig von Moonshot. Unten findest du den Day-of-Praxis-Read: wo du downloadest, was „Open Source / Open Weights“ bei License und GPUs wirklich heißt, und was du diese Woche tun solltest, ohne aus FOMO ein Rack zu verbrennen.
Kurzantwort (zuerst lesen)
- Ja—du kannst Kimi K3 jetzt von Hugging Face laden. Kanonischer Link: huggingface.co/moonshotai/Kimi-K3. Tech-Report-PDF: MoonshotAI/Kimi-K3 auf GitHub. Launch-Story: Kimi-K3-Blog.
- Open-Source-Weights ≠ gratis unendlicher lokaler Chat. Volles K3 bleibt ~2,8T Parameter (MoE; ~104B aktiv pro Token). Laptop-Ollama-Fantasien bleiben Fantasien—siehe unseren VRAM-/Ollama-Ehrlichkeitstest und den vLLM-Day-0-Guide.
- Lies die Kimi K3 License, bevor du produktisierst. Forschung, interner Einsatz und kleinere kommerzielle Embeds sind weitgehend offen. K3 als bezahlte API / Model-as-a-Service hosten oberhalb einer $20M Jahresumsatz-Schwelle braucht einen separaten Deal mit Moonshot. Details unten—nicht von „Modified MIT à la K2.x“ ausgehen.
- Die meisten sollten trotzdem nicht zuerst downloaden. Willst du Intelligenz heute? Produkt + API-ID
kimi-k3. Willst du Weights für VPC / Fine-Tune / Audit? Labs und Infra-Teams mit Serving-Plan.
Ein Satz: der Open-Source-File-Drop am 27. Juli ist real; behandle ihn als Hugging-Face- + Cluster- + License-Event, nicht als One-Click-Chat-App-Install.

Quelle: @Kimi_Moonshot Open-Weights-Ankündigung, 27. Juli 2026.
Was sich gerade geändert hat (Open Source ist kein Kalender-Teaser mehr)
| Thema | Vor heute (unsere früheren Guides) | Stand 27. Juli 2026 |
|---|---|---|
| Hugging-Face-Files-Tab | Leer / „Upcoming“-Countdown | Live-Download unter moonshotai/Kimi-K3 (Dutzende model-*-of-000096.safetensors + Configs) |
| License-Datei | Aus K2.x Modified MIT geraten | Kimi K3 License im Repo—lesen, nicht annehmen |
| Tech-Report | „Kommt mit den Weights“ | Veröffentlicht (GitHub-PDF von der Model Card verlinkt) |
| Serving-Story | vLLM-Preview | Model Card zeigt auf vLLM Recipes, SGLang Cookbook, TokenSpeed |
| Dein Default-Move | API / Produkt | Weiterhin API / Produkt für die meisten Teams; Self-Host nur, wenn du die Dateien brauchst |
Wenn du „Open Weights 27. Juli: was du heute nutzen kannst“ gebookmarkt hast, als HF noch leer war—dieser Post war damals korrekt. Diese Seite ist das Day-of-Update für alle, die gerade Hugging Face / Download / Open Source suchen.
Was wirklich geliefert wurde (Kimi-K3-Open-Source-Drop)
Aus offizieller Model Card und Moonshot-Ankündigung:
Modell-Form (klartext)
| Spec | Zahl / Fakt | Warum dich das interessiert |
|---|---|---|
| Gesamtparameter | 2,8T | „Größtes offenes 3T-Klasse“-Marketing dreht sich um diese Skala |
| Aktiv pro Token | ~104B | Du fährst nicht 2,8T dense—es ist sparse MoE |
| Experts | 16 von 896 selektiert (+ 2 shared) | Sparsity ist die ganze Effizienz-Wette |
| Layers / Attention | 93 Layers; 69 KDA + 24 Gated MLA | Serving-Stacks brauchen KDA-aware Code, keine Vanilla-Llama-Rezepte |
| Kontext | 1.048.576 Tokens | Long-Repo- / Long-Agent-Jobs—kein Grund, jeden Chat zu maximieren |
| Vision | MoonViT-V2 (~401M) nativ multimodal | Dieselben Weights verstehen Text + Bilder |
| Quantisierung | MXFP4 Weights / MXFP8 Activations (QAT) | Day-0-Formate sind compressed-tensor-Style—kein Random-GGUF von Fremden |
| Offizieller Effizienz-Claim | ~2,5× Intelligenz pro Compute-Einheit vs. K2-Ära-Scaling (deren Framing) | Lies als Architektur-Story, nicht als Freifahrtschein für deine Stromrechnung |
Moonshot öffnet außerdem mehr vom Stack ums Modell herum—Attention-Kernels, MoE-Kommunikationsbibliothek und Agent-Environment-Infra (z. B. AgentENV auf ihrem Channel genannt). Weights allein ergeben keine Production-Agent-Farm; der umgebende Code ist die zweite Hälfte von „open“.
Kimi K3 Hugging Face Download — nur offizielle Links
| Asset | URL |
|---|---|
| Weights + Model Card (hier downloaden) | huggingface.co/moonshotai/Kimi-K3 |
| Tech-Report (PDF) | github.com/MoonshotAI/Kimi-K3/…/k3_tech_report.pdf |
| Produkt-Narrativ / früherer Launch-Post | kimi.com/blog/kimi-k3 |
| Gehostete API (wenn du nicht self-hostest) | Model-ID kimi-k3 auf platform.kimi.ai |
Pinne einen Commit-Hash, bevor du etwas Production-ähnliches verdrahtest. Day-0-Repos bewegen sich. Bevorzuge die Org moonshotai gegenüber Random-„Kimi-K3“-Mirrors, die diese Woche die Suche fluten.

Quelle: Offizielle K3-Launch-Medien / Kimi-K3-Blog, 16. Juli 2026; dieselbe Chart-Klasse, auf die die Open-Weight-Card zurückverweist.
Kimi-K3-License (was „Open Source“ weiterhin einschränkt)
Hugging Face listet die License als other / kimi-k3, nicht als stock SPDX MIT. Die Kimi K3 License im Repo ist MIT-ähnlich mit kommerziellen Gates. Klartext (immer die Datei neu lesen—das ist keine Rechtsberatung):
| Situation | Grobe Lesart |
|---|---|
| Forschung, Fine-Tunes, Experimente | Generell erlaubt |
| Interner Einsatz (Modell/Capability nicht Dritten anbieten) | Carve-out—Sections-2–3-Style-Gates greifen nicht genauso |
| K3 innerhalb eines Produkt-Features embedden (nicht „rohes Modell als API vermieten“) | Oft anders behandelt als reines Model-as-a-Service—Definitionen sorgfältig lesen |
| Du betreibst Model as a Service (Dritte steuern Prompts / Fine-Tunes über dein gehostetes K3) und der Gruppenumsatz ist > $20M über beliebige 12 aufeinanderfolgende Monate | Du musst vor kommerziellem Einsatz dieser Art eine separate Vereinbarung mit Moonshot verhandeln |
| Sehr große Consumer-Produkte (>100M MAU oder >$20M Monatsumsatz) | „Kimi K3“ muss prominent in der UI dieses Produkts/Services stehen |
| Zugang nur über Moonshot-offizielle Produkte oder zertifizierte Partner | Commercial-Gate-Carve-outs greifen ebenfalls |
Unsere Builder-Lesart: bist du ein Startup unter der Umsatzschwelle und shippst eine App mit K3 drin, ist das näher an „open mit Brand- + MaaS-Regeln“ als an „Apache free-for-all“. Willst du mit Moonshots eigener API konkurrieren, plane ein License-Gespräch, nicht nur Bandbreite.
Frühere offene Kimi-Linien (K2.5 / K2.6 / K2.7 Code) haben Leute trainiert, „Modified MIT“ zu sagen. K3 ist ein eigenes Dokument. Zitiere die Datei, nicht den Tweet.
Wer Kimi-K3-Weights downloaden sollte (und wer nicht)
| Du bist… | Mach das diese Woche | Skip |
|---|---|---|
| Indie / Hobbyist, der „kimi k3 free“ oder „open source“ für Chat gegoogelt hat | kimi.com oder Free-Tier-Produktpfade (ehrliche Gratis-Optionen) | Multi-hundert-GB Hugging-Face-Pull „nur um Chat zu testen“ |
| App- / Agent-Builder, der Features shippt | API kimi-k3 + Kostenkontrolle | Self-Host, bis Unit Economics es erzwingen |
| Infra / Platform mit Multi-Node-GPUs | HF-Dateien verifizieren → vLLM- / SGLang-Recipes → Load-Test | Random Community-GGUF-Mirrors |
| Research Lab, das Weights für Audit / Fine-Tune braucht | Offizielles Repo clonen, Commit pinnen, LICENSE lesen | Re-Uploads mit umbenannten Ordnern vertrauen |
| Team, das im IDE lebt | Bei K2.7 Code / Kimi Code für den Tages-PR bleiben (welches Modell) | Volles K3 für jedes Autocomplete erzwingen |
Auswahl-Urteil (unseres, nicht Moonshots): Open Weights ändern die Ownership- und Audit-Story. Sie ändern nicht die Produkt-Story für die meisten Leser. War dein Schmerz „API-Rechnung“ oder „Abo pausiert“, ist der Download von 2,8T-Klasse-Shards eine seltsame Lösung—Kapazitätsprobleme wandern von Moonshots GPUs zu deinen.

Quelle: Offizielle K3-Launch-Materialien / Kimi-K3-Blog, 16. Juli 2026.
So nutzt du die Open Weights, ohne dir selbst etwas vorzulügen
Pfad A — Gehostet (weiterhin der Default)
- Chat / Work / Code auf kimi.com
- API:
kimi-k3, OpenAI-/Anthropic-kompatibel auf platform.kimi.ai - Öffentlicher Listenpreis, den wir früher getrackt haben: grob $0.30 Cache-Hit / $3 Cache-Miss / $15 Output pro 1M Tokens—auf der Live-Preisseite bestätigen (Pricing Deep Dive)
Thinking defaultet auf max Effort und liefert reasoning_content. Super für harte Jobs und teuer für Casual Chat—Disziplin schlägt Slogan.
Pfad B — Self-Host (jetzt, wo Files real sind)
Die Model Card steuert Day-0-Serving aktuell Richtung:
Checkliste, die aus unserem Self-Host-Guide weiter gilt:
moonshotai/Kimi-K3Files + LICENSE bestätigen (kein Fan-Mirror).- Engine-Version pinnen, die K3- / KDA-Support beansprucht.
- Multi-Accelerator-Kapazität planen—keine einzelne Consumer-GPU.
- Prefix Cache / Long Context load-testen, bevor du 1M Tokens in Prod versprichst.
- Fallback auf die gehostete API behalten, wenn dein Cluster am Tag zwei schmilzt.
Pfad C — „Open“ für Compliance / Procurement
Wenn Legal gefragt hat „gibt es ein downloadbares Weight-Artefakt für die VPC?“—ja, ab heute. Das ist der Procurement-Win. Es heißt nicht automatisch billiger oder besser als die API für die ersten 90 Ops-Tage.
Mythen, die am Open-Source-Tag sterben sollten
| Mythos | Realität |
|---|---|
| „Open Source heißt für immer gratis auf meinem Laptop“ | Skala ist Rechenzentrums-förmig; aktive Params allein sind ~104B-Klasse |
| „License ist plain MIT“ | Kimi K3 License mit MaaS + $20M und Attribution-Regeln für große Produkte |
| „Ich muss heute Nacht jeden Workflow auf Self-Host umstellen“ | Produkt-/API-Qualität läuft schon; Weights freischalten Kontrolle, nicht magisches IQ |
| „Jeder Hugging-Face-Upload namens Kimi-K3 ist ok“ | Bevorzuge moonshotai + Commit-Pin; Community-GGUF-Mirrors explodieren—Lineage prüfen |
| „Open Weights fixen die Abo-Pause“ | Pause war gehostete Kapazität (Hintergrund); deine eigenen GPUs sind eine andere Queue |
| „Download = für immer gratis API“ | Weights sind für deine Infra; die gehostete API rechnet weiter auf platform.kimi.ai (Pricing-Guide) |
Was du diese Woche tun solltest (Entscheidungsbaum)
Brauchst du nur Antworten oder Code-Hilfe: App oder API öffnen. Fertig.
Brauchst du Offline / VPC / Fine-Tune-Rechte: offiziellen Download starten, LICENSE lesen, GPU-Zeit buchen, vLLM-/SGLang-Docs folgen—kein Random-Discord-Zip.
Verkaufst du Inference: Revenue-Test gegen Section 2 der License bevor du kimi-k3 auf eine Preisseite setzt.
Schreibst du den ganzen Tag IDE-Agents: K2.7 Code als Default behalten; harte, lange, multi-domain Jobs an K3 routen (Release-Switch-Guide).
Weiterführend
- Hub mit Live-Specs: /kimi-k3
- Status / Timeline: /kimi-k3-status
- Self-Host in der Tiefe: /blog/38-kimi-k3-self-host-vllm-day0
- API-Geld-Disziplin: /blog/37-kimi-k3-api-pricing-cost-control
- Familie wählen K2.6 / K2.7 / K3: /blog/29-kimi-which-model-k26-k27-k3
Fazit: Der 27. Juli hat geliefert, was der Launch-Post versprochen hat—Frontier-Scale Open Weights, kein Consumer-One-Click-Install. Downloaden, wenn du einen Grund hast; sonst nutze das Modell den einfachen Weg und lass jemand anderen den Cluster babysitten.