Model Release
12 min Min. Lesezeit
AI Observer

Kimi K3 Hugging Face Download: Open-Source-Weights live

Kimi-K3-Hub: Specs, Preise, API-ID → /kimi-k3. Timeline → /kimi-k3-status. Self-Host-Pfad → /blog/38-kimi-k3-self-host-vllm-day0. Pre-Drop-Kalender → /blog/31-kimi-k3-open-weights-july-27.

Du hast kimi k3 huggingface, kimi k3 download oder kimi k3 open source gesucht—weil der Feed sagt, das Modell sei offen, und du willst einen echten Files-Tab, keine weitere Countdown-Seite.

Gute Nachricht: Stand 27. Juli 2026 sind die Kimi-K3-Open-Source-Weights live. Moonshot hat die Model Weights + den Tech-Report veröffentlicht. Das offizielle Hugging-Face-Repo moonshotai/Kimi-K3 hat echte Safetensors-Shards, eine LICENSE und eine volle Model Card—kein „Upcoming release“-Teaser.

Diese Seite ist unabhängig von Moonshot. Unten findest du den Day-of-Praxis-Read: wo du downloadest, was „Open Source / Open Weights“ bei License und GPUs wirklich heißt, und was du diese Woche tun solltest, ohne aus FOMO ein Rack zu verbrennen.

Kurzantwort (zuerst lesen)

  1. Ja—du kannst Kimi K3 jetzt von Hugging Face laden. Kanonischer Link: huggingface.co/moonshotai/Kimi-K3. Tech-Report-PDF: MoonshotAI/Kimi-K3 auf GitHub. Launch-Story: Kimi-K3-Blog.
  2. Open-Source-Weights ≠ gratis unendlicher lokaler Chat. Volles K3 bleibt ~2,8T Parameter (MoE; ~104B aktiv pro Token). Laptop-Ollama-Fantasien bleiben Fantasien—siehe unseren VRAM-/Ollama-Ehrlichkeitstest und den vLLM-Day-0-Guide.
  3. Lies die Kimi K3 License, bevor du produktisierst. Forschung, interner Einsatz und kleinere kommerzielle Embeds sind weitgehend offen. K3 als bezahlte API / Model-as-a-Service hosten oberhalb einer $20M Jahresumsatz-Schwelle braucht einen separaten Deal mit Moonshot. Details unten—nicht von „Modified MIT à la K2.x“ ausgehen.
  4. Die meisten sollten trotzdem nicht zuerst downloaden. Willst du Intelligenz heute? Produkt + API-ID kimi-k3. Willst du Weights für VPC / Fine-Tune / Audit? Labs und Infra-Teams mit Serving-Plan.

Ein Satz: der Open-Source-File-Drop am 27. Juli ist real; behandle ihn als Hugging-Face- + Cluster- + License-Event, nicht als One-Click-Chat-App-Install.

Official Kimi K3 open-weights release graphic from Moonshot

Quelle: @Kimi_Moonshot Open-Weights-Ankündigung, 27. Juli 2026.

Was sich gerade geändert hat (Open Source ist kein Kalender-Teaser mehr)

ThemaVor heute (unsere früheren Guides)Stand 27. Juli 2026
Hugging-Face-Files-TabLeer / „Upcoming“-CountdownLive-Download unter moonshotai/Kimi-K3 (Dutzende model-*-of-000096.safetensors + Configs)
License-DateiAus K2.x Modified MIT geratenKimi K3 License im Repo—lesen, nicht annehmen
Tech-Report„Kommt mit den Weights“Veröffentlicht (GitHub-PDF von der Model Card verlinkt)
Serving-StoryvLLM-PreviewModel Card zeigt auf vLLM Recipes, SGLang Cookbook, TokenSpeed
Dein Default-MoveAPI / ProduktWeiterhin API / Produkt für die meisten Teams; Self-Host nur, wenn du die Dateien brauchst

Wenn du „Open Weights 27. Juli: was du heute nutzen kannst“ gebookmarkt hast, als HF noch leer war—dieser Post war damals korrekt. Diese Seite ist das Day-of-Update für alle, die gerade Hugging Face / Download / Open Source suchen.

Was wirklich geliefert wurde (Kimi-K3-Open-Source-Drop)

Aus offizieller Model Card und Moonshot-Ankündigung:

Modell-Form (klartext)

SpecZahl / FaktWarum dich das interessiert
Gesamtparameter2,8T„Größtes offenes 3T-Klasse“-Marketing dreht sich um diese Skala
Aktiv pro Token~104BDu fährst nicht 2,8T dense—es ist sparse MoE
Experts16 von 896 selektiert (+ 2 shared)Sparsity ist die ganze Effizienz-Wette
Layers / Attention93 Layers; 69 KDA + 24 Gated MLAServing-Stacks brauchen KDA-aware Code, keine Vanilla-Llama-Rezepte
Kontext1.048.576 TokensLong-Repo- / Long-Agent-Jobs—kein Grund, jeden Chat zu maximieren
VisionMoonViT-V2 (~401M) nativ multimodalDieselben Weights verstehen Text + Bilder
QuantisierungMXFP4 Weights / MXFP8 Activations (QAT)Day-0-Formate sind compressed-tensor-Style—kein Random-GGUF von Fremden
Offizieller Effizienz-Claim~2,5× Intelligenz pro Compute-Einheit vs. K2-Ära-Scaling (deren Framing)Lies als Architektur-Story, nicht als Freifahrtschein für deine Stromrechnung

Moonshot öffnet außerdem mehr vom Stack ums Modell herum—Attention-Kernels, MoE-Kommunikationsbibliothek und Agent-Environment-Infra (z. B. AgentENV auf ihrem Channel genannt). Weights allein ergeben keine Production-Agent-Farm; der umgebende Code ist die zweite Hälfte von „open“.

Kimi K3 Hugging Face Download — nur offizielle Links

AssetURL
Weights + Model Card (hier downloaden)huggingface.co/moonshotai/Kimi-K3
Tech-Report (PDF)github.com/MoonshotAI/Kimi-K3/…/k3_tech_report.pdf
Produkt-Narrativ / früherer Launch-Postkimi.com/blog/kimi-k3
Gehostete API (wenn du nicht self-hostest)Model-ID kimi-k3 auf platform.kimi.ai

Pinne einen Commit-Hash, bevor du etwas Production-ähnliches verdrahtest. Day-0-Repos bewegen sich. Bevorzuge die Org moonshotai gegenüber Random-„Kimi-K3“-Mirrors, die diese Woche die Suche fluten.

Kimi K3 coding benchmarks (max effort)—why teams care about serving quality, not only download size

Quelle: Offizielle K3-Launch-Medien / Kimi-K3-Blog, 16. Juli 2026; dieselbe Chart-Klasse, auf die die Open-Weight-Card zurückverweist.

Kimi-K3-License (was „Open Source“ weiterhin einschränkt)

Hugging Face listet die License als other / kimi-k3, nicht als stock SPDX MIT. Die Kimi K3 License im Repo ist MIT-ähnlich mit kommerziellen Gates. Klartext (immer die Datei neu lesen—das ist keine Rechtsberatung):

SituationGrobe Lesart
Forschung, Fine-Tunes, ExperimenteGenerell erlaubt
Interner Einsatz (Modell/Capability nicht Dritten anbieten)Carve-out—Sections-2–3-Style-Gates greifen nicht genauso
K3 innerhalb eines Produkt-Features embedden (nicht „rohes Modell als API vermieten“)Oft anders behandelt als reines Model-as-a-Service—Definitionen sorgfältig lesen
Du betreibst Model as a Service (Dritte steuern Prompts / Fine-Tunes über dein gehostetes K3) und der Gruppenumsatz ist > $20M über beliebige 12 aufeinanderfolgende MonateDu musst vor kommerziellem Einsatz dieser Art eine separate Vereinbarung mit Moonshot verhandeln
Sehr große Consumer-Produkte (>100M MAU oder >$20M Monatsumsatz)„Kimi K3“ muss prominent in der UI dieses Produkts/Services stehen
Zugang nur über Moonshot-offizielle Produkte oder zertifizierte PartnerCommercial-Gate-Carve-outs greifen ebenfalls

Unsere Builder-Lesart: bist du ein Startup unter der Umsatzschwelle und shippst eine App mit K3 drin, ist das näher an „open mit Brand- + MaaS-Regeln“ als an „Apache free-for-all“. Willst du mit Moonshots eigener API konkurrieren, plane ein License-Gespräch, nicht nur Bandbreite.

Frühere offene Kimi-Linien (K2.5 / K2.6 / K2.7 Code) haben Leute trainiert, „Modified MIT“ zu sagen. K3 ist ein eigenes Dokument. Zitiere die Datei, nicht den Tweet.

Wer Kimi-K3-Weights downloaden sollte (und wer nicht)

Du bist…Mach das diese WocheSkip
Indie / Hobbyist, der „kimi k3 free“ oder „open source“ für Chat gegoogelt hatkimi.com oder Free-Tier-Produktpfade (ehrliche Gratis-Optionen)Multi-hundert-GB Hugging-Face-Pull „nur um Chat zu testen“
App- / Agent-Builder, der Features shipptAPI kimi-k3 + KostenkontrolleSelf-Host, bis Unit Economics es erzwingen
Infra / Platform mit Multi-Node-GPUsHF-Dateien verifizieren → vLLM- / SGLang-Recipes → Load-TestRandom Community-GGUF-Mirrors
Research Lab, das Weights für Audit / Fine-Tune brauchtOffizielles Repo clonen, Commit pinnen, LICENSE lesenRe-Uploads mit umbenannten Ordnern vertrauen
Team, das im IDE lebtBei K2.7 Code / Kimi Code für den Tages-PR bleiben (welches Modell)Volles K3 für jedes Autocomplete erzwingen

Auswahl-Urteil (unseres, nicht Moonshots): Open Weights ändern die Ownership- und Audit-Story. Sie ändern nicht die Produkt-Story für die meisten Leser. War dein Schmerz „API-Rechnung“ oder „Abo pausiert“, ist der Download von 2,8T-Klasse-Shards eine seltsame Lösung—Kapazitätsprobleme wandern von Moonshots GPUs zu deinen.

Kimi K3 architecture framing: KDA, Attention Residuals, sparse MoE

Quelle: Offizielle K3-Launch-Materialien / Kimi-K3-Blog, 16. Juli 2026.

So nutzt du die Open Weights, ohne dir selbst etwas vorzulügen

Pfad A — Gehostet (weiterhin der Default)

  • Chat / Work / Code auf kimi.com
  • API: kimi-k3, OpenAI-/Anthropic-kompatibel auf platform.kimi.ai
  • Öffentlicher Listenpreis, den wir früher getrackt haben: grob $0.30 Cache-Hit / $3 Cache-Miss / $15 Output pro 1M Tokens—auf der Live-Preisseite bestätigen (Pricing Deep Dive)

Thinking defaultet auf max Effort und liefert reasoning_content. Super für harte Jobs und teuer für Casual Chat—Disziplin schlägt Slogan.

Pfad B — Self-Host (jetzt, wo Files real sind)

Die Model Card steuert Day-0-Serving aktuell Richtung:

Checkliste, die aus unserem Self-Host-Guide weiter gilt:

  1. moonshotai/Kimi-K3 Files + LICENSE bestätigen (kein Fan-Mirror).
  2. Engine-Version pinnen, die K3- / KDA-Support beansprucht.
  3. Multi-Accelerator-Kapazität planen—keine einzelne Consumer-GPU.
  4. Prefix Cache / Long Context load-testen, bevor du 1M Tokens in Prod versprichst.
  5. Fallback auf die gehostete API behalten, wenn dein Cluster am Tag zwei schmilzt.

Pfad C — „Open“ für Compliance / Procurement

Wenn Legal gefragt hat „gibt es ein downloadbares Weight-Artefakt für die VPC?“—ja, ab heute. Das ist der Procurement-Win. Es heißt nicht automatisch billiger oder besser als die API für die ersten 90 Ops-Tage.

Mythen, die am Open-Source-Tag sterben sollten

MythosRealität
„Open Source heißt für immer gratis auf meinem Laptop“Skala ist Rechenzentrums-förmig; aktive Params allein sind ~104B-Klasse
„License ist plain MIT“Kimi K3 License mit MaaS + $20M und Attribution-Regeln für große Produkte
„Ich muss heute Nacht jeden Workflow auf Self-Host umstellen“Produkt-/API-Qualität läuft schon; Weights freischalten Kontrolle, nicht magisches IQ
„Jeder Hugging-Face-Upload namens Kimi-K3 ist ok“Bevorzuge moonshotai + Commit-Pin; Community-GGUF-Mirrors explodieren—Lineage prüfen
„Open Weights fixen die Abo-Pause“Pause war gehostete Kapazität (Hintergrund); deine eigenen GPUs sind eine andere Queue
„Download = für immer gratis API“Weights sind für deine Infra; die gehostete API rechnet weiter auf platform.kimi.ai (Pricing-Guide)

Was du diese Woche tun solltest (Entscheidungsbaum)

Brauchst du nur Antworten oder Code-Hilfe: App oder API öffnen. Fertig.

Brauchst du Offline / VPC / Fine-Tune-Rechte: offiziellen Download starten, LICENSE lesen, GPU-Zeit buchen, vLLM-/SGLang-Docs folgen—kein Random-Discord-Zip.

Verkaufst du Inference: Revenue-Test gegen Section 2 der License bevor du kimi-k3 auf eine Preisseite setzt.

Schreibst du den ganzen Tag IDE-Agents: K2.7 Code als Default behalten; harte, lange, multi-domain Jobs an K3 routen (Release-Switch-Guide).

Weiterführend

Fazit: Der 27. Juli hat geliefert, was der Launch-Post versprochen hat—Frontier-Scale Open Weights, kein Consumer-One-Click-Install. Downloaden, wenn du einen Grund hast; sonst nutze das Modell den einfachen Weg und lass jemand anderen den Cluster babysitten.

Verwandte Artikel

Willst du Kimi K3 selbst betreiben? Hier die ehrliche Trennung: Cluster-taugliche vLLM-Day-0-Vorbereitung versus „Ollama auf dem Gaming-Laptop“—und was du tust, solange die Weights noch Upcoming sind.
K3 ist nicht der Free-Chat-Weg. Die Preisliste $0.30 / $3 / $15 klar erklärt—wann Cache spart, wann Max-Thinking Geld verbrennt und wann günstigere Kimi-Modelle gewinnen.
Dein Feed ist voll mit Kimi K3. Die praktische Karte für diese Woche: App oder Free-Try, was tun wenn Subscribe pausiert ist, wann die API sich lohnt — und was bis zu den Weights am 27. Juli warten kann.