Alle Modelle

Kimi K3: Moonshots Frontier-Modell mit 2,8 Billionen Parametern

Moonshots Mixture-of-Experts-Modell mit 2,8 Billionen Parametern, einem Kontextfenster von 1M Token, nativer Bild- und Videoeingabe und offenen Gewichten.

1M tokens · Text / Vision / Video / Code · Prompt cache

Okou führt Kimi K3 nicht aus. Diese Seite ist eine Referenz für Spezifikationen, Preise und Benchmarks. Für dieselbe Art von Arbeit auf Okou nutzen Sie heute Claude Fable 5.

Claude Fable 5 ansehen

Kimi K3 ist das Frontier-Modell von Moonshot AI, veröffentlicht am 16. Juli 2026: ein sparsames Mixture-of-Experts-Netz mit 2,8 Billionen Parametern insgesamt, 16 von 896 aktiven Experten pro Token, einem Kontextfenster von 1.048.576 Token und nativer Bild- und Videoeingabe. Artificial Analysis bewertet es im Intelligence Index v4.1 mit 57,1 — Platz vier der getesteten Konfigurationen, hinter Claude Fable 5 (59,9) und GPT 5.6 Sol (58,9), vor Claude Opus 4.8.

Der Listenpreis liegt bei $3.00 pro Million Eingabe-Token, $0.30 bei einem Cache-Treffer und $15.00 pro Million Ausgabe-Token — einheitlich über das gesamte Fenster, ohne Aufschlag für lange Kontexte. Die offenen Gewichte erschienen am 27. Juli 2026 auf Hugging Face unter Moonshots eigener Kimi K3 License. Okou führt Kimi K3 nicht aus. Das nächstliegende Modell im Okou-Angebot ist Claude Fable 5: gleiches 1M-Token-Fenster und Spitzenplatz im selben Intelligence Index.

Was ist Kimi K3?

16. Juli 2026 · Moonshots Frontier-Linie. Nachfolger der Kimi-K2-Serie einschließlich K2.7 Code.

Kimi K3 ist das Frontier-Modell von Moonshot AI, vorgestellt am 16. Juli 2026 und über die Kimi-App sowie die Kimi-API als kimi-k3 verfügbar. Es ist ein sparsames Mixture-of-Experts-Modell: 2,8 Billionen Parameter insgesamt, davon 16 von 896 Experten pro Token aktiv. Genau das hält die Inferenzkosten trotz der Parameterzahl auf dem Niveau eines dichten Mittelklassemodells.

Der Sprung gegenüber der K2-Reihe fällt bei langlaufender Agentenarbeit am größten aus. In Moonshots Launch-Suite führt K3 alle getesteten Modelle bei Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 und Automation Bench an, liegt aber bei FrontierSWE hinter Claude Fable 5 und bei DeepSWE hinter GPT 5.6 Sol. Beim GDPval-AA-v2-Elo von Artificial Analysis, das wirtschaftlich wertvolle Wissensarbeit bewertet, erreicht es 1668 — nach 1190 für Kimi K2.6 und über Claude Opus 4.8 mit 1600.

Das zeichnet Kimi K3 aus

Architektur- und Funktionsmerkmale im Überblick.

K3 kombiniert den MoE-Stack mit zwei Effizienzmechanismen, die Moonshot Kimi Delta Attention und Attention Residuals nennt und denen bis zu 6,3-fach schnelleres Decoding zugeschrieben wird. Das Fenster von 1.048.576 Token wird zu einem einzigen Preis ohne Kontextstufen bedient. Die Ausgabe reicht standardmäßig bis 131.072 Token und lässt sich innerhalb desselben Fensters höher konfigurieren. Eingabe sind Text, Bilder und Video; Ausgabe ist Text. Die API unter platform.kimi.ai ist OpenAI-kompatibel, und die Gewichte — rund 594 GB in MXFP4 — sind zum Selbsthosten veröffentlicht.

Technische Daten auf einen Blick

FamilieKimi K3
Parameter2,8T gesamt / 16 von 896 Experten aktiv (MoE)
ModalitätenText, Bild, Video hinein; Text hinaus
Kontextfenster1.048.576 Token
Maximale Ausgabe131K Token standardmäßig, im Fenster konfigurierbar
LizenzKimi K3 License (offene Gewichte, 27. Juli 2026)

Kimi K3 Benchmarks

Die Werte zu Coding, Agenten und Bildverarbeitung stammen aus Moonshots Launch-Tabelle, mit allen Modellen auf maximalem Reasoning-Aufwand; Intelligence Index und GDPval-Elo sind unabhängige Messungen von Artificial Analysis. Eine Anbietertabelle ist eher eine Obergrenze als eine Zusage, und unabhängige Tester berichten von einer Halluzinationsrate deutlich über Moonshots eigener Angabe.

Artificial Analysis Intelligence Index v4.1unabhängig; Platz 4, hinter Fable 5 (59,9) und GPT 5.6 Sol (58,9)
57.1
GDPval-AA v2 (Elo)unabhängig; über Opus 4.8 (1600)
1668
GPQA DiamondAnbieterangabe
93.5
Terminal-Bench 2.1Anbieterangabe; Sol 88,8
88.3
FrontierSWEAnbieterangabe; Fable 5 86,6
81.2
DeepSWEAnbieterangabe; Sol 73,0
67.5
SWE MarathonAnbieterangabe; Bestwert der Launch-Suite
42.0
BrowseCompAnbieterangabe; Bestwert der Launch-Suite
91.2

Kimi K3 Preise

Listenpreis des Anbieters, pro 1 Mio. Tokens.

Input$3.00
Output$15.00
Cache Read$0.30
Cache WriteNicht abgerechnet

Wie sich Kimi K3 in der Praxis verhält

Berichtetes Verhalten aus den Launch-Unterlagen des Anbieters und unabhängigen Evaluierungen.

Langlaufende Agentenläufe

Die Benchmarks, die K3 klar anführt — SWE Marathon, Automation Bench, BrowseComp — messen das Durchhalten über Hunderte Schritte, nicht die Korrektheit einer einzelnen Antwort. Das passt zu Moonshots Positionierung als Agenten-Engine.

Einheitlicher Preis über 1M Token

Das komplette Fenster von 1.048.576 Token wird zu einem Satz abgerechnet, ohne Aufschlag ab einer Schwelle. Das 1M-Fenster von GPT-5.5 bepreist Eingaben oberhalb von 272K Token anders — genau das macht sehr lange Läufe anderswo teuer.

Kosten pro Aufgabe

Artificial Analysis misst $0.94 pro Aufgabe über den gesamten Index — etwa die Hälfte von Claude Opus 4.8 ($1.80) und auf dem Niveau von GPT 5.6 Sol ($1.04). Moonshot nennt Cache-Trefferquoten über 90% bei Coding-Workloads, was die effektiven Eingabekosten Richtung $0.30 zieht.

Beste Agent-Aufgaben für Kimi K3

Ganze Repositories in einem Kontext lesen

Ein 1M-Token-Fenster zum Einheitspreis fasst eine komplette Codebasis, ein Quartal an Support-Tickets oder einen ganzen Dokumentensatz in eine Anfrage — ohne Chunking und ohne Aufschlag am Ende des Fensters.

Browsing- und Recherche-Agenten

BrowseComp 91,2 ist der höchste Wert in Moonshots Launch-Tabelle, vor GPT 5.6 Sol und Claude Fable 5. Mehrstufige Webrecherche — Quelle finden, Zitat verfolgen, Zahlen abgleichen — zeigt K3s Agententraining am deutlichsten.

Screenshot- und Videoeingabe

K3 nimmt Bilder und Video nativ entgegen. QA-Agenten, die Screenshots lesen, und Pipelines für aufgezeichnete Clips brauchen deshalb kein separates Vision-Modell vor dem Reasoning-Modell.

Wann du Kimi K3 überspringen solltest

Verzichten Sie auf K3, wenn ein anbietergeprüftes Sicherheitsprofil oder vertraglicher Enterprise-Support in den USA oder der EU nötig ist; wenn die Prompts so kurz sind, dass der Cache-Preis von $0.30 nie greift und ein kostengünstigeres Modell reicht; und wenn Selbsthosting das Ziel ist — 594 GB MXFP4-Gewichte verlangen für den Produktivbetrieb 64 oder mehr Beschleuniger. Unabhängige Tests messen zudem Halluzinationsraten deutlich über Moonshots veröffentlichter Zahl, faktenlastige Ausgaben brauchen also weiterhin eine Prüfung. Und auf Okou ist K3 ohnehin keine Option.

Kimi K3 vs andere Modelle

Kimi K3 vs Claude Fable 5

Fable 5 führt im Intelligence Index (59,9 zu 57,1) und bei FrontierSWE (86,6 zu 81,2); K3 gewinnt Terminal-Bench 2.1, BrowseComp und SWE Marathon. Beide haben ein 1M-Token-Fenster. Entscheidend sind meist Preis und Verfügbarkeit: Fable 5 kostet $10/$50 pro Million Token und läuft auf Okou, K3 kostet $3/$15 und läuft dort nicht.

Kimi K3 vs GPT 5.6 Sol

Sol erreicht im Intelligence Index 58,9 gegenüber 57,1 und gewinnt DeepSWE (73,0 zu 67,5) sowie Terminal-Bench um einen halben Punkt. K3 hält mit 1M Fenster gegen Sols 400K und einem Drittel des Eingabepreises dagegen. Die gemessenen Kosten pro Aufgabe liegen nah beieinander: $0.94 für K3, $1.04 für Sol.

Kimi K3 vs Claude Opus 4.8

K3 liegt bei den meisten Agenten-Benchmarks und beim GDPval-AA-Elo (1668 zu 1600) vor Opus 4.8, bei $3/$15 gegenüber $5/$25. Opus 4.8 behält den Vorsprung bei der Zuverlässigkeit des Tool-Routings im Produktivbetrieb und ist auf Okou verfügbar, K3 nicht.

Kimi K3 vs Kimi K2.7 Code

K3 ist der Nachfolger: 1M Token Kontext statt 256K, native Videoeingabe und ein deutlich höheres Niveau bei Agenten-Benchmarks — zu etwa dem dreifachen Preis ($3/$15 gegenüber $1.14/$4.80). Keines von beiden läuft heute auf Okou; K2.7 Code wurde entfernt, K3 wurde nie aufgenommen.

Fazit: Solltest du Kimi K3 nutzen?

Das stärkste bisher veröffentlichte Modell mit offenen Gewichten und das erste, das bei Agentenarbeit mit der geschlossenen Spitze mithält — zu einem Drittel des Preises von Fable 5. Okou führt es nicht aus, diese Seite ist also Referenz: Für dieselben 1M-Token-Agentenlasten auf Okou kommt Claude Fable 5 am nächsten.

Häufig gestellte Fragen

Kann ich Kimi K3 auf Okou nutzen?

Derzeit nicht. Kimi K3 gehört nicht zum Modellangebot von Okou — es lässt sich weder im Chat noch in einem Workflow auswählen und auch nicht mit einem eigenen API-Schlüssel hinzufügen. Claude Fable 5 ist das nächstliegende Modell, das Okou ausführt: dasselbe 1M-Token-Kontextfenster und der Spitzenwert im selben Intelligence Index.

Wann wurde Kimi K3 veröffentlicht?

Moonshot AI hat Kimi K3 am 16. Juli 2026 in der Kimi-App und der Kimi-API gestartet und die offenen Gewichte am 27. Juli 2026 auf Hugging Face veröffentlicht.

Wie groß ist das Kontextfenster von Kimi K3?

1.048.576 Token für Eingabe und Ausgabe zusammen, einheitlich bepreist über das gesamte Fenster. Die Ausgabe liegt standardmäßig bei 131.072 Token und lässt sich innerhalb des verbleibenden Kontexts höher konfigurieren.

Was kostet Kimi K3?

$3.00 pro Million Eingabe-Token ohne Cache-Treffer, $0.30 pro Million mit Cache-Treffer und $15.00 pro Million Ausgabe-Token, ohne Aufschlag für lange Kontexte. In der Kimi-App beginnen die bezahlten Stufen bei $19 pro Monat für ein 256K-Fenster, das volle 1M-Fenster gibt es ab $39 pro Monat.

Ist Kimi K3 Open Source?

Die Gewichte sind unter Moonshots eigener Kimi K3 License offen. Sie liest sich wie MIT, mit zwei kommerziellen Bedingungen: Ein Model-as-a-Service-Geschäft braucht eine gesonderte Vereinbarung mit Moonshot, sobald der Umsatz in 12 Monaten $20 Mio. übersteigt, und jedes Produkt mit mehr als 100 Millionen monatlich aktiven Nutzern oder $20 Mio. Monatsumsatz muss "Kimi K3" in der Oberfläche anzeigen.

Alternativen

Verfügbarkeit von Kimi K3 auf Okou

Kimi K3 gehört nicht zum Modellangebot von Okou. Das Modell lässt sich weder im Chat noch in einem Workflow auswählen und auch nicht mit einem eigenen API-Schlüssel hinzufügen. Claude Fable 5 ist das nächstliegende Modell, das Okou heute ausführt.