Semua model

Kimi K3: model frontier 2,8T dari Moonshot

Model Mixture-of-Experts 2,8 triliun parameter dari Moonshot, dengan context window 1J token, input gambar dan video secara native, serta bobot terbuka.

1M tokens · Text / Vision / Video / Code · Prompt cache

Okou tidak menjalankan Kimi K3. Halaman ini adalah referensi untuk spesifikasi, harga, dan benchmark-nya. Untuk pekerjaan sejenis di Okou, saat ini gunakan Claude Fable 5.

Lihat Claude Fable 5

Kimi K3 adalah model frontier Moonshot AI yang diluncurkan 16 Juli 2026: jaringan Mixture-of-Experts jarang dengan total 2,8 triliun parameter, 16 dari 896 expert aktif per token, context window 1.048.576 token, dan input gambar serta video secara native. Artificial Analysis memberinya 57,1 pada Intelligence Index v4.1 — peringkat empat di antara konfigurasi yang diuji, di bawah Claude Fable 5 (59,9) dan GPT 5.6 Sol (58,9), di atas Claude Opus 4.8.

Harga resminya $3.00 per juta token input, $0.30 saat cache hit, dan $15.00 per juta token output, rata di seluruh window tanpa biaya tambahan untuk konteks panjang. Bobot terbuka terbit di Hugging Face pada 27 Juli 2026 dengan Kimi K3 License milik Moonshot sendiri. Okou tidak menjalankan Kimi K3. Model terdekat di jajaran Okou adalah Claude Fable 5, yang punya window 1J token yang sama dan memimpin Intelligence Index yang sama.

Apa itu Kimi K3?

16 Juli 2026 · Lini frontier Moonshot. Penerus seri Kimi K2, termasuk K2.7 Code.

Kimi K3 adalah model frontier Moonshot AI, diperkenalkan pada 16 Juli 2026 dan disajikan lewat aplikasi Kimi serta Kimi API sebagai kimi-k3. Ini model Mixture-of-Experts jarang: total 2,8 triliun parameter dengan 16 dari 896 expert aktif per token, dan justru itulah yang menjaga biaya inferensi tetap dekat dengan model dense kelas menengah meski ukurannya besar.

Lompatan terbesar dibanding lini K2 terlihat pada pekerjaan agen berdurasi panjang. Pada suite peluncuran Moonshot, K3 memimpin semua model yang diuji di Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2, dan Automation Bench, sementara tertinggal dari Claude Fable 5 di FrontierSWE dan dari GPT 5.6 Sol di DeepSWE. Pada Elo GDPval-AA v2 milik Artificial Analysis, yang menilai pekerjaan pengetahuan bernilai ekonomi, skornya mencapai 1668, naik dari 1190 milik Kimi K2.6 dan di atas 1600 milik Claude Opus 4.8.

Apa yang menonjol dari Kimi K3

Fitur arsitektur dan kapabilitas utama.

K3 memadukan tumpukan MoE dengan dua mekanisme efisiensi yang disebut Moonshot sebagai Kimi Delta Attention dan Attention Residuals, yang diklaim mempercepat decoding hingga 6,3 kali, dan menyajikan window 1.048.576 token dengan satu harga rata tanpa tiering konteks. Output mencapai 131.072 token secara default dan bisa dikonfigurasi lebih tinggi di dalam window yang sama. Input mencakup teks, gambar, dan video; output berupa teks. API di platform.kimi.ai kompatibel dengan OpenAI, dan bobotnya — sekitar 594 GB dalam MXFP4 — diterbitkan untuk self-hosting.

Spesifikasi sekilas

KeluargaKimi K3
ParameterTotal 2,8T / 16 dari 896 expert aktif (MoE)
ModalitasInput teks, gambar, video; output teks
Context window1.048.576 token
Output maksimum131K token secara default, dapat dikonfigurasi dalam window
LisensiKimi K3 License (bobot terbuka, 27 Juli 2026)

Benchmark Kimi K3

Skor coding, agen, dan visual adalah angka peluncuran Moonshot dengan semua model pada usaha penalaran maksimum; Intelligence Index dan Elo GDPval berasal dari pengukuran independen Artificial Analysis. Tabel vendor adalah batas atas, bukan jaminan, dan penguji independen melaporkan tingkat halusinasi jauh di atas angka Moonshot sendiri.

Artificial Analysis Intelligence Index v4.1independen; peringkat 4, di bawah Fable 5 (59,9) dan GPT 5.6 Sol (58,9)
57.1
GDPval-AA v2 (Elo)independen; di atas Opus 4.8 (1600)
1668
GPQA Diamonddilaporkan vendor
93.5
Terminal-Bench 2.1dilaporkan vendor; Sol 88,8
88.3
FrontierSWEdilaporkan vendor; Fable 5 86,6
81.2
DeepSWEdilaporkan vendor; Sol 73,0
67.5
SWE Marathondilaporkan vendor; tertinggi di suite peluncuran
42.0
BrowseCompdilaporkan vendor; tertinggi di suite peluncuran
91.2

Harga Kimi K3

Harga daftar vendor, per 1J token.

Input$3.00
Output$15.00
Cache read$0.30
Cache writeTidak ditagih

Bagaimana Kimi K3 berperilaku dalam praktik

Perilaku yang dilaporkan materi peluncuran vendor dan evaluasi independen.

Sesi agen berdurasi panjang

Benchmark yang dipimpin K3 secara meyakinkan — SWE Marathon, Automation Bench, BrowseComp — mengukur kemampuan tetap pada tujuan selama ratusan langkah, bukan ketepatan satu jawaban. Ini cocok dengan cara Moonshot memposisikannya: pertama-tama sebagai mesin agen.

Harga rata di 1J token

Seluruh window 1.048.576 token ditagih dengan satu tarif, tanpa tambahan biaya setelah ambang tertentu. Sebaliknya, window 1J milik GPT-5.5 menagih input di atas 272K token dengan tarif berbeda, dan itulah yang membuat sesi konteks tunggal yang sangat panjang jadi mahal di tempat lain.

Biaya per tugas

Artificial Analysis mengukur $0.94 per tugas di seluruh indeksnya — sekitar setengah dari $1.80 milik Claude Opus 4.8 dan setara $1.04 milik GPT 5.6 Sol. Moonshot menyebut tingkat cache hit di atas 90% pada beban kerja coding, yang menarik biaya input efektif mendekati tarif $0.30.

Tugas agen terbaik untuk Kimi K3

Membaca satu repositori penuh dalam satu konteks

Window 1J token dengan harga rata memuat seluruh basis kode, tiket dukungan satu kuartal, atau kumpulan dokumen panjang dalam satu permintaan, tanpa perlu dipecah dan tanpa biaya tambahan yang menunggu di ujung window.

Agen penelusuran dan riset

BrowseComp 91,2 adalah skor tertinggi pada tabel peluncuran Moonshot, di atas GPT 5.6 Sol dan Claude Fable 5. Riset web bertahap — menemukan sumber, mengikuti kutipan, mencocokkan angka — adalah tempat pelatihan agentic K3 paling terlihat.

Input tangkapan layar dan video

K3 menerima gambar dan video secara native, jadi agen QA yang membaca tangkapan layar dan pipeline yang memproses klip rekaman tidak perlu menyisipkan model vision terpisah di depan model penalaran.

Kapan melewatkan Kimi K3

Lewati K3 bila pekerjaan menuntut profil keamanan yang diaudit vendor atau dukungan enterprise berbasis kontrak di AS atau UE; bila prompt-nya cukup pendek sehingga tarif cache $0.30 tidak pernah berlaku dan model hemat biaya sudah cukup; dan bila self-hosting adalah tujuannya — bobot MXFP4 sebesar 594 GB butuh 64 akselerator atau lebih untuk produksi. Pengujian independen juga mengukur tingkat halusinasi jauh di atas angka yang dipublikasikan Moonshot, jadi keluaran yang padat fakta tetap perlu diperiksa. Dan di Okou, K3 memang bukan pilihan yang tersedia.

Kimi K3 vs model lain

Kimi K3 vs Claude Fable 5

Fable 5 unggul di Intelligence Index (59,9 berbanding 57,1) dan FrontierSWE (86,6 berbanding 81,2); K3 mengambil Terminal-Bench 2.1, BrowseComp, dan SWE Marathon. Keduanya punya window 1J token. Yang biasanya menentukan adalah harga dan ketersediaan: Fable 5 seharga $10/$50 per juta token dan berjalan di Okou, K3 seharga $3/$15 dan tidak.

Kimi K3 vs GPT 5.6 Sol

Sol mencetak 58,9 di Intelligence Index berbanding 57,1 milik K3, dan menang di DeepSWE (73,0 berbanding 67,5) serta Terminal-Bench dengan selisih setengah poin. K3 menjawab dengan window 1J berbanding 400K milik Sol dan sepertiga harga input. Biaya terukur per tugas berdekatan: $0.94 untuk K3, $1.04 untuk Sol.

Kimi K3 vs Claude Opus 4.8

K3 unggul atas Opus 4.8 di sebagian besar suite agentic dan pada Elo GDPval-AA (1668 berbanding 1600), dengan harga $3/$15 berbanding $5/$25. Opus 4.8 tetap unggul pada keandalan tool routing di produksi dan tersedia di Okou, sementara K3 tidak.

Kimi K3 vs Kimi K2.7 Code

K3 adalah penerusnya: konteks 1J token berbanding 256K, input video native, dan langit-langit benchmark agentic yang jauh lebih tinggi — dengan harga sekitar tiga kali lipat ($3/$15 berbanding $1.14/$4.80). Keduanya kini tidak berjalan di Okou: K2.7 Code sudah ditarik, dan K3 tidak pernah ditambahkan.

Kesimpulan: haruskah Anda menggunakan Kimi K3?

Model bobot terbuka terkuat yang pernah dirilis, dan yang pertama benar-benar bersaing dengan frontier tertutup pada pekerjaan agen, dengan sepertiga harga Fable 5. Okou tidak menjalankannya, jadi bacalah halaman ini sebagai referensi: untuk beban kerja agen 1J token yang sama di Okou, Claude Fable 5 adalah padanan terdekat.

Pertanyaan yang sering diajukan

Bisakah saya memakai Kimi K3 di Okou?

Saat ini tidak. Kimi K3 bukan bagian dari jajaran model Okou — tidak bisa dipilih di chat maupun di workflow, dan tidak bisa ditambahkan dengan API key Anda sendiri. Claude Fable 5 adalah model terdekat yang dijalankan Okou: context window 1J token yang sama, dan skor tertinggi pada Intelligence Index yang sama.

Kapan Kimi K3 dirilis?

Moonshot AI meluncurkan Kimi K3 pada 16 Juli 2026 di aplikasi Kimi dan Kimi API, lalu menerbitkan bobot terbukanya di Hugging Face pada 27 Juli 2026.

Berapa context window Kimi K3?

1.048.576 token, mencakup input dan output sekaligus, dengan harga rata di seluruh window. Output secara default 131.072 token dan bisa dikonfigurasi lebih tinggi dalam sisa konteks.

Berapa biaya Kimi K3?

$3.00 per juta token input saat cache miss, $0.30 per juta saat cache hit, dan $15.00 per juta token output, tanpa biaya tambahan konteks panjang. Di aplikasi Kimi, paket berbayar mulai $19 per bulan dengan window 256K, dan window penuh 1J terbuka mulai $39 per bulan.

Apakah Kimi K3 open source?

Bobotnya terbuka di bawah Kimi K3 License milik Moonshot sendiri, yang sebagian besar mirip MIT dengan dua syarat komersial: bisnis model-as-a-service wajib membuat perjanjian terpisah dengan Moonshot begitu pendapatannya melewati $20 juta dalam 12 bulan berturut-turut, dan produk dengan lebih dari 100 juta pengguna aktif bulanan atau pendapatan $20 juta per bulan wajib menampilkan "Kimi K3" di antarmukanya.

Alternatif

Ketersediaan Kimi K3 di Okou

Kimi K3 bukan bagian dari jajaran model Okou, jadi tidak bisa dipilih di chat maupun di workflow, dan tidak bisa ditambahkan dengan API key Anda sendiri. Claude Fable 5 adalah model terdekat yang dijalankan Okou saat ini.