Semua model

GLM-5.1: model dari Z.AI

Andalan Z.AI. Jendela konteks hingga 1M token. Kuat untuk agen seluruh basis kode atau seluruh basis pengetahuan dengan harga jauh di bawah Sonnet.

1M tokens · Text / Code · Prompt cache

Okou tidak lagi menjalankan GLM-5.1. Halaman ini dipertahankan sebagai referensi spesifikasi, harga, dan benchmark-nya. Untuk pekerjaan serupa, gunakan GPT 5.6 Luna.

Lihat GPT 5.6 Luna

GLM-5.1 adalah spesialis konteks panjang di jajaran ini, dengan input hingga 1M token. Gunakan ketika prompt-nya benar-benar besar: seluruh repositori sekaligus, beberapa ratus dokumen dalam satu jalannya riset. Papan peringkat independen secara konsisten menempatkannya di tingkat teratas model open-weight untuk pekerjaan konteks panjang.

Harga daftar vendor adalah $1,40 / $4,40 per 1M token, jauh di bawah separuh Sonnet 4.6 di tingkat vendor, dan API-nya kompatibel dengan Anthropic sehingga agen bergaya Claude dapat langsung digunakan tanpa penulisan ulang. Gunakan Sonnet atau Opus ketika kedalaman penalaran Inggris lebih penting daripada ukuran konteks, dan Kimi K2.7 Code ketika latensi menjadi penentu.

Apa itu GLM-5.1?

Model serbaguna andalan Z.AI / Zhipu AI.

GLM-5.1 adalah andalan seri GLM Zhipu AI, didistribusikan melalui Z.AI. Ini adalah model penalaran dengan kemampuan umum yang kuat dan jendela konteks yang luar biasa besar. Hingga 1M token, beberapa kali lebih besar daripada default Anthropic dan Moonshot pada tingkat harga yang sama.

Apa yang menonjol dari GLM-5.1

Fitur arsitektur dan kapabilitas utama.

GLM-5.1 mengekspos jendela konteks hingga 1M token (yang terbesar di jajaran Built-in) melalui permukaan API yang kompatibel dengan Anthropic, sehingga agen bergaya Claude dapat langsung digunakan tanpa perubahan. Upstream mendukung prompt caching di api.z.ai.

Spesifikasi sekilas

KeluargaSeri GLM-5
ModalitasTeks, kode
BahasaMultibahasa
Jendela konteksHingga 1M token
Prompt cachingDidukung (kompatibel Anthropic)

Benchmark GLM-5.1

Ulasan independen menempatkan GLM-5.1 di tingkat teratas model open-weight untuk tugas konteks panjang. Angka bergeser setiap minggu pada papan peringkat pihak ketiga. Kami sengaja tidak mematok persentase pasti di sini.

Code Arenapapan peringkat pihak ketiga
3 besar (open weights)
Recall konteks panjangdilaporkan vendor
Kuat di seluruh jendela 1M token

Harga GLM-5.1

Harga daftar vendor, per 1J token.

Input$1.40
Output$4.40
Cache read$0.26
Cache write$1.40

Bagaimana GLM-5.1 berperilaku dalam praktik

Perilaku yang diamati dari eksekusi agen produksi.

Recall konteks panjang

Jendela 1M token GLM-5.1 benar-benar dapat digunakan. Ia mempertahankan koherensi jauh melewati batas 200K yang membatasi keluarga Anthropic pada model 200K yang lebih lama. Berguna untuk agen seluruh repo atau seluruh korpus dokumen.

Penalaran

Penalaran umum yang solid. Di bawah Sonnet 4.6 pada routing multi-tool bahasa Inggris yang tersulit, tetapi jaraknya kecil relatif terhadap perbedaan biaya.

Tugas agen terbaik untuk GLM-5.1

Refactor seluruh repo yang muat dalam satu prompt

Masukkan basis kode berukuran menengah berisi 500K token ke dalam satu pemanggilan GLM-5.1 dan minta penggantian nama lintas file, ulasan arsitektur, atau lintasan keamanan. Model dengan jendela lebih kecil memaksa Anda memotong repo menjadi bagian-bagian dan menjahit hasilnya, di situlah bug menyelinap masuk. GLM-5.1 menjaga setiap file dalam memori kerja dan merujuk path yang tepat dalam output-nya.

Jalannya riset atas ratusan dokumen

Wiki, RFC, kontrak, tiket dukungan tahun lalu — muat seluruh tumpukan sekaligus dan minta pola lintas dokumen. Biaya per jalannya tetap terkelola berkat harga vendor yang rendah, yang membuat alur kerja "baca semuanya, ringkas sekali" semacam ini benar-benar terjangkau di produksi alih-alih sekadar proyek sains sekali jalan.

Kapan melewatkan GLM-5.1

Lewati GLM-5.1 pada penalaran bahasa Inggris tersulit di mana Sonnet 4.6 atau Opus 4.7 masih memimpin, dan pada balasan chat yang kritis terhadap latensi di mana Kimi K2.7 Code jauh lebih cepat.

GLM-5.1 vs model lain

GLM-5.1 vs Kimi K2.7 Code

Keduanya adalah opsi konteks panjang dengan biaya kredit serupa (×0,4 vs ×0,3). Kimi memiliki recall konteks panjang yang lebih kuat dalam evaluasi internal kami; GLM-5.1 menang pada ukuran konteks mentah (1M vs 256K). Pilih Kimi untuk transkrip yang sangat panjang; pilih GLM-5.1 ketika Anda perlu menjejalkan seluruh basis kode ke dalam satu prompt.

GLM-5.1 vs Claude Sonnet 4.6

Sonnet 4.6 (×1) memimpin pada akurasi tool-routing dan penalaran bahasa Inggris. GLM-5.1 (×0,4) memimpin pada jendela konteks dan menjadi pilihan tepat ketika biaya atau ukuran konteks menjadi penentu keputusan.

GLM-5.1 vs DeepSeek V4 Pro

DeepSeek V4 Pro (×0,1) lebih murah dan mencetak benchmark lebih tinggi pada Code Arena menurut ulasan pihak ketiga. GLM-5.1 tetap menang pada ukuran konteks. Pilih DeepSeek untuk pekerjaan konteks standar yang sensitif terhadap biaya; pilih GLM-5.1 ketika ukuran konteks menjadi kendalanya.

Kesimpulan: haruskah Anda menggunakan GLM-5.1?

Pilih GLM-5.1 ketika ukuran konteks menjadi kendalanya. Untuk yang lainnya, DeepSeek V4 Pro lebih murah dan Sonnet 4.6 mengarahkan tool lebih andal.

Ketersediaan GLM-5.1 di Okou

GLM-5.1 telah dihapus dari lineup Okou, sehingga tidak dapat lagi dipilih di chat maupun di workflow, dan tidak tersedia dengan API key Anda sendiri. GPT 5.6 Luna mencakup tier hemat biaya yang sama.