GLM-5.1: model dari Z.AI
Andalan Z.AI. Jendela konteks hingga 1M token. Kuat untuk agen seluruh basis kode atau seluruh basis pengetahuan dengan harga jauh di bawah Sonnet.
1M tokens · Text / Code · Prompt cache
Okou tidak lagi menjalankan GLM-5.1. Halaman ini dipertahankan sebagai referensi spesifikasi, harga, dan benchmark-nya. Untuk pekerjaan serupa, gunakan GPT 5.6 Luna.
Lihat GPT 5.6 LunaGLM-5.1 adalah spesialis konteks panjang di jajaran ini, dengan input hingga 1M token. Gunakan ketika prompt-nya benar-benar besar: seluruh repositori sekaligus, beberapa ratus dokumen dalam satu jalannya riset. Papan peringkat independen secara konsisten menempatkannya di tingkat teratas model open-weight untuk pekerjaan konteks panjang.
Harga daftar vendor adalah $1,40 / $4,40 per 1M token, jauh di bawah separuh Sonnet 4.6 di tingkat vendor, dan API-nya kompatibel dengan Anthropic sehingga agen bergaya Claude dapat langsung digunakan tanpa penulisan ulang. Gunakan Sonnet atau Opus ketika kedalaman penalaran Inggris lebih penting daripada ukuran konteks, dan Kimi K2.7 Code ketika latensi menjadi penentu.
Apa itu GLM-5.1?
Model serbaguna andalan Z.AI / Zhipu AI.
GLM-5.1 adalah andalan seri GLM Zhipu AI, didistribusikan melalui Z.AI. Ini adalah model penalaran dengan kemampuan umum yang kuat dan jendela konteks yang luar biasa besar. Hingga 1M token, beberapa kali lebih besar daripada default Anthropic dan Moonshot pada tingkat harga yang sama.
Apa yang menonjol dari GLM-5.1
Fitur arsitektur dan kapabilitas utama.
GLM-5.1 mengekspos jendela konteks hingga 1M token (yang terbesar di jajaran Built-in) melalui permukaan API yang kompatibel dengan Anthropic, sehingga agen bergaya Claude dapat langsung digunakan tanpa perubahan. Upstream mendukung prompt caching di api.z.ai.
Spesifikasi sekilas
Benchmark GLM-5.1
Ulasan independen menempatkan GLM-5.1 di tingkat teratas model open-weight untuk tugas konteks panjang. Angka bergeser setiap minggu pada papan peringkat pihak ketiga. Kami sengaja tidak mematok persentase pasti di sini.
Harga GLM-5.1
Harga daftar vendor, per 1J token.
Bagaimana GLM-5.1 berperilaku dalam praktik
Perilaku yang diamati dari eksekusi agen produksi.
Recall konteks panjang
Jendela 1M token GLM-5.1 benar-benar dapat digunakan. Ia mempertahankan koherensi jauh melewati batas 200K yang membatasi keluarga Anthropic pada model 200K yang lebih lama. Berguna untuk agen seluruh repo atau seluruh korpus dokumen.
Penalaran
Penalaran umum yang solid. Di bawah Sonnet 4.6 pada routing multi-tool bahasa Inggris yang tersulit, tetapi jaraknya kecil relatif terhadap perbedaan biaya.
Tugas agen terbaik untuk GLM-5.1
Refactor seluruh repo yang muat dalam satu prompt
Masukkan basis kode berukuran menengah berisi 500K token ke dalam satu pemanggilan GLM-5.1 dan minta penggantian nama lintas file, ulasan arsitektur, atau lintasan keamanan. Model dengan jendela lebih kecil memaksa Anda memotong repo menjadi bagian-bagian dan menjahit hasilnya, di situlah bug menyelinap masuk. GLM-5.1 menjaga setiap file dalam memori kerja dan merujuk path yang tepat dalam output-nya.
Jalannya riset atas ratusan dokumen
Wiki, RFC, kontrak, tiket dukungan tahun lalu — muat seluruh tumpukan sekaligus dan minta pola lintas dokumen. Biaya per jalannya tetap terkelola berkat harga vendor yang rendah, yang membuat alur kerja "baca semuanya, ringkas sekali" semacam ini benar-benar terjangkau di produksi alih-alih sekadar proyek sains sekali jalan.
Kapan melewatkan GLM-5.1
Lewati GLM-5.1 pada penalaran bahasa Inggris tersulit di mana Sonnet 4.6 atau Opus 4.7 masih memimpin, dan pada balasan chat yang kritis terhadap latensi di mana Kimi K2.7 Code jauh lebih cepat.
GLM-5.1 vs model lain
GLM-5.1 vs Kimi K2.7 Code
Keduanya adalah opsi konteks panjang dengan biaya kredit serupa (×0,4 vs ×0,3). Kimi memiliki recall konteks panjang yang lebih kuat dalam evaluasi internal kami; GLM-5.1 menang pada ukuran konteks mentah (1M vs 256K). Pilih Kimi untuk transkrip yang sangat panjang; pilih GLM-5.1 ketika Anda perlu menjejalkan seluruh basis kode ke dalam satu prompt.
GLM-5.1 vs Claude Sonnet 4.6
Sonnet 4.6 (×1) memimpin pada akurasi tool-routing dan penalaran bahasa Inggris. GLM-5.1 (×0,4) memimpin pada jendela konteks dan menjadi pilihan tepat ketika biaya atau ukuran konteks menjadi penentu keputusan.
GLM-5.1 vs DeepSeek V4 Pro
DeepSeek V4 Pro (×0,1) lebih murah dan mencetak benchmark lebih tinggi pada Code Arena menurut ulasan pihak ketiga. GLM-5.1 tetap menang pada ukuran konteks. Pilih DeepSeek untuk pekerjaan konteks standar yang sensitif terhadap biaya; pilih GLM-5.1 ketika ukuran konteks menjadi kendalanya.
Kesimpulan: haruskah Anda menggunakan GLM-5.1?
Pilih GLM-5.1 ketika ukuran konteks menjadi kendalanya. Untuk yang lainnya, DeepSeek V4 Pro lebih murah dan Sonnet 4.6 mengarahkan tool lebih andal.
Ketersediaan GLM-5.1 di Okou
GLM-5.1 telah dihapus dari lineup Okou, sehingga tidak dapat lagi dipilih di chat maupun di workflow, dan tidak tersedia dengan API key Anda sendiri. GPT 5.6 Luna mencakup tier hemat biaya yang sama.