すべてのモデル

Kimi K3: Moonshot の 2.8T フロンティアモデル

Moonshot の 2.8 兆パラメータ Mixture-of-Experts モデル。100万トークンのコンテキストウィンドウ、画像・動画のネイティブ入力、オープンウェイト。

1M tokens · Text / Vision / Video / Code · Prompt cache

Okou は Kimi K3 を提供していません。このページは仕様・料金・ベンチマークのリファレンスです。同種の作業を Okou で行う場合は、現在は Claude Fable 5 をご利用ください。

Claude Fable 5 を見る

Kimi K3 は Moonshot AI のフロンティアモデルで、2026年7月16日に公開されました。総パラメータ 2.8 兆、トークンごとに 896 エキスパートのうち 16 が動作するスパース Mixture-of-Experts 構成で、1,048,576 トークンのコンテキストウィンドウと画像・動画のネイティブ入力を備えます。Artificial Analysis の Intelligence Index v4.1 では 57.1 で、テスト済み構成のうち第4位。Claude Fable 5(59.9)と GPT 5.6 Sol(58.9)に次ぎ、Claude Opus 4.8 を上回ります。

定価は入力 100万トークンあたり $3.00、キャッシュヒット時 $0.30、出力 100万トークンあたり $15.00。ウィンドウ全体で一律で、長文コンテキストの割増はありません。オープンウェイトは 2026年7月27日に Moonshot 独自の Kimi K3 License のもと Hugging Face で公開されました。Okou は Kimi K3 を提供していません。Okou のラインナップで最も近いのは Claude Fable 5 で、同じ 100万トークンのウィンドウを持ち、同じ Intelligence Index で首位です。

Kimi K3とは?

2026年7月16日 · Moonshot のフロンティア系列。K2.7 Code を含む Kimi K2 シリーズの後継。

Kimi K3 は Moonshot AI のフロンティアモデルで、2026年7月16日に発表され、Kimi アプリと Kimi API から kimi-k3 として利用できます。スパース Mixture-of-Experts モデルであり、総パラメータ 2.8 兆に対してトークンごとに動作するのは 896 エキスパート中 16 のみ。この構成が、パラメータ規模のわりに推論コストを中位の dense モデル並みに抑えています。

K2 系列からの伸びが最も大きいのは、長時間にわたるエージェント作業です。Moonshot の launch スイートでは、Program Bench、SWE Marathon、BrowseComp、SpreadsheetBench 2、Automation Bench でテスト対象のすべてを上回る一方、FrontierSWE では Claude Fable 5 に、DeepSWE では GPT 5.6 Sol に及びません。経済的価値のある知識労働を測る Artificial Analysis の GDPval-AA v2 Elo では 1668 に達し、Kimi K2.6 の 1190 から大きく伸び、Claude Opus 4.8 の 1600 を上回ります。

Kimi K3の注目ポイント

アーキテクチャと機能の主な特徴。

K3 は MoE スタックに、Moonshot が Kimi Delta Attention と Attention Residuals と呼ぶ2つの効率化機構を組み合わせ、最大 6.3 倍のデコード高速化を掲げています。1,048,576 トークンのウィンドウは段階課金なしの一律料金で提供されます。出力は既定で 131,072 トークンまで、同じウィンドウ内でさらに大きく設定できます。入力はテキスト・画像・動画、出力はテキストです。platform.kimi.ai の API は OpenAI 互換で、重み(MXFP4 でおよそ 594 GB)はセルフホスト向けに公開されています。

スペック概要

ファミリーKimi K3
パラメータ総計 2.8T / 896 エキスパート中 16 が動作(MoE)
モダリティ入力: テキスト・画像・動画 / 出力: テキスト
コンテキストウィンドウ1,048,576 トークン
最大出力既定 131K トークン、ウィンドウ内で設定変更可
ライセンスKimi K3 License(オープンウェイト、2026年7月27日)

Kimi K3のベンチマーク

コーディング・エージェント・視覚系のスコアは Moonshot の launch 時の数値で、いずれのモデルも最大の思考努力での測定です。Intelligence Index と GDPval Elo は Artificial Analysis による独立測定です。ベンダーの表は上限値であって保証ではなく、第三者のテストでは Moonshot 公表値をかなり上回るハルシネーション率も報告されています。

Artificial Analysis Intelligence Index v4.1独立測定; 第4位、Fable 5(59.9)と GPT 5.6 Sol(58.9)に次ぐ
57.1
GDPval-AA v2 (Elo)独立測定; Opus 4.8(1600)を上回る
1668
GPQA Diamondベンダー報告
93.5
Terminal-Bench 2.1ベンダー報告; Sol は 88.8
88.3
FrontierSWEベンダー報告; Fable 5 は 86.6
81.2
DeepSWEベンダー報告; Sol は 73.0
67.5
SWE Marathonベンダー報告; launch スイート最高値
42.0
BrowseCompベンダー報告; launch スイート最高値
91.2

Kimi K3の価格

プロバイダー定価、100万トークンあたり。

入力$3.00
出力$15.00
キャッシュ読み取り$0.30
キャッシュ書き込み課金対象外

Kimi K3の実践的な挙動

ベンダーの公開資料と第三者評価にもとづく報告値です。

長時間のエージェント実行

K3 が明確に首位を取る指標(SWE Marathon、Automation Bench、BrowseComp)は、単発の正答率ではなく数百ステップにわたって目的を保てるかを測るものです。エージェント基盤として位置づける Moonshot の主張と一致します。

100万トークンの一律料金

1,048,576 トークンのウィンドウ全体が単一レートで課金され、しきい値を超えても割増はありません。対照的に GPT-5.5 の 100万トークンウィンドウは 272K トークンを超える入力を別料金にしており、これが長大な単一コンテキスト実行を高くしています。

タスクあたりのコスト

Artificial Analysis の測定ではタスクあたり $0.94。Claude Opus 4.8 の $1.80 のおよそ半分で、GPT 5.6 Sol の $1.04 と同水準です。Moonshot はコーディング用途でのキャッシュヒット率 90% 超を挙げており、実効的な入力単価は $0.30 に近づきます。

Kimi K3に最適なエージェントタスク

リポジトリ全体を1つのコンテキストで読む

一律料金の 100万トークンウィンドウなら、コードベース全体、四半期分のサポートチケット、長大な文書一式を分割せずに1リクエストへ収められます。ウィンドウの終盤で割増が発生することもありません。

ブラウジング・調査エージェント

BrowseComp 91.2 は Moonshot の launch 表で最高値であり、GPT 5.6 Sol と Claude Fable 5 を上回ります。出典を探し、引用をたどり、数字を突き合わせる多段のウェブ調査で、K3 のエージェント学習が最もよく表れます。

スクリーンショットと動画の入力

K3 は画像と動画をネイティブに受け取ります。スクリーンショットを読む QA エージェントや録画クリップを処理するパイプラインで、推論モデルの前段に別の視覚モデルを挟む必要がありません。

Kimi K3を避けるべきケース

ベンダー監査済みの安全性プロファイルや、米国・EU での契約に基づくエンタープライズサポートが必要な場合、プロンプトが短く $0.30 のキャッシュ単価が効かずコスト重視モデルで足りる場合、そしてセルフホストが目的の場合は K3 を避けるべきです。594 GB の MXFP4 重みは本番運用に 64 基以上のアクセラレータを要します。第三者のテストでは Moonshot 公表値を大きく超えるハルシネーション率も測定されており、事実密度の高い出力は依然として検証が必要です。そして Okou では、そもそも K3 を選べません。

Kimi K3 vs 他のモデル

Kimi K3 vs Claude Fable 5

Intelligence Index(59.9 対 57.1)と FrontierSWE(86.6 対 81.2)では Fable 5 が上、Terminal-Bench 2.1・BrowseComp・SWE Marathon は K3 が上です。どちらも 100万トークンのウィンドウを備えます。判断を分けるのはたいてい価格と提供状況で、Fable 5 は 100万トークンあたり $10/$50 で Okou で動作し、K3 は $3/$15 ですが Okou では動きません。

Kimi K3 vs GPT 5.6 Sol

Intelligence Index は Sol が 58.9、K3 が 57.1。DeepSWE(73.0 対 67.5)と Terminal-Bench(0.5 ポイント差)も Sol が取ります。K3 は Sol の 400K に対する 100万トークンのウィンドウと、3分の1の入力単価で応じます。実測のタスク単価は近く、K3 が $0.94、Sol が $1.04 です。

Kimi K3 vs Claude Opus 4.8

多くのエージェント系ベンチマークと GDPval-AA Elo(1668 対 1600)で K3 が上回り、価格も $3/$15 対 $5/$25 です。ただし本番でのツールルーティングの安定性は Opus 4.8 に分があり、そして Opus 4.8 は Okou で利用できますが K3 はできません。

Kimi K3 vs Kimi K2.7 Code

K3 は後継機です。コンテキストは 256K から 100万トークンへ、動画入力がネイティブになり、エージェント系ベンチマークの水準も大きく上がりました。価格はおよそ3倍($3/$15 対 $1.14/$4.80)です。現在どちらも Okou では動きません。K2.7 Code は提供を終了し、K3 は追加されていません。

結論: Kimi K3を使うべきか?

これまでに公開されたオープンウェイトモデルとして最も強力で、エージェント作業でクローズドなフロンティアと競える最初の存在です。しかも Fable 5 の3分の1の価格です。Okou では提供していないため、このページはリファレンスとしてお読みください。Okou で同様の 100万トークン規模のエージェント作業を行うなら、Claude Fable 5 が最も近い選択肢です。

よくある質問

Okou で Kimi K3 を使えますか?

現時点では使えません。Kimi K3 は Okou のモデルラインナップに含まれておらず、チャットでもワークフローでも選択できず、ご自身の API キーで追加することもできません。Okou が提供するモデルでは Claude Fable 5 が最も近く、同じ 100万トークンのコンテキストウィンドウを持ち、同じ Intelligence Index で首位です。

Kimi K3 はいつ公開されましたか?

Moonshot AI は 2026年7月16日に Kimi アプリと Kimi API で Kimi K3 を公開し、2026年7月27日に Hugging Face でオープンウェイトを公開しました。

Kimi K3 のコンテキストウィンドウは?

入力と出力を合わせて 1,048,576 トークンで、ウィンドウ全体が一律料金です。出力は既定で 131,072 トークン、残りのコンテキスト内でより大きく設定できます。

Kimi K3 の料金は?

キャッシュミス時の入力が 100万トークンあたり $3.00、キャッシュヒット時が $0.30、出力が $15.00 で、長文コンテキストの割増はありません。Kimi アプリの有料プランは 256K ウィンドウで月額 $19 から、100万トークンのフルウィンドウは月額 $39 から利用できます。

Kimi K3 はオープンソースですか?

重みは Moonshot 独自の Kimi K3 License のもとで公開されています。大部分は MIT に近い内容ですが、商用に関する条件が2つあります。model-as-a-service 事業は、連続する12か月の売上が $20M を超えた時点で Moonshot と個別契約が必要です。また月間アクティブユーザー1億人超、または月商 $20M 超の製品・サービスは、インターフェースに "Kimi K3" を表示する必要があります。

代替モデル

Okou での Kimi K3 の提供状況

Kimi K3 は Okou のモデルラインナップに含まれていないため、チャットでもワークフローでも選択できず、ご自身の API キーで追加することもできません。現在 Okou が提供するモデルの中では Claude Fable 5 が最も近い選択肢です。