Kimi K
履歴を開く現行モデル
公式モデル一覧- Kimi K3
- Kimi K2.7 Code
- Kimi K2.7 Code HighSpeed
- Kimi K2.6
発表記録リリース済み
Kimi K3
Kimi K3 はネイティブな視覚理解と 100 万トークンの文脈長を備えます。
- モデル重みは別途 7 月 27 日に公開。
発表時の利用条件
アプリの公開と7月27日の重み公開は別の出来事です。
発表と評価の資料
11 件の資料独立評価
Kimi K3: second only to Fable 5 on AA-BriefcaseAA-BriefcaseでKimi K3の知識作業を評価し、成果物の品質・費用・時間を比較。結果は7月のテスト設定に対応します。
現在の評価表
独立評価
Artificial Analysis LLM Leaderboard · 4.3.2Intelligence Index v4.3.2 の確認時データ。旧手法のスコアとは直接比較できません。
データを見る更新日は未記載
更新日は未記載
| Claude Opus 5.5max with fallback | 58 |
|---|---|
| Claude Sonnet 5.5max with fallback | 56 |
| GPT-6 Astramax | 53 |
| Gemini 4 Argonhigh | 53 |
| GPT-6.1 Solmax | 52 |
| Qwen3.8 Max (0902) | 45 |
| Muse Spark 1.3max | 48 |
| GLM-5.3max | 45 |
| GLM-5.3low | 34 |
| GLM-5.3-Flash | 42 |
独立評価
Text Arena Overallテキストの選好スコア。暫定判定と不確実性を保持し、同一ランキング内で比較してください。
データを見る2026年10月2日
データ更新 ·
| Gemini 4 Argonhigh; preliminary | 1525±9 |
|---|---|
| Claude Opus 5.5high | 1504±9 |
| Claude Fable 5.1max | 1501±6 |
| Gemini 3.8 Flashhigh; preliminary | 1495±5 |
| Muse Spark 1.3max | 1494±6 |
独立評価
Code Arena WebDev OverallWebDev の選好スコア。暫定判定と不確実性を保持し、同一ランキング内で比較してください。
データを見る2026年10月1日
データ更新 ·
| Claude Opus 5.5max | 1815+16/-16 |
|---|---|
| Claude Sonnet 5.5xhigh | 1786+18/-18 |
| GPT-6.1 Solmax | 1758+17/-17 |
| Gemini 4 Argonhigh; preliminary | 1680+13/-13 |
| Qwen3.8 Max (0902)preliminary | 1670+8/-8 |
独立評価
Agent Arena OverallAgent Arena の Net Improvement 指標です。タスク成功率ではなく、記載した設定に対応します。
データを見る2026年10月2日
データ更新 ·
| Claude Fable 5.1max | 14.31%±1.90% |
|---|---|
| Claude Opus 5.5high | 13.82%±2.17% |
| Claude Sonnet 5.5max | 12.52%±3.09% |
| GPT-6 Astramax | 12.27%±2.23% |
| GPT-6.1 Solmax | 11.23%±2.76% |
独立評価
Task-Completion Time Horizons of Frontier AI Models · TH1.1TH1.1 のタスク完了時間。モデル別のグラフ値は未確認のため、数値を掲載しません。
データ更新 ·
モデル群の資料2
モデル群や過去のバージョンを扱う資料です。今回の発表を評価したものではありません。