記事一覧へ戻る
コーディングAI

Kimi K2.8 Preview登場、全会員に100万トークン文脈を開放

読了目安 3 分

概要

月の暗面はKimiの新しいモデル、K2.8 Previewを発表した。9月11日からKimi CodeとKimi Workで全面提供され、公式にはK3に近い総合性能を持ちながら、日常的な開発作業により適したモデルと説明されている。今回の最も大きな製品変更は、100万トークンのコンテキストを全会員層に開放したことだ。

主な変更点

  • コーディングとAgentを強化。 K2.8 Previewはコード補完や通常の開発タスクを重視し、K2.7 Codeより推論効率を高めたとされる。
  • 3段階の推論設定。 low、high、maxのreasoning effortに対応し、K3と同様の思考レベルを選べる。
  • マルチモーダル入力。 テキストだけでなく、画像と動画も入力できる。
  • 長文脈の利用条件を緩和。 K3では高い会員ランクが必要だった1Mコンテキストを、K2.8 PreviewではすべてのKimi Code会員が利用できる。
  • 既存サービスへの影響を抑制。 kimi-for-codingはModel IDを維持したままK2.8 Previewへ更新される。また、K3関連の一部リクエストは、thinkingを無効にするとK2.8 Previewの非思考版へ振り分けられる。

K3の小型版なのか

K2.8という名称から、K3の小型・低価格版を想像しやすい。しかし、現時点ではその差を定量的に判断できる材料が少ない。今回、月の暗面は新たなベンチマーク結果を公開しておらず、「総合性能がK3に近い」という説明が、どのタスクでどの程度を意味するのかは明らかになっていない。

K3は高い能力上限を狙ったフラッグシップである一方、計算コストや応答速度、Agentが過去の思考履歴をどのように扱うかといった運用面の課題もある。素材では、履歴が完全に引き継がれない場合や途中でモデルを切り替えた場合、出力が不安定になる可能性が指摘されている。また、曖昧な依頼に対して必要以上に先回りする場合もあるという。

そのため、コード補完や明確な範囲内の修正では、最高性能よりも低コスト、安定性、利用しやすさが重要になる。K2.8 Previewは、まさにこの日常利用を大規模に支えるモデルと考えられる。

事業面での意味

K2.8の投入は、月の暗面の商業化とも結びついている。素材によれば、K3の公開後にARRは大きく伸び、同社は香港IPOの手続きも始めた。利用量を増やしながら収益を拡大するには、高コストのフラッグシップだけで全リクエストを処理するのは難しい。

K2.8は、日常的なコーディングと業務用途を低い利用障壁で受け止める普及層になりそうだ。ただし、K3にどこまで近いかは、今後のベンチマークや独立検証を待つ必要がある。

量子位

コメント

ログイン状態を確認中…

コメントを読み込み中…

関連記事

CCTest · Blog
Cognitionの評価額が480億ドルに、AIコーディングは一強にならず
コーディングAI
cctest.ai
コーディングAI

Cognitionの評価額が480億ドルに、AIコーディングは一強にならず

Devinを開発するCognitionが、評価額480億ドルで20億ドルを調達した。CursorのSpaceX売却前を上回る売上倍率は、AIコーディング市場に複数の有力企業が残るとの投資家の見方を示している。

続きを読む
CCTest · Blog
テストを通っても十分ではない:コードモデルが編集しすぎる理由
コーディングAI
cctest.ai
コーディングAI

テストを通っても十分ではない:コードモデルが編集しすぎる理由

コード修正モデルは、テストに通る場合でも必要以上に広い範囲を書き換えることがある。新たな研究は、保全を求める指示と強化学習が編集の忠実度を高める可能性を示した。

続きを読む