返回文章列表
代码智能体

Kimi Code 上线 K3-256k:用更低消耗覆盖主流编程场景

阅读约 2 分钟

导语

Kimi Code 的模型文档更新显示,面向编程场景的 Kimi K3 新增并推荐使用 k3-256k。它可以理解为 K3 的 256k 上下文版本:在 256k 范围内,官方称其输出效果与 K3 保持一致,但配额消耗约为 1M 版本的一半。对多数日常开发者来说,这意味着无需每次都为超长上下文付出更高成本。

核心要点

  • 模型矩阵更清晰:Kimi Code 当前包含四个模型 ID:k3k3-256kkimi-for-codingkimi-for-coding-highspeed。其中 K3 是旗舰编码模型,k3 最高支持 1M 上下文;k3-256k 固定为 256k。
  • K3-256k 主打性价比:官方推荐它用于日常问答、代码补全、常规功能开发,以及单文件或小规模多文件编辑。其限制是仅支持图像输入,不支持视频输入。
  • 长上下文仍有适用场景:如果会话已经接近或超过 256k,直接从 k3 切到 k3-256k 可能触发工具侧 compact。官方建议先手动 compact,把关键任务信息压缩到 256k 内,再切换。
  • 缓存会影响用量感知:切换模型 ID 或 reasoning effort 会导致已有上下文缓存失效,需要重新预填充,因此刚切换后用量看起来可能上升。官方建议切换模型时新开会话。
  • 权限与工具配置需要注意:K3 需要相应会员等级;若能力超过套餐权益,接口可能返回 401。第三方工具中应填写模型 ID,而不是“Kimi K3”这类版本名。

意义与影响

这次更新的重点不是单纯增加一个模型名,而是把“超长上下文能力”和“日常编码成本”拆开。1M 上下文对大型仓库理解、长会话维护和复杂迁移有价值,但大量编码任务并不会真正用满 1M。k3-256k 把 K3 能力下放到更常用的上下文区间,有助于减少不必要的配额消耗。

对开发者和团队而言,新的最佳实践会变成:日常任务默认使用 k3-256k,只有在确实需要完整长历史或超大代码上下文时再切到 k3。同时,模型切换、思考强度切换、视频输入兼容性和第三方工具的上下文窗口设置,都会成为影响体验和成本的关键细节。

来源:Hacker News

评论

正在确认登录状态……

正在加载评论……

相关文章

CCTest · Blog
让代码模型不只写对,还要写快:Meta 论文探索面向代码优化的强化学习
代码智能体
cctest.ai
代码智能体

让代码模型不只写对,还要写快:Meta 论文探索面向代码优化的强化学习

这篇论文讨论了一个更难的代码智能目标:不仅让模型生成能通过测试的程序,还要让它学会生成运行更快的程序。研究指出,执行时间作为奖励信号看似直接,实际却会被噪声、稀疏奖励和训练不稳定性放大。

阅读全文