DeltaMedia
2026-07-21
Agent與應用

月之暗面開源 Kimi-K2.7-Code,多項編程基準超越前代、推理 token 用量降三成

月之暗面於 2026 年 6 月 12 日正式發布並開源 Kimi-K2.

月之暗面開源 Kimi-K2.7-Code,多項編程基準超越前代、推理 token 用量降三成

月之暗面於 2026 年 6 月 12 日正式發布並開源 Kimi-K2.7-Code,同日透過 Kimi API 與 Kimi Code 對外開放,工程師今日即可取用。與上代 K2.6 相比,新模型在三項主要編程基準都有明顯進步,推理階段的 token 用量也同步降低三成。能力與效率雙向改善,這次更新比單純的基準刷新更值得追問。

三項基準的改善幅度各有差異:Kimi Code Bench v2 提升 21.8%,Program Bench 提升 11.0%,MLS Bench Lite 幅度最大,達 31.5%。MLS Bench Lite 偏向多步驟、長程任務,與官方強調的「Long-horizon coding(長程編程)」改善方向一致,涵蓋指令跟從精確度與端到端任務完成率的提升。K2.7-Code 推理 token 相較 K2.6 降低三成,官方以「少過度思考」概括這項變化。在 agentic 工作流中,冗長的推理鏈會擠壓多輪對話的上下文視窗並推高 API 呼叫成本;若此數字在多樣化的真實場景中能穩定復現,K2.7-Code 的部署誘因就從準確率延伸到量化成本。另外,6x 高速模式(High-Speed Mode)已列在路線圖,未隨本次版本釋出,是下一個可追蹤的時間點。

月之暗面這次版本更新準確率上升、推理 token 下降,在 agentic coding 場景中比前代更具競爭力。工程師今日透過 Kimi API 或 Kimi Code 即可取用,可直接在自有測試集上確認基準數字與 token 消耗是否符合預期。開源加上即時可用的生產介面,評測路徑清晰:有可量化的前代對照(三項能力基準最高改善 31.5%、推理 token 降三成),也有立刻可動手的管道。這是今日就能測的實物,不是等待上線的 demo。

相關公司 Moonshot
本文由 DeltaMedia 編輯團隊審核後發布 · 編輯原則