月之暗面Kimi.ai当日精选
兄弟们,这几天国产模型都在疯狂更新啊! Kimi直接把coding model最烦人的“过度思考”这个毛病给治好了,2.7版比上一代少烧30% token,agent长任务成功率却反而...
AI 摘要
Kimi 发布并开源了 K2.7-Code 模型,针对编码智能体常见的“过度思考”问题进行了优化,相比上一代减少 30% token 消耗。在多项基准测试中性能显著提升:Kimi Code Bench v2 提高 21.8%,Program Bench 提高 11%,MLS Bench Lite 提高 31.5%。模型权重和代码已开源至 Hugging Face,同时预告了即将推出的 6x 高速模式。开发者可通过开放 API 和 Kimi Code 立即使用,并参与 Beta 计划体验新功能。 核心观点: 1. K2.7-Code 通过减少过度思考,在长任务智能体场景下 token 消耗降低 30%,同时 agent 长任务成功率反而提升。 2. Kimi Code Bench v2 提升 21.8%、Program Bench 提升 11%、MLS Bench Lite 提升 31.5%,指令跟随和端到端完成率均有改善。 3. 模型权重和代码已开源至 Hugging Face,并预告即将推出 6x High-Speed Mode 以进一步提升编码效率。
推荐理由高信息密度,值得细读
原文
无法获取正文,可打开下方原始链接查看。
开源编码模型token优化智能体基准测试高速模式66/100
讨论
暂无评论。