月之暗面发布Kimi K2.7 Code高速版,输出速度提升5至6倍

6月15日 21:33
该版本于6月15日面向API开发者及Code Beta用户开放,短上下文场景输出速率最高达260Token/s,定价为普通版两倍,需开启思考模式运行。

月之暗面公司于6月15日晚上线Kimi K2.7 Code模型的高速版本。该版本基于已发布的K2.7 Code架构,核心能力保持一致,重点优化了推理输出效率,旨在满足开发者在代码生成等任务中对实时性的需求。官方数据显示,高速版在常规编程场景下的输出速度约为180 Token/s,在短上下文场景中峰值可达260 Token/s,整体速率提升至普通版本的5至6倍。

在调用机制与定价方面,高速版API的模型ID为kimi-k2.7-code-highspeed,每百万Token的标准输入价格为13元,输出价格为54元,命中缓存的输入价格为2.6元。该价格体系是普通版Kimi K2.7 Code的两倍。目前,服务已对加入Kimi Code抢先体验计划的用户、API开发者及Business用户开放。技术运行要求上,系统默认开启思考模式,若用户尝试手动关闭该功能,API调用将直接报错并自动回退至K2.6版本。为确保性能,所有相关调用必须维持思考模式开启状态。

此次发布是月之暗面在6月12日推出K2.7 Code编程模型后的后续动作。此前的评估显示,K2.7 Code相比前代K2.6在长上下文指令遵循及长程任务表现上有显著提升,且平均Token消耗降低了30%。针对高速版未来的开放计划,公司表示将随着算力扩容逐步扩大范围,预计从7月起向Allegretto及以上级别会员开放,届时其在Kimi Code Plan中的用量消耗标准将调整为普通版的3倍。