这周我所有的任务都交给了kimi 2.7 code,然后还有1/4的任交给openrouter的glm 5.2,说说感受
kimi 2.7 code的代码能力没问题,个人觉得有gpt 5.5的水准
glm 5.2也差不多,我的任务应该没能测出它的上限
但这2个模型都有一个问题,agentic 能力非常一般,我分别在 hermes agent下使用,对于一次性的任务完成的还可以,但对于2步以上的任务,质量就直线下降,甚至还比不上 gpt 5.4
特别是kimi 2.7 code,工具调用和指令遵循都不去kimi 2.6,所以它真的是专用于 code 的。。。