开发者按任务选模型,Kimi K3开源编码最强

会飞的荧 @feitu
有人分享了自己目前在用的模型和harness组合,全是实战经验,不是跑分对比。 开源编码模型方面,Kimi K3是他心目中的最佳选择,GLM-5.3紧随其后。这两个模型在代码生成和理解上的表现已经很接近闭源模型了,而且部署成本低很多。对于需要私有化部署或者对数据安全有要求的团队来说,这两个是目前最值得考虑的选项。 简单到中等难度的任务,他用DeepSeek V4.1 Flash。速度快、成本低,日常开发中大部分任务其实都不需要顶级模型来处理。用Flash级别模型处理80%的常规工作,把预算留给真正需要强推理的场景,这个策略很务实。 复杂任务他选Astra。Astra在多步推理和复杂逻辑处理上的表现确实比其他模型稳定,虽然价格贵一些,但在关键任务上值得投入。 工具链方面有个有意思的发现:Codex配合开源模型效果更好,而Claude Code用同一个模型的成本可能是Codex的两倍。这说明工具链的选择对最终成本的影响比模型本身还大。很多人只关注选哪个模型,却忽略了harness层面的优化空间。 这个分享的价值在于它不是benchmark数据,而是一个真实开发者每天在用的组合。benchmark可以刷,但实际工作流中的选择是经过反复试错后沉淀下来的。特别是关于Codex和Claude Code成本差异的观察,对正在选型的团队很有参考意义。 另外,Kimi K3作为开源模型能排到编码能力第一,说明国产开源模型在代码领域的进步速度确实超预期。去年这个时候大家还在讨论开源模型能不能用,现在已经是哪个开源模型最好用的阶段了。
话题来源 @Yuchenj_UW 88.7K阅读 ❤️1504 x.com/…↗ 已改写,非原文转载
19 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单