Kimi Work 公测了,我拿它和 ChatGPT Work 对了一遍,国产办公 Agent 现在走到哪了
2026 年 7 月,月之暗面把 Kimi Work 推上了公测。这款产品一开始被描述为“面向知识工作者的通用型本地 Agent”,底子来自 Kimi Code:每天几十万程序员在用、支持本地浏览器/终端/文件、还能装 Skill、跑定时任务。发布后不久,社区里已经有人开箱说能同时跑 300 个子 Agent,底层模型是 K2.6 万亿参数 MoE。
我把公开资料和几篇 2026 年 7 月的实测/横评综合了一下,打算把 Kimi Work 和 OpenAI 的 ChatGPT Work 放在一起对照看,尽量不喊口号,只谈“现在能做什么、和竞品差在哪、前端人该怎么用”。
先看事实:两家到底做了什么
Kimi Work
- 定位:本地优先的办公/编码 Agent,随 Mac 和 Windows 客户端一起发。
- 能力边界:浏览器、终端、文件系统、网页浏览、文档生成、PPT/表格交付,支持并行执行子任务。
- 公开证据:月之暗面官方公测公告;CSDN 上有 7 月 22 日开箱,提到 K2.6 (1T MoE) Ready、浏览器/终端/文件已就绪;另有第三方横评显示它在大规模办公 Agent 评测里总分 4.08,和飞书 aily、钉钉悟空同场。
- 生态动作:支持 Skill,继承在线 Kimi 的专业 Skills 和数据库,CLI 安装脚本已经公开。
ChatGPT Work
- 定位:OpenAI 的云侧工作代理,管理邮件、Slack、日历,不是本地控制台。
- 能力边界:更像是“云上助理”,偏日程、消息、文档摘要,不接管用户本地终端。
- 公开证据:OpenAI 官方产品发布;社区讨论主要围绕 Work 权限、外部系统授权、SaaS 集成深度。
这两款产品的第一层差别其实很明显:Kimi Work 要进你的电脑干活,ChatGPT Work 要进你的 SaaS 日程表做事。对前端工程师而言,前者天然更适合改代码、跑脚本、操作本地项目;后者更适合对齐排期、回复消息、整理周报。
国产办公 Agent 的真实水平:和全球竞品比差在哪
从 2026 年 7 月公开的横评数据来看,Kimi Work 已经被放到一个五款产品的池子里测:
| 产品 | 综合得分 | 代码/前端 | 浏览器操作 | 内容创作 | 单题成本 |
|---|---|---|---|---|---|
| 飞书 aily | 4.46 | 一般 | 一般 | 较强 | ¥1.84 |
| Kimi Work | 4.08 | 较强 | 一般 | 较强 | 未公开 |
| 钉钉悟空旗舰 | 约 4.0 | 较强 | 一般 | 一般 | 未公开 |
| WorkBuddy | 约 4.0 | 一般 | 一般 | 一般 | 未公开 |
| Qoder | 约 4.0 | 一般 | 较强 | 一般 | 未公开 |
数据口径来自 2026-07 公开第三方横评,评测题 25 道,覆盖飞书生态、内容创作、代码/前端、浏览器操作。注意这是“企业办公 Agent”维度,不是纯编码能力。
结论很清楚:Kimi Work 现在属于第一梯队,但不是断层领先。它的长板是本地控制 + 编码/内容生成,短板是生态集成深度和跨端协同。飞书 aily 在企业内协同上更成熟,Qoder 在浏览器操作上更稳。
前端工程师真正该关心的 3 个细节
1. 本地终端接管能力
Kimi Work 从设计上就给了终端、文件、浏览器。对我这种前端来说,意义是:它能直接跑 npm、git、docker、curl,不用来回复制粘贴。ChatGPT Work 没有这层能力,更适合整理 PR 描述,不适合帮你修构建失败。
2. 并行子 Agent 与 Skill 生态
公开资料提到 Kimi Work 支持 300 个子 Agent 并行,底层靠 K2.6。这个数字听听就好,真正落地时瓶颈通常是 Skill 质量,而不是模型并发。当前它继承的是在线 Kimi 的专业 Skills,数量和深度还在爬坡。
3. 模型层透明度
Kimi K2.6 是 1T MoE,已开源;OpenAI 没有公开 ChatGPT Work 的底层模型明细。对企业用户来说,这个差距意味着数据出域和合规审计的复杂度不同。
一个可落地的判断标准
如果你现在要选办公/编码 Agent,不用看广告语,直接按这个标准判断:
- 你每天 40% 以上时间在本地改代码、跑脚本、操作文件 → Kimi Work、TRAE Work、Cursor Background Agent 更合适。
- 你每天 40% 以上时间在跨团队对齐、邮件/日程/SaaS 联动 → ChatGPT Work、飞书 aily 更合适。
- 你需要中文长文本 + 本地项目理解 → 当前 Kimi Work 的中文场景适配有明显优势。
- 你非常在意企业级权限、审计、知识库隔离 → 飞书 aily 这类内嵌于协作平台的方案落地更稳。
结论
Kimi Work 的公测不是“国产替代 ChatGPT”的情绪宣告,而是一个本地优先 + 编码友好 + 中文场景优化的具体产品形态。和 ChatGPT Work 比,它不是同一个物种,更适合前端工程师和本地开发场景。但企业级深度、跨端协同、浏览器操作稳定性,它还需要时间补课。
2026 下半年,国产办公 Agent 的竞争会从“能不能跑”进入“哪个更适配团队 workflow”的阶段。前端工程师选型时,建议优先看 Skill 生态和本地终端能力,而不是模型参数量。
评论区
登录后可评论。