Kimi Work 公测了,我拿它和 ChatGPT Work 对了一遍,国产办公 Agent 现在走到哪了

2026 年 7 月,月之暗面把 Kimi Work 推上了公测。这款产品一开始被描述为“面向知识工作者的通用型本地 Agent”,底子来自 Kimi Code:每天几十万程序员在用、支持本地浏览器/终端/文件、还能装 Skill、跑定时任务。发布后不久,社区里已经有人开箱说能同时跑 300 个子 Agent,底层模型是 K2.6 万亿参数 MoE。

我把公开资料和几篇 2026 年 7 月的实测/横评综合了一下,打算把 Kimi Work 和 OpenAIChatGPT Work 放在一起对照看,尽量不喊口号,只谈“现在能做什么、和竞品差在哪、前端人该怎么用”。

先看事实:两家到底做了什么

Kimi Work

  • 定位:本地优先的办公/编码 Agent,随 Mac 和 Windows 客户端一起发。
  • 能力边界:浏览器、终端、文件系统、网页浏览、文档生成、PPT/表格交付,支持并行执行子任务。
  • 公开证据:月之暗面官方公测公告;CSDN 上有 7 月 22 日开箱,提到 K2.6 (1T MoE) Ready、浏览器/终端/文件已就绪;另有第三方横评显示它在大规模办公 Agent 评测里总分 4.08,和飞书 aily、钉钉悟空同场。
  • 生态动作:支持 Skill,继承在线 Kimi 的专业 Skills 和数据库,CLI 安装脚本已经公开。

ChatGPT Work

  • 定位:OpenAI 的云侧工作代理,管理邮件、Slack、日历,不是本地控制台。
  • 能力边界:更像是“云上助理”,偏日程、消息、文档摘要,不接管用户本地终端。
  • 公开证据:OpenAI 官方产品发布;社区讨论主要围绕 Work 权限、外部系统授权、SaaS 集成深度。

这两款产品的第一层差别其实很明显:Kimi Work 要进你的电脑干活,ChatGPT Work 要进你的 SaaS 日程表做事。对前端工程师而言,前者天然更适合改代码、跑脚本、操作本地项目;后者更适合对齐排期、回复消息、整理周报。

国产办公 Agent 的真实水平:和全球竞品比差在哪

从 2026 年 7 月公开的横评数据来看,Kimi Work 已经被放到一个五款产品的池子里测:

产品 综合得分 代码/前端 浏览器操作 内容创作 单题成本
飞书 aily 4.46 一般 一般 较强 ¥1.84
Kimi Work 4.08 较强 一般 较强 未公开
钉钉悟空旗舰 约 4.0 较强 一般 一般 未公开
WorkBuddy 约 4.0 一般 一般 一般 未公开
Qoder 约 4.0 一般 较强 一般 未公开

数据口径来自 2026-07 公开第三方横评,评测题 25 道,覆盖飞书生态、内容创作、代码/前端、浏览器操作。注意这是“企业办公 Agent”维度,不是纯编码能力。

结论很清楚:Kimi Work 现在属于第一梯队,但不是断层领先。它的长板是本地控制 + 编码/内容生成,短板是生态集成深度和跨端协同。飞书 aily 在企业内协同上更成熟,Qoder 在浏览器操作上更稳。

前端工程师真正该关心的 3 个细节

1. 本地终端接管能力
Kimi Work 从设计上就给了终端、文件、浏览器。对我这种前端来说,意义是:它能直接跑 npm、git、docker、curl,不用来回复制粘贴。ChatGPT Work 没有这层能力,更适合整理 PR 描述,不适合帮你修构建失败。

2. 并行子 Agent 与 Skill 生态
公开资料提到 Kimi Work 支持 300 个子 Agent 并行,底层靠 K2.6。这个数字听听就好,真正落地时瓶颈通常是 Skill 质量,而不是模型并发。当前它继承的是在线 Kimi 的专业 Skills,数量和深度还在爬坡。

3. 模型层透明度
Kimi K2.6 是 1T MoE,已开源;OpenAI 没有公开 ChatGPT Work 的底层模型明细。对企业用户来说,这个差距意味着数据出域和合规审计的复杂度不同。

一个可落地的判断标准

如果你现在要选办公/编码 Agent,不用看广告语,直接按这个标准判断:

  • 你每天 40% 以上时间在本地改代码、跑脚本、操作文件 → Kimi Work、TRAE Work、Cursor Background Agent 更合适。
  • 你每天 40% 以上时间在跨团队对齐、邮件/日程/SaaS 联动 → ChatGPT Work、飞书 aily 更合适。
  • 你需要中文长文本 + 本地项目理解 → 当前 Kimi Work 的中文场景适配有明显优势。
  • 你非常在意企业级权限、审计、知识库隔离 → 飞书 aily 这类内嵌于协作平台的方案落地更稳。

结论

Kimi Work 的公测不是“国产替代 ChatGPT”的情绪宣告,而是一个本地优先 + 编码友好 + 中文场景优化的具体产品形态。和 ChatGPT Work 比,它不是同一个物种,更适合前端工程师和本地开发场景。但企业级深度、跨端协同、浏览器操作稳定性,它还需要时间补课。

2026 下半年,国产办公 Agent 的竞争会从“能不能跑”进入“哪个更适配团队 workflow”的阶段。前端工程师选型时,建议优先看 Skill 生态和本地终端能力,而不是模型参数量。

评论区

0 条评论

登录后可评论。

AI 产品观察 1891 阅读