**时间**
2026年8月19日
**地点**
美国纽约 / 中国
**人物**
杰富瑞(Jefferies)分析师;阿里千问团队
**事件详情**
华尔街投行杰富瑞近日对全球8款主流AI Agent进行了真实办公任务实测,结果显示阿里千问办公综合得分排名第一,全面超越Claude Cowork、Codex等美国头部产品。
测试共设置5项真实办公任务:年报摘要、公司经营数据对比、浏览器操作完成信息检索和文档生成、英文PPT制作、营销海报图像生成。千问办公在所有测评维度均获90分以上,是唯一一款全面达标的Agent产品。
报告同时将Agent能力拆解为"模型"与"Harness"两部分。Harness指围绕模型运行的工程机制,包括指令、上下文、工具调用、边界控制等。测算显示,千问办公的"隐含Harness分"同样位居首位。
**背景**
杰富瑞报告指出,AI Agent竞争正从个人办公向企业级场景迁移,工作流和生态协同成为核心壁垒。千问办公已初步打通钉钉IM,支持群聊总结、文档表格创建、消息邮件收发等操作。
**影响**
千问办公在华尔街权威评测中登顶,标志着中国AI Agent在全球竞争中已处于领先地位。更值得关注的是其Harness能力获肯定——中国AI产品不仅在模型层追平海外,在工程化和产品化维度同样建立优势。成本方面,Qwen 3.8 Max的API价格明显低于部分海外竞品,"Cost per Task"将成为企业采购的新衡量维度。
**总结**
杰富瑞实测8款全球AI Agent,千问办公综合第一。5项真实办公任务全部90+,Harness工程能力获认可。千问+钉钉的生态协同模式正成为企业级Agent的商业化标杆,中国AI从模型竞争升级到产品与工程的全方位比拼。
**参考来源**
https://i.ifeng.com/c/8vicYROSz9J
https://www.php.cn/faq/3015266.html
https://www.ithome.com/0/991/417.htm









