时间:2026年8月7日
地点:中国杭州(阿里巴巴)
人物:阿里通义千问团队;智东西测试团队
事件详情:
阿里千问 APP 与 PC 端 8 月 7 日集中功能上新,新增思考研究、定时任务、办公助理、智能体广场、语音童话等多项能力,并支持阿里最新旗舰模型 Qwen3.8-MAX。其中办公助理定位"自主任务执行",能够理解目标、自主拆解任务、调用浏览器/文件/Office 等工具完成复杂流程;定时任务可按设定时间自动执行反复性工作。智东西对其进行了为期 3 天的实测:将"寻找杭州 → 上海游戏行业 2026 届校招岗位"完整链路交给千问执行,最终收回 32 条岗位、19 个字段的结构化清单及可编辑 Excel,整体 80% 以上工具调用任务一次成功,字段随需求变更可持续叠加而无需重排。
背景:
进入 2026 年下半年,AI Agent 厂商进入"端到端真实任务"的比拼阶段。阿里通义在 Qwen3 系列大模型之外,将办公助理作为 Qwen3.8-MAX 落地的主战场之一,目的是把"通用大模型"包装为"日常可用的助理"。此次实测以应届生求职作为切入,是因为这条任务链路信息源分散、跨多网站、需要反复迭代,能够检验 Agent 在真实场景中的稳定性。
影响:
- 真实场景落地:求职这类长链路任务成为 Agent 实用化的标志性场景,千问办公助理可降低大量重复劳动
- 推动 Agent 编排能力升级:跨浏览器、文件、Office 的工具调用稳定性将成为下一阶段竞争焦点
- 行业竞争升温:与字节扣子、百度文心、智谱清言等办公类 Agent 的差距有望被进一步压缩或拉大
- 利好 B 端集成:办公助理的稳定调用能力,可被企业 IT 团队复刻为内部 RPA 与知识流程助手
总结:
千问办公助理把"AI Agent 跑完整秋招"作为一次产品能力的公开测试,结果显示 Agent 已能在多轮迭代、跨工具调用下保持稳定。这一步既验证了 Qwen3.8-MAX 在真实任务中的可用性,也为阿里在大模型落地潮中拿下一块关键拼图。
参考来源:
- https://zhidx.com/p/583250.html
- https://www.163.com/dy/article/L3P38KCS051180F7.html
- https://m.sohu.com/a/121471021_121687206
- https://wap.ithome.com/html/684250.htm
- https://www.qwenlm.com/