时间:2026年9月15日(IDC 报告发布)至9月18日(钛媒体深度复盘)
地点:中国(IDC China / 钛媒体 / 阿里 / 字节 / 腾讯 / 蚂蚁 / 京东)
人物:腾讯(WorkBuddy)、阿里(千问办公)、字节(豆包工作)、TeleAgent(星辰超级智能体,7 月 WAIC 首发)、IDC China
事件详情:钛媒体 9 月 18 日深度复盘国内办公 Agent 战局:腾讯 WorkBuddy 5.5.6 走聚合模式、内置混元并接入 DeepSeek/GLM/Kimi/MiniMax 等主流大模型供用户自由切换;阿里千问办公、字节豆包工作则走自营路线,分别主推千问与豆包系列模型;2026 年 7 月 WAIC 期间,TeleAgent(星辰超级智能体)悄然问世,把战事「靶心」定位到上下文工程。9 月 15 日 IDC 发布《中国企业级通用 Agent 产品技术评估》,TeleAgent 综合成绩位居前三甲,其中「任务表现」维度获 5 分满分、成本效率获评测最高分。TeleAgent 自研星辰大模型 Xing4.0 采用 mHC+MLA+MTP 设计,原生支持 256K 长上下文并可扩展到 512K;在 Harness 层引入动态上下文治理——实时预判窗口水位、溢出前主动分级压缩、并按任务阶段动态分配预算。
背景:办公 Agent 的上半年还停留在「模型路由 1.0」阶段——把任务交给模型分销即可。腾讯 WorkBuddy 飞奔时,阿里和字节收拢内部多产品赛马机制,分别整合为千问办公和豆包工作;WorkBuddy 主打聚合、千问办公与豆包工作主打自营。但 Model Router 1.0 只解决「能力输出通道」问题,能力与场景适配仍悬而未决。9 月 17 日 IDC 报告印证了行业从「模型分销」走向「模型调度」、从「聚焦解决任务的能力」走向「能力的持续、自主进化」的转向。TeleAgent 在模型 API 服务端集成多模型动态路由,把 Model Router 1.0 迭代为智能调度 2.0:模型供给侧支持提供商自动无缝切换并按压力分发;用户端按任务强度分轻量/均衡/旗舰三档精准优化资源消耗与积分成本。上下文侧,TeleAgent 在接近窗口上限时优先剪枝久远工具输出,仍超限时由专职压缩模型深度压缩整段对话;并结合提示词缓存命中减少重复前缀的 Token 计费。
影响:1)TeleAgent 在 IDC 综合榜上进入前三甲,验证「上下文工程」是办公 Agent 决胜点;意味着办公 Agent 战场从「比拼模型路由分发」正式转向「比拼动态上下文治理与模型调度」;2)WorkBuddy 的「聚合模式」与千问办公/豆包工作的「自营模式」可能都要被迫迭代,2.0 智能调度或成行业标配;3)成本效率被 IDC 列为关键评分项,将倒逼所有厂商重新审视按 token 计费、按任务分层计费的商业模型;4)蚂蚁、京东等暂未发布旗舰办公 Agent 的玩家将面临更大决策压力——继续观望或直接跃迁至 2.0 范式;5)办公 Agent 行业逐步从「功能 demo」走向「可量化、可治理、可计费」的企业服务基础设施,国内 SaaS 厂商对 Agent 能力的接入诉求会快速上升。
总结:钛媒体 9 月 18 日深度复盘指出办公 Agent 之战在 IDC 2002R 报告发布后才算「找到战场」:腾讯 WorkBuddy、阿里千问办公、字节豆包工作三家各有侧重,而 TeleAgent 以「上下文工程 + 模型智能调度 2.0」在 IDC 综合榜冲进前三甲,任务表现 5 分满分、成本效率获评测最高分,把办公 Agent 行业的胜负手从「模型分销」拉回到「动态上下文治理」。
参考来源:
- https://www.tmtpost.com/8144821.html
- https://www.ithome.com/1/004/283.htm
- https://www.geekpark.net/news/370431
- https://www.geekpark.net/news/370460
- https://www.ifanr.com/1680560







