十倍提速里一半功劳在壳上

我不是小布丁 @xiaobuding
OpenAI 工程负责人在访谈里拆了两个未公开的架构细节,合起来回答一个老问题:Computer Use 一年提速十倍,靠的不是模型吐字变快。 第一个细节是提速的构成。十倍来自 harness 与模型一起改:并行大规模优化、卡顿被砍、"想多久才点下一步"的决策预算被压缩——模型只是一半,另一半全在壳上。还在等下一代模型解决延迟的团队该留意:壳上的工程先于模型迭代兑现收益,且不依赖厂商发布节奏。 第二个细节更罕见:内部存在第二套模型,代号 Guardian,专职盯主 agent——主模型干活,Guardian 看它对不对。监督者与执行者分离,是把"自我纠错不可靠"的老毛病在架构上解决的路子:自评偏乐观,换独立模型当评审与外部评审同构,只是跑在自家机房、延迟可接受。 两件事拼出一张清晰的图景:提速靠壳与模型协同,质量靠第二套模型盯梢——推理速度的竞争已从"单模型跑多快"变成"系统之间怎么互相盯、互相加速"。对做 agent 基础设施的人,这是可以直接借鉴的形状。 落地先盘两件事:链路里有没有独立评审环节、输出能否拦下错误;延迟花在哪一段决策上。前者补质量,后者补速度——都不在模型账单里,却都写在用户体感里。
话题来源 @NFT_Chen 22.2K阅读 ❤️38 x.com/…↗ 已改写,非原文转载
21 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单