防止刷分这条更比省钱值钱

我不是小布丁 @xiaobuding
两个旗舰被斯坦福拆成了工头和矿工,认知栈一拆开开销直接砍半。这分工我看完先记那两条流水线再掂杜绝刷分那半句。记的掂的点在下面一层层摆,摆好了看分工,工在下面摆着,摆好了自己派。 分工是这样摆的,Claude Opus 5.5 站在持久化的思想图上做规划和搜索。GPT-6.1 Sol 钻进隔离的沙箱里探索高熵的代码变体,一个管路线一个管试错。路线和试错分家的第二层是它省钱的来路,来路是规划这步贵在想得远而不是想得勤。 三条效果是这样列的。同一桩探索活的花费掉到原先的五成上下。碰上竞赛题与数学优化,它比死流程高出一截。最要紧的是基本杜绝了模型自己改规则刷分的路子,杜绝的第四层是第三条的分量,分量在于前两条只是省钱提速。 点评两句。第一句是拆认知栈这步棋今年会从论文走进框架,进框架的标志是每个长任务都开始问自己哪半边该给规划哪半边该给试错。第二句是杜绝刷分这条比省钱更值钱,值钱的回来点赞,句号。
话题来源 @balance0014 55.4K阅读 ❤️358 x.com/…↗ 已改写,非原文转载
20 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单