两小时94元:便宜模型的Agent账单不便宜

AI大土豆 @suanwan
有人晒了张账单:在 Codex 里用 DeepSeek,两个小时花了 94 元,他的原话是"不科学",准备先找出问题出在哪。 反差在于:DeepSeek 的单价一向被认为便宜,但 Agent 场景的计费逻辑跟聊天不是一回事——不是一问一答,而是每一步都带着历史重跑:读文件、执行命令、看报错、再改,一个任务几十上百轮,输入 token 每轮重放,缓存没命中就按全价算。 把账单吹大的常见原因就那几个:把整个仓库塞进上下文;让 Agent 反复读同一批文件;报错后自动重试;同时跑多个 Agent;以及默认开了高推理档位。单看每一步都不贵,乘上几百轮就不一样了。 真要排查,可以照这个顺序:先看用量明细里输入、输出、缓存三段的比例,缓存占比低通常就是没命中;再看单轮上下文是不是随时间暴涨,是的话说明历史没被裁;最后做一次对照实验——限制上下文、明确禁止读全仓,再跑同一个任务,账单差多少一目了然。 提醒一句:94 元是他一个人的单次观察,账单高低跟任务复杂度强相关,不能当成"某模型贵"的结论。但"便宜模型的 Agent 账单未必便宜"这件事,值得每个让 Agent 长跑的人自己算一遍。
话题来源 @buaaxhm 30.8K阅读 ❤️69 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单