同一条签到脚本,三家模型给出三种反应。有人拿自己写过的公司签到脚本去让 AI 优化逻辑,Gemini 直接拒绝,说涉及地理围栏和上班打卡;Opus 也挡了,理由是这类脚本触发安全协议;Grok 爽快得很,觉得能做得很完美,还主动说手机上要跑可以写成 js。
我第一反应是好笑,第二反应是这事挺典型。签到脚本卡在灰色地带,帮人代打卡说不上多正当,也谈不上恶意。三家模型对同一段模糊需求的容忍度差这么多,说明护栏的松紧不是行业共识,是各家自己定的。
我好奇的是差别从哪来。Gemini 和 Opus 给的理由都很"程序",一个点名场景,一个搬出协议,拒绝得干脆,没留商量余地。Grok 则把活儿接了,还主动往下想实现细节。你很难说谁对,但用户会记住谁帮了忙。
付费意愿就这么被塑造出来了。测完直接表态会保留 Grok 的付费,理由是马斯克的 AI 够奔放。我懂这感受,工具的价值不只在能不能办成,还在于碰上模糊需求时它愿不愿跟你一起想办法。
我自己的取舍是分场景。正经业务我反而喜欢严一点的,出事有人担;个人的边角需求,更愿意用不啰嗦的那家。没有标准答案,但每家护栏的松紧,试一次模糊需求就摸出来了。
话题来源 @bao3
20.9K阅读 ❤️83 x.com/…↗ 已改写,非原文转载
19 浏览 0 评论
0 反应










