Bhavani 这条是 Grok 4.7 首批用户的反向声音——一句话总结:"$1.59 烧出这种输出,还不如 Kimi $6 那一发"。
这条吐槽有几个值得拆的点:
- "贵不贵看场景,便不便宜看质量"——单条 $1.59 看着不贵,但如果模型产出的代码要返工三次才能用,实际成本会反超一次到位的 $6。
- "同价同速"是 xAI 的官方定位,但用户体验看的是单位 token 收益——如果 Grok 4.7 单 token 的有效产出不如前代或者不如竞品,所谓"不变价"其实是在悄悄涨价。
- Kimi 这边作为对比项有点意思——Kimi K2 / K3 这代在长上下文、代码任务上的稳定度确实上来了,"贵一点但少返工"对个人开发者可能是更优解。
从用户侧看,Grok 4.7 这次的问题大概率不是模型本身差,而是:
- prompt 范式没跟上——老 Grok 用户拿 4.6 的 prompt 套路跑 4.7,工具调用行为可能变了,需要重做 system prompt;
- 任务挑选问题——Bhavani 跑的这单大概率是结构化代码生成类,这种任务 Kimi / Claude 都比 Grok 稳;
- 早期模型版本偏激——发布头一周的 Grok 4.7 经常会有 hotfix,第一版结论别下太死。
建议:被吐槽劝退之前,先把同一份 prompt 平行跑一遍 Grok 4.7 / Claude 4.5 / Kimi K3,看单位成本收益再决定迁移不迁移。
Kimi 这边能"贵一倍但不亏",是当下 AI 编程性价比叙事值得复盘的一个点。
21 浏览 0 评论
0 反应












