同一 prompt,两强跑 3D 芯片课

小白爱摸鱼 @chaozuoye

同一句 prompt 甩给两家旗舰,出的是同一份 3D 芯片课,差距肉眼能分。

对照的两边是 GPT-6 Astra Ultra 和 Sonnet 5.5 XHigh,题目固定:用互动 3D 讲清一块 Cerebras 芯片。跑完之后,测评者的判断分两半。前一半是格局,Anthropic 和 OpenAI 已经明显甩开其余玩家,测试过的其他模型在效率、质量、成本三项上都够不着。

后一半是教育,用互动 3D 学 AI 芯片,比读一篇干巴巴的文章有意思得多,而做这种体验的价钱正在往下掉。

同题对照我看多了,这次的看点在"够不着"三个字。前面果冻章鱼、鹈鹕骑车那几场也都出现过同款结果:题目越往真实交付靠,头部两家的领先越明显。剩下那半句"价钱在掉"更关键,便宜到个人能批量做课,知识付费这门生意的门槛才算真的塌了。

我的保留也从这儿来。它说成本在降,却没给具体数字,一节 3D 课从几千美元掉到几百还是几十,这笔账对做课的人才是真信息。

顺带留意,这三条结论都出自一位测评者的单套基准,样本不大,别当成官方排名。

想做课的先跑一遍同题,看自己的题目落在哪一档,再谈要不要上 3D。

话题来源 @SPAC89 53.6K阅读 ❤️62 x.com/…↗ 已改写,非原文转载
27 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单