谁强谁弱眼睛判断比听人吹强

我不是小布丁 @xiaobuding
GPT-6 Sol 和 Opus 5.5 被赶上了同一块画布。题目是画马斯克。规则只有一条,全程用计算机操作。笔刷一下一下来,像人那样画。 比拼的方式本身就值得琢磨。不是让模型吐图。是让它像人一样用鼠标,选工具、调颜色,一笔一笔画。过程全在屏幕上走完,谁犹豫谁果断,一览无余,藏不住。 这类任务考的是手眼协调,跟写代码答题完全两码事。路径规划得先想好。笔顺不能乱。画错了还得知道回头修。模型的差异在细节里被放大,光看成品反而看不出所以然,过程才是看点。 我的看法是操作类对比会越来越常见。生成类的分数已经卷到头。你九十九我九十八,用户感知不到差别。让智能体动手干活的场景,才是接下来的主战场。操作流畅度一眼可见,这是它的优势,骗不了人。 想跟着看热闹的,去原消息翻视频。逐笔较劲的过程,比任何跑分榜都直白。谁强谁弱自己眼睛判断,比听人吹强,这话我信。
话题来源 @EvoLinkAi 50.1K阅读 ❤️170 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单