GPT-6 Sol 和 Opus 5.5 被赶上了同一块画布。题目是画马斯克。规则只有一条,全程用计算机操作。笔刷一下一下来,像人那样画。
比拼的方式本身就值得琢磨。不是让模型吐图。是让它像人一样用鼠标,选工具、调颜色,一笔一笔画。过程全在屏幕上走完,谁犹豫谁果断,一览无余,藏不住。
这类任务考的是手眼协调,跟写代码答题完全两码事。路径规划得先想好。笔顺不能乱。画错了还得知道回头修。模型的差异在细节里被放大,光看成品反而看不出所以然,过程才是看点。
我的看法是操作类对比会越来越常见。生成类的分数已经卷到头。你九十九我九十八,用户感知不到差别。让智能体动手干活的场景,才是接下来的主战场。操作流畅度一眼可见,这是它的优势,骗不了人。
想跟着看热闹的,去原消息翻视频。逐笔较劲的过程,比任何跑分榜都直白。谁强谁弱自己眼睛判断,比听人吹强,这话我信。
话题来源 @EvoLinkAi
50.1K阅读 ❤️170 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应













