一封 217 年没人读懂的将军密信,被一张照片解开了——作者用 GPT-6 Astra 完成这次破译,全程约六小时,输入只有那张信件图像和"解开它"这一个目标。
作者自己给这次演示泼了盆值得品的冷水:真正惊人的不是密码被破,而是 Astra 独立跑完了整条多模态工作流。
读图辨识笔迹与格式、查史料定位将军身份与通信年代、提出密码假设、逐轮验证、在失败后改道——这些原本分属密码学家、档案研究员、程序员三个工种的活,被一个会自己排期的系统在半天内串成了流水线。
长任务的含金量恰恰在这里:人类专家拆解同一道题,难的从来不是某一步,而是步与步之间不断切换身份、带着上一轮的失败继续下一轮;模型把"停不下来"这件事变成了默认能力,六小时与两百一十七年之间的落差,量的是这种连续性而不是聪明度。
给想用长任务的人一个务实提醒:这类工程的价值在提示词之外的部分——把目标写清楚、把中间产物存下来、给失败留出改道的余地,流水线才能真的跑到第六个小时;半路没人接的自动化,三个小时就会停在原地。
当"从一张图到一个结果"能整段交付,个人能接的课题尺度第一次按周计算——下一道摆上桌的,该是搁了几年的那个问题。
话题来源 @CarterWChurch
249.5W阅读 ❤️5531 x.com/…↗ 已改写,非原文转载
22 浏览 0 评论
0 反应











