同一个抓取任务,Gemini 和 GPT 给出了两种完全不同的解题策略,结果是碾压级的差距。
Gemini 的路子偏协议层。头一个任务受阻之后,它没有硬闯,转手模拟起微信浏览器的请求头,脚本一写就过。第二个任务同样,几轮基础尝试碰壁,它直接定位到视频的 CDN 地址,再用现成的命令行工具完成解析。每一步都在找那条最省力的缝。
GPT 走的是浏览器层硬啃。基础脚本失败,换内置浏览器读页面;DOM 超时,改调本机浏览器再读;撞上反抓取脚本,最后干脆上视觉去截屏认字。流程步步为营,每一步都对,合起来又慢又烧 token,被评价为智能与白痴的差别。
我关心的不是谁赢,是这个场景暴露的选路能力。同样是被挡,一个在想协议还能怎么变通,一个在想界面还能怎么绕,出发点差一层,终点就差一个量级。写工具调用的 prompt 时,给它一句"优先找协议层的解法",可能比夸它聪明管用。
当然这类抓取都得在对方规则允许的范围内用,平台的反制和合规边界摆在那里。值得记的是模型策略的差别:遇到阻碍时,先换工具还是先换思路,这个习惯比任何单点能力都值钱。
话题来源 @fly3nn
415.2K阅读 ❤️2482 x.com/…↗ 已改写,非原文转载
19 浏览 0 评论
0 反应













