每次爬虫脚本报废?试试 browser-act-skill-forge——让 AI 把网站探索变成可复用的 Skill 包

做过批量爬虫的都知道,最崩溃的不是「爬不到」,而是「这次能爬,下次又挂了」。

网站改个路径、加个参数、上个验证码——之前写的脚本全部报废,重新调试一遍。

browser-act-skill-forge 就是来解决这个问题的。

它干了什么

简单说:它把「单次浏览器自动化」升级成了「可复用的 Skill 包」。

你告诉它要抓什么网站、抓什么数据,它会先探索一遍网站的结构(优先找 API 路径,找不到再用 DOM 自动化兜底),然后自动生成一个带 SKILL.md + 脚本的 Skill 包。这个包是参数化的,下次再跑同样任务,直接调参数就行,不用重新探索。

官方叫这个四步流程:Describe → Explore → Generate → Self-test。整个过程 AI agent 自己跑完,你只需要描述需求。

解决什么问题

传统爬虫的痛:
每次都要重新探索:换关键词、换页面结构,脚本就废了
不稳定:路径一变就失败,大规模跑的时候简直是噩梦
Token 浪费:每次运行都要 agent 重新理解网站

Skill Forge 的思路是把探索成本变成一次性投入,后续复用同一个稳定路径。官方说得很直白:Explore once, reuse forever。

支持多少平台

Claude Code、Cursor、Windsurf、Codex、Gemini CLI、Cline、Amp、Roo Code、Continue……共 39 个 AI 编程/Agent 工具,基本覆盖主流玩家。

安装一条命令:

npx skills add https://github.com/browser-act/skills --skill browser-act-skill-forge

装完跟 AI 说你要干什么就行,比如「从 LinkedIn 抓职位信息,字段包括标题、公司、薪资、链接,后续要跑 300 个关键词」——剩下的它自己搞定。

实际场景

  • 批量采集竞品数据(Amazon、Google Maps、YouTube 等已有现成 Skill)
  • 周期性监控价格/库存/listing 变动
  • 内部流程自动化(把重复性浏览器操作包装成可复用 Skill)
  • 跨平台数据对比(生成多个站点的 Skill,标准化输出格式)

GitHub 链接

https://github.com/browser-act/skills

browser-act-skills 仓库星数 1.4K+,Skill Forge 本身近期热度很高,安装量也在持续涨。如果你经常需要批量从某个网站拿数据,这个 Skill 值得先装上试试。


顺手提一句:它家还有一个基础 browser-act Skill,是给 AI agent 装个浏览器自动化 CLI 能力的,那个是另一种用法——实时的、交互式的。两个可以配合着用,也可以单独装 Skill Forge。


GitHub: https://github.com/browser-act/skills

评论区

0 条评论

登录后可评论。