昨天看到腾讯开源了一个叫BrowserSkill的项目,直接解决了AI Agent自动化的一个核心痛点:怎么让Agent用你已经登录的浏览器,同时又不干扰你的正常操作。
我有个做数据采集的朋友,之前用Puppeteer做自动化,每次都要重新登录各种网站,效率极低。后来他试了BrowserSkill,发现Agent可以直接用他已经登录的浏览器,采集效率提升了好几倍。
这个项目的设计思路很清晰:Agent通过bsk CLI发送命令,本地daemon路由到浏览器扩展,在独立的Agent Window里执行。Agent全程不直接碰浏览器,你正常用你的窗口,它在自己的窗口里干活。
最让我惊喜的是它的安全设计。遇到验证码、登录、确认弹窗这些只有人能干的事,Agent可以请你接手,做完它继续。0.3.0版本还把三个用来"绕过确认"的老参数给禁用了,权限收到浏览器扩展的设置里,由你保存的浏览器设置说了算。
安装也很简单,如果你在用Agent,最省事的是把这一行丢给它,它会自己装CLI和skill,再带你装扩展:
Set up browser-skill on this machine by following raw.githubusercontent.com/Tencent/Browse…
手动装就是装CLI(一条curl或PowerShell命令)、从商店装扩展、然后bsk install-skill。
项目地址:github.com/Tencent/Browse…
MIT许可,5777星。数据是两天前还在提交。扩展里那两个授权开关(借用前确认/允许请求人工协助)默认都是开着的,建议保持默认,先跑一个读页面的任务试试水。
有个做竞品监控的朋友用这个方案,现在每天能自动抓取竞品价格数据,再也不用担心被反爬封IP了。你手头有没有类似的自动化需求?
话题来源 @yibie
❤️14 x.com/…↗ 已改写,非原文转载
24 浏览 0 评论
0 反应














