首页 / 开源 · 浏览器 / 自动化 Agent / browser-use
🖥️
browser-use
browser-use
让 AI 控制真实浏览器自动完成网页任务,社区超火。
它能帮你做什么
- 让 AI 像真人一样操作浏览器:填表、点击、下单、翻页、抓数据
- 用一句话描述任务,它自己看页面决定怎么做,较能适应改版
- 做网页数据采集、批量操作、自动化测试
- 接自己的模型,串进更大的自动化流程
解读
browser-use 是让 AI 控制真实浏览器自动完成网页任务的开源库——填表、下单、抓数据、点来点去,它像真人一样操作页面。因为好用,社区非常火。
和「写死规则」的传统爬虫不同,它靠 AI 理解页面:你用一句话描述任务(如「去某网站搜关键词、把前 10 条标题抓下来」),它自己看页面、决定点哪、填什么,网页改版也较能适应。
它面向开发者,需要写几行 Python 来驱动。不写代码又想做网页自动化,可看 Skyvern(带界面)或国产影刀 RPA。
适合谁
面向开发者——要写几行 Python 来用。会 Python 的人做网页自动化很爽。不写代码的人,想做网页自动化可看 Skyvern(带界面)或国产影刀 RPA。
开始前的准备
- 装好
Python 3.11+。 - 一个模型 API Key。
- 会写一点 Python。
手把手教程
- 装库:运行
pip install browser-use(国内加清华源)。 - 装浏览器驱动:运行
playwright install chromium(让它能开一个浏览器)。 - 配密钥:准备一个模型 API Key(如 OpenAI/Claude),设成环境变量。
- 写任务:照官网示例写几行代码,用自然语言描述任务,如「打开某站、搜索、抓结果」。
- 运行:跑脚本,你会看到浏览器自己动起来,一步步完成任务。
- 调整:根据结果改任务描述或加约束,提高成功率。
常见问题 / 踩坑
不会 Python 能用吗?
基本不行,它是给开发者的库。想不写代码,用 Skyvern(有界面)或国产影刀 RPA。
和传统爬虫比有啥好?
传统爬虫要为每个网站写死规则、网页一改就崩;browser-use 靠 AI 理解页面,更灵活、更抗改版,但每步要调模型(有成本)。
会被网站封吗?
频繁自动操作可能触发风控。注意频率、遵守网站条款,别用于违规抓取或攻击。
要花钱吗?
库免费;它每一步决策都调大模型,按量付费。任务越复杂调用越多。
进阶技巧
- 任务描述具体到「在哪个页面、点哪个按钮、要什么结果」,成功率更高。
- 常规任务用便宜够用的模型跑省钱;复杂页面再上强模型。
打不开 GitHub / 国内访问
pip 用清华源加速;官网 browser-use.com 有文档和示例。用境外模型需自行解决网络访问,或接国内模型接口。