它解决什么问题
写爬虫、做浏览器自动化、或者让 AI 去操作网页时,最花时间的往往不是写流程,而是「到底怎么定位到那个按钮 / 输入框」。BrowserUse 把这件事做得特别顺:
- 一条命令打开网址、查元素、看元素快照;
- 定位语法统一——ID、class、文字、属性、CSS、XPath 全用一套写法;
- 还能给指定元素「拍快照」,把结构吐出来,方便你自己看或喂给 AI 分析定位策略。
它用独立的 Chrome 调试 profile,不干扰你日常用的浏览器。
核心特性
- 统一的选择器语法:
#id、.class、text:文字、@属性、css:、xpath:一套搞定; - 链式选择器(
>>):层层缩小范围,像#form >> .item >> input这样一路找下去; - 父元素上下文(
-P):在某个父容器内查找,定位更准; - 元素快照(
snapshot):把元素结构打印出来,供 AI 分析「该用什么选择器」; - 独立调试 Chrome:用专门的 profile,不碰你日常浏览器;
- 命令行透传:参数原样转发,方便接进脚本 / 自动化流程。
选择器语法速查
| 写法 | 含义 | 示例 |
|---|---|---|
#id | 按 ID | #kw |
.class | 按 class | .item |
text:xxx | 按可见文字 | text:登录 |
@attr | 按属性 | @type=submit |
css: | CSS 选择器 | css:div>p |
xpath: | XPath | xpath://button |
>> | 链式(层层定位) | #form >> input |
-P | 在父元素内查找 | 限定查找范围 |
命令行速查
新开一个终端,命令是 py-tools-browseruse:
:: 打开网址
py-tools-browseruse goto https://www.baidu.com
:: 按 ID 定位单个元素
py-tools-browseruse ele -s "#kw"
:: 查找多个元素(按标签 + class)
py-tools-browseruse eles --tag li --cls item
:: 按文字点击
py-tools-browseruse click -s "text:登录"
:: 给元素拍快照(供 AI 分析定位策略)
py-tools-browseruse snapshot -s "#submit-btn"
:: 查看更多示例
py-tools-browseruse examples
所有元素定位都通过 find_el / find_els 实现,命令行参数完整示例见 py-tools-browseruse examples。
典型场景
- 写爬虫:快速试出能稳准定位目标元素的选择器,再写进脚本;
- 浏览器自动化:登录、点击、翻页、抓数据,命令行一步步验证;
- AI 操作网页:用
snapshot把页面结构给大模型,让它建议选择器; - 调试前端:临时检查某个元素能否被选中、结构是什么样。
给 AI 用的小技巧:不确定该用什么选择器时,先 snapshot 拍下元素(或父容器)快照,把输出贴给 AI,它能直接告诉你最稳的定位写法。
下载与安装
- 点上方「下载安装包」按钮,得到
py-tools-browseruse-setup-1.0.0.exe; - 双击运行,按提示下一步——免管理员,装到当前用户目录,自动加入 PATH;
- 新开一个终端,输入
py-tools-browseruse --help验证安装。
首次运行会在终端里显示环境初始化进度(约 1~3 分钟),完成后即可使用。本系列三个工具共用一套运行环境,之后装另外两个会很快。
常见问题
- 会动到我平时用的 Chrome 吗?不会,它用独立的调试 profile,和你日常浏览器互不干扰。
- 有图形界面吗?没有,BrowserUse 是纯命令行工具,专为脚本 / 终端场景设计。
- 需要本机装 Chrome 吗?基于 DrissionPage 驱动浏览器,按其要求准备 Chrome 即可。
总结
如果你要做 Chrome 自动化、写爬虫,或者让 AI 去操作网页,BrowserUse 把「定位元素」这件事做得格外顺——一套语法覆盖所有选择器,还能拍快照给 AI 分析。纯命令行、轻量、装上不占地方,是浏览器自动化工具箱里很好用的一把螺丝刀。