它解决什么问题

写爬虫、做浏览器自动化、或者让 AI 去操作网页时,最花时间的往往不是写流程,而是「到底怎么定位到那个按钮 / 输入框」。BrowserUse 把这件事做得特别顺:

  • 一条命令打开网址、查元素、看元素快照;
  • 定位语法统一——ID、class、文字、属性、CSS、XPath 全用一套写法;
  • 还能给指定元素「拍快照」,把结构吐出来,方便你自己看或喂给 AI 分析定位策略。

它用独立的 Chrome 调试 profile,不干扰你日常用的浏览器。

核心特性

  • 统一的选择器语法#id.classtext:文字@属性css:xpath: 一套搞定;
  • 链式选择器>>):层层缩小范围,像 #form >> .item >> input 这样一路找下去;
  • 父元素上下文-P):在某个父容器内查找,定位更准;
  • 元素快照snapshot):把元素结构打印出来,供 AI 分析「该用什么选择器」;
  • 独立调试 Chrome:用专门的 profile,不碰你日常浏览器;
  • 命令行透传:参数原样转发,方便接进脚本 / 自动化流程。

选择器语法速查

写法含义示例
#id按 ID#kw
.class按 class.item
text:xxx按可见文字text:登录
@attr按属性@type=submit
css:CSS 选择器css:div>p
xpath:XPathxpath://button
>>链式(层层定位)#form >> input
-P在父元素内查找限定查找范围

命令行速查

新开一个终端,命令是 py-tools-browseruse

:: 打开网址
py-tools-browseruse goto https://www.baidu.com

:: 按 ID 定位单个元素
py-tools-browseruse ele -s "#kw"

:: 查找多个元素(按标签 + class)
py-tools-browseruse eles --tag li --cls item

:: 按文字点击
py-tools-browseruse click -s "text:登录"

:: 给元素拍快照(供 AI 分析定位策略)
py-tools-browseruse snapshot -s "#submit-btn"

:: 查看更多示例
py-tools-browseruse examples

所有元素定位都通过 find_el / find_els 实现,命令行参数完整示例见 py-tools-browseruse examples

典型场景

  • 写爬虫:快速试出能稳准定位目标元素的选择器,再写进脚本;
  • 浏览器自动化:登录、点击、翻页、抓数据,命令行一步步验证;
  • AI 操作网页:用 snapshot 把页面结构给大模型,让它建议选择器;
  • 调试前端:临时检查某个元素能否被选中、结构是什么样。

给 AI 用的小技巧:不确定该用什么选择器时,先 snapshot 拍下元素(或父容器)快照,把输出贴给 AI,它能直接告诉你最稳的定位写法。

下载与安装

  1. 点上方「下载安装包」按钮,得到 py-tools-browseruse-setup-1.0.0.exe
  2. 双击运行,按提示下一步——免管理员,装到当前用户目录,自动加入 PATH;
  3. 新开一个终端,输入 py-tools-browseruse --help 验证安装。

首次运行会在终端里显示环境初始化进度(约 1~3 分钟),完成后即可使用。本系列三个工具共用一套运行环境,之后装另外两个会很快。

常见问题

  • 会动到我平时用的 Chrome 吗?不会,它用独立的调试 profile,和你日常浏览器互不干扰。
  • 有图形界面吗?没有,BrowserUse 是纯命令行工具,专为脚本 / 终端场景设计。
  • 需要本机装 Chrome 吗?基于 DrissionPage 驱动浏览器,按其要求准备 Chrome 即可。

总结

如果你要做 Chrome 自动化、写爬虫,或者让 AI 去操作网页,BrowserUse 把「定位元素」这件事做得格外顺——一套语法覆盖所有选择器,还能拍快照给 AI 分析。纯命令行、轻量、装上不占地方,是浏览器自动化工具箱里很好用的一把螺丝刀。