← 返回博主原创
BiFish original · 2026-07-25

Browser Use:让 AI 替你操作浏览器,自动点鼠标、填表格

自动填表、自动搜索、自动下单……就像有个人在替你点鼠标

它是什么

Browser Use(直译就是"用浏览器")是一个能让 AI 替你操作浏览器的工具。你给它一句话,比如"帮我去某网站搜一下 XX,把前 5 个结果整理出来",它就真的会打开浏览器、自己点鼠标、自己打字,把活儿干完。

它的工作原理挺有意思:AI 会""网页(其实是读取网页内容),然后自己判断该点哪里、输入什么、滚动到哪,一步一步把任务做完。就像有个人坐在你电脑前,替你操作鼠标键盘。

需要说明一下:这个工具是用 Python(一种编程语言)来驱动的,所以你得稍微懂一点点"敲命令"的操作。比起前面那些纯拖拽的工具,它更适合有点动手能力的老手

解决什么问题

网上有大量重复又枯燥的操作:填一堆表单、批量搜信息、定时下单、爬数据……手动做又累又容易出错。

Browser Use 就是来替你点鼠标的,它特别适合这些人:

  • 经常要在网页上做重复操作、想偷懒的人。
  • 想批量采集网页信息、但不会写复杂爬虫的人。
  • 想让 AI 帮忙"跑腿"、自动完成网上任务的人。
  • 会一点 Python、想玩点高级自动化的老手。

长什么样

Browser Use 不像普通软件那样有漂亮的图形界面,它主要是靠代码和命令行来用的:

  • 你会看到一个命令行窗口,里面打印着 AI 正在干嘛,比如"正在打开网页""正在点击搜索按钮"。
  • 它会真的弹出一个浏览器窗口,你能亲眼看到 AI 在里面点来点去、自动填字,特别有"看机器人干活"的感觉。
  • 你的"任务"是用几行 Python 代码写好的,比如告诉它"去做 XX"。

虽然没有花哨界面,但看着浏览器自己动起来,其实挺解压的。

怎么安装

因为它基于 Python,所以要先准备好 Python 环境。跟着步骤来:

  1. 先装 Python:访问 python.org,下载 3.11 以上的版本,安装时一定要勾选 Add Python to PATH(把 Python 加到系统路径)。
  2. 打开命令行:Windows 按 Win + R 输入 cmd 回车;Mac 打开"终端"。
  3. 建一个项目文件夹并进去,输入并回车:
    mkdir browser-use-demo
    cd browser-use-demo
  4. 安装 Browser Use,输入并回车:
    pip install browser-use
  5. 它需要一个浏览器内核,再输入这行命令安装:
    playwright install chromium
    (Playwright 是一个能"遥控"浏览器的工具,你不用懂原理,装上就行。)
  6. 装好后,准备一个能跑 Python 的文件,比如新建一个 demo.py,就可以开始用了。

怎么用

我们来跑一个最简单的例子:让 AI 去搜索一个东西,并把结果告诉你。

  1. 用记事本或任意编辑器,新建一个文件叫 demo.py,把下面这段代码复制进去:
    import asyncio
    from browser_use import Agent
    from langchain_openai import ChatOpenAI
    
    async def main():
        agent = Agent(
            task="去维基百科搜索'人工智能',把第一段内容总结成一句话",
            llm=ChatOpenAI(model="gpt-4o"),
        )
        result = await agent.run()
        print(result)
    
    asyncio.run(main())
  2. 这段代码的意思是:造一个"小助手",给它一个任务(去维基百科搜"人工智能"并总结),再指定用哪个 AI 模型来"动脑子"。
  3. 用 AI 需要 API key(AI 的"通行证")。在命令行里先设置一下,比如:
    set OPENAI_API_KEY=你的key
    (Mac/Linux 用 export OPENAI_API_KEY=你的key。)
  4. 运行它,输入并回车:
    python demo.py
  5. 然后你就会看到浏览器自己弹出来、自动搜索、自动阅读,最后在命令行里打印出一句总结。任务完成!

想让它干别的,只要把 task= 后面那句话改成你的需求就行,比如"帮我打开某网站,填写这个表单"。

需要 AI 模型吗?

需要的。Browser Use 里的 AI 要"看懂网页、决定下一步点哪里",这都得靠一个 AI 模型来思考。

它支持很多模型,比如 OpenAI 的 GPT 系列、Claude 等都能接,填上对应的 API key(AI 的"通行证")就行。因为要频繁"看网页、做判断",建议选个聪明点的模型,效果会更好。

不知道选哪个?看这里就对了:

去模型导航挑一个适合你的 AI 助手 →

费用

Browser Use 这个工具本身是免费、开源的,谁都能免费用。

花钱的地方在 AI 模型上:它每"看"一次网页、做一次判断,都要调用 AI,任务越复杂、调用越多,模型费用就越高。新手可以先用小任务试试水,控制好用量。

适合谁

  • 经常做网页重复操作、想自动化的上班族
  • 想批量采集网页信息、但不会写复杂爬虫的人
  • 会一点 Python、想玩高级自动化的老手
  • 想让 AI 帮忙"跑腿"完成网上任务的折腾党

项目地址

Browser Use 是开源项目,源代码和详细说明都在 GitHub 上,目前已经有 97k(9 万 7 千)个 star(点赞),社区非常活跃:

https://github.com/browser-use/browser-use

本文基于公开来源进行分析,AI 参与资料整理与初稿生成,最终由人工确认选题和发布。涉及产品能力、价格或政策时,请以原始来源的最新信息为准。