Browser Use 评测:开源浏览器 Agent,云浏览器每小时 0.02 美元
「让 Agent 自己用浏览器」这件事,Browser Use 是做得比较早也跑得比较开的开源项目。官网首页的标语很直白:Agents that use the browser。产品被分成两块——Browser Use Agents 给一个任务直接拿结果,Browser Infrastructure 则是给你自己的 Agent 用的远程浏览器。首屏两个入口分别对应这两块:Run an agent 与 Launch a browser,右上角标注着 11.5 万星。

官方基准:同时比成功率和单题成本
官网给出的是它自建的难度基准 Internal Bench Hard:在 106 个任务里,Browser Use 成功率 82%、每题成本 17 美分;对照条目里 Opus 5 为 62%、Sonnet 5 为 59%、Gemini 3.1 Pro 为 59%,对照项的单题成本分别是 3.40 美元、1.55 美元与 2.20 美元。口径写得很清楚:Task success on 106 tasks 与 cost per solved task——也就是同时看成功率与「每解决一个任务花多少钱」,而不是只看单次调用价格。
远程浏览器那一侧也有一组官方数据:在 71 个受保护站点的触达比例基准上,Browser Use 81%、Anchor 77%、Onkernel 67%、Steel 47%。这两组数字都出自官方自建基准,样本与对照方法由官方设定,实际效果建议按自己的目标站点自测。展示区倒是给了更直观的参考:官方称收录 42 个真实运行录屏,任务包括找两个相邻的电影座位、完成家居建材自提购物车、把门户结果导出为 CSV、给网站做质量检查、从实时棋盘下棋、在 Slack 里跑浏览器任务,甚至清 100 行俄罗斯方块。
三条上手路径,从云到本地
仓库 README 把用法切成三条。完全托管云:调用托管的 Agent 接口,由它自己驱动浏览器,附隐身浏览器、档案、录屏与数据策略等基础设施。命令行:把一段提示词粘给你的编码智能体,让它装好命令行工具并连接你自己的浏览器。Python 库:在本地代码里跑开源 Agent,要求 Python 3.11 以上,用包管理器安装、配好模型密钥即可;示例任务是查某个仓库的 Star 数,运行后 Agent 会自己打开浏览器查完并打印答案,模型既可用第三方也可以选它自家模型,浏览器既可用本地的也可以走云。

云侧 SDK:两条云路线怎么选
官方文档站把云侧明确分成两条:Browser Use Agents 与 Browser Infrastructure,都走 API V4。前者是你给任务、它驱动浏览器并返回结果;后者是你自己的 Playwright 或 Puppeteer 代码通过 CDP 直接连到托管的浏览器上操作,适合已经有一套浏览器自动化代码、只想把「跑在哪」换成云端的团队。文档站给了一个容易踩的点:断开 CDP 并不会停止托管的浏览器,必须在收尾时显式停止会话,否则会一直计费。云侧 SDK 要求 Python 3.10 以上,取到 API key 后即可创建任务、等待完成并取回结果——核心调用只有三行。

价格:按量走,不订阅
官网的计费口径是:额度 5 美元起、无订阅、不过期;浏览器每小时 0.02 美元另加流量;Browser Use Agents 按模型成本加价 20%,另加浏览器时长与流量。符合条件的新注册可获 15 美元额度。也就是说,如果只用云浏览器跑自己的 Playwright 代码,成本结构非常接近「一台按小时租的、带隐身与代理的浏览器」;让它的 Agent 干活则是在模型成本上加两成。开源侧,仓库约 11.5 万星、每月下载 2310 万次、MIT 许可,官方也明确说可以云上跑也可以跑在自己机器上,语言几乎全是 Python(99.2%),现有 366 位贡献者与 137 个发布版本。
适合谁用
三种人比较合适:需要把重复网页操作自动化、又不想自己维护反爬与验证码方案的小团队(受保护站点触达率是它主推的能力);已经用 Playwright 写好流程、只想把执行环境搬到云上的工程团队(走基础设施那条路,改动最小);以及想把「浏览器操作」当成工具交给自家 Agent 调用的开发者(命令行与 MCP 方向都有对应入口)。需要提醒的是,两组亮眼数据都来自官方自建基准,落地前建议拿自己的目标站点和任务跑一轮对照。
浏览器 Agent 真正的门槛从来不是会点按钮,而是被目标站点拦下来之后,还找不找得到回去的路。