browser-use 开源项目突破 112k Star,AI 浏览器自动化迎来新标杆
browser-use 在 GitHub 上获得 112k Star 和 12.3k Fork,支持 AI 代理像人类一样操作浏览器。其基准测试在 200 项长时任务中平均得分 87.4%,超越 OpenAI、Anthropic 等厂商的计算机使用代理,成为该领域领先的开源方案。
近日,开源项目 browser-use 在 GitHub 上持续升温,Star 数已突破 112,000,Fork 数达到 12,300。该项目旨在让 AI 代理能够像人类一样使用浏览器,执行打开页面、点击按钮、填写表单等操作,用户只需描述任务,代理即可自动完成。
browser-use 提供了两种主要使用方式:面向已有 AI 代理(如 Claude Code、Codex、Cursor 等)的 CLI 技能安装方案,以及面向开发者的 Python 库。Python 库支持 Python 3.11 及以上版本,可通过 uv 或 pip 快速安装,并支持接入 OpenAI、Anthropic、Google 等多种 LLM 提供商。
项目团队在 100 项真实浏览器任务上进行了基准测试,结果全面开源。此外,在 Odysseys 排行榜上,browser-use 以 87.4% 的平均得分位居首位,领先于 OpenAI、Anthropic、Google 和 Microsoft 的计算机使用代理。该排行榜评估的是代理在 200 项长时程网页任务中的表现,browser-use 的成绩证明了其在复杂场景下的可靠性。
为了优化性能,browser-use 推出了专用的 ChatBrowserUse 接口,据称其完成任务的速度比其他模型快 3 至 5 倍,同时保持较高的准确率。开发者还可以通过该接口使用 provider-prefixed 模型 ID,只需一个 API 密钥即可访问多种主流模型,简化了集成流程。
browser-use 的开源特性吸引了大量开发者的关注和贡献,其社区活跃度持续上升。该项目不仅为 AI 代理提供了标准化的浏览器操作能力,也为网页自动化领域带来了新的可能性。随着 AI 技术的快速发展,browser-use 或将成为连接大语言模型与真实网页操作的重要桥梁。