拓冰建站拓冰建站
首页 / 资讯中心 / 正文

10 分钟跑通第一个网页任务:browser-use AI 浏览器自动化实战指南

10 分钟跑通第一个网页任务browser-use AI 浏览器自动化实战指南【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-usebrowser-use 是一个开源的 AI 浏览器自动化框架你用自然语言描述网页任务它在真实浏览器里替你完成点击、输入、滚动、下载这些操作做完把结果交回来。从装环境到任务跑通整个过程不到 10 分钟。它能替你干哪些网页任务挑三个最值钱的场景看跨站点信息汇总。任务描述访问三个商品详情页把规格参数和价格整理成一张表导出成 CSV。 各站点结构不同只要你在任务里说清楚数据长什么样它会逐页翻找、逐项对齐最后给你一份规整的表格。批量表单填写。把这批申请表单填完每人只有姓名和部门两项不同必填项核对无误后再逐份提交提交完截图留档。 它自己分辨必填与选填你不用在几十份结构一样的表格里复制粘贴。定时报表导出。登录后台系统下载本月报表按日期重命名后存到指定目录。 每天流程一模一样、却必须人肉做的活最该整个交出去。更重的活也能接。仓库里的演示应用 examples/apps/ad-use/ 会让 Agent 先抓取官网的品牌信息再直接生成一张商品落地页生成结果长这样运行脚本时把--url换成你自己的站点地址即可复现。安装与第一次运行环境准备就两步克隆仓库、装依赖需要 Python 3.11 及以上。git clone https://gitcode.com/GitHub_Trending/br/browser-use cd browser-use pip install browser-use把大模型 API 密钥写进.env文件比如BROWSER_USE_API_KEY你的密钥OpenAI、Google、Anthropic 的密钥也可以直接用。然后写一个最小任务import asyncio from browser_use import Agent, ChatBrowserUse async def main(): agent Agent( task查询 browser-use 项目页面的最新版本号, llmChatBrowserUse(modelopenai/gpt-5.5), ) await agent.run() asyncio.run(main()) 运行后你会看到一个浏览器窗口自己弹开导航到目标页面读出页面上的数字最终把结果打印到终端。把task换成你自己的活这一节就算跑通了。进阶自定义工具与浏览器行为配置AI 缺你常用的某种能力时注册一个自定义工具即可创建Tools()对象用tools.action(description...)装饰器给普通函数加一句用途说明再传给Agent(..., toolstools)AI 走到对应环节会主动调用它而不是自己瞎猜。更多写法在 examples/custom-functions/ 里。浏览器行为集中在 browser_use/browser/profile.py 里调代理、下载路径、页面加载超时、是否禁用图片加载都是可直接改的参数。想在自己的代码里响应页面变化事件系统允许你在页面加载、弹窗出现、下载完成这些时机订阅回调。第一次使用先别动这些配置用默认参数把主流程跑顺再按你的具体场景逐项调整。实战建议模型选型、任务写法与安全模型怎么选。官方基准在 100 个真实网页任务上测了各模型的成功率追求成功率官方优化模型bu-2-0-mini-preview85% 一骑绝尘。预算紧张GPT-5.5、Gemini Flash 这类通用模型约 65%成本低不少。数据不能出内网接 Ollama 跑本地模型全程留在线上。任务怎么写才稳。给可验证的完成标准导出 CSV 并核对行数一致用max_steps参数给步数兜底防死循环网络类错误设重试而不是直接判失败。密钥与权限。密钥只放环境变量不写进代码敏感网站的账号密码交给 2FA 集成见 examples/custom-functions/onepassword_2fa.py不往模型里明文传自动化任务能访问的域名范围收得越小越好。性能注意。每个 Agent 都占一份浏览器进程内存并发先控制在 3 个以内跑顺再谈扩容大站点任务先禁掉图片加载速度立竿见影。 这套方案已在大量真实场景跑过项目社区星标来到 6.9 万高频问题快答要写多少代码最小示例十几行改任务描述就能跑复杂场景直接找 examples/ 里现成脚本改参数。需要登录的站点怎么办复用你本地的 Chrome 配置文件参考 examples/browser/real_browser.py或首次登录后保存会话状态后续自动保持登录。能跑本地模型吗能接 Ollama 即可模型只换model参数任务流程不变。任务卡死循环了任务里写清完成标准再设max_steps上限到点自动停不会一直烧 token。反检测风险有多大拟人操作加随机延迟能明显降低风险高安全级别的站点建议先小规模试跑再逐步放量。并发能开多大每个 Agent 占浏览器内存3 个以内先跑顺确认稳定后再往上加。从 10 分钟开始你的第一个网页任务现在就做这件事克隆仓库跑通上面的最小任务然后把task改成你每天做得最多的那件网页活。卡住时先翻 examples/ 里最接近你场景的脚本边界行为拿不准的再看 tests/ 里的对应用例。常用资源都放在仓库里文档入口 README.md、各场景示例 examples/、边界情况测试 tests/、能力速查 skills/。【免费下载链接】browser-use Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门