403 不再卡住你:3 分钟搞定 Browser-Use 代理配置与视窗测试
【免费下载链接】browser-use🌐 Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use
你的 AI 代理访问目标站点,请求全部 403,问题多半不在模型,而在"出口"——流量被反爬策略从源头拦掉了。Browser-Use 是一个让网站可被 AI 代理访问的开源项目:给它一句任务描述,它自动开浏览器完成点击、填表、采集等线上操作。这篇文章带你实操两件事:Browser-Use 代理配置,以及验证"代理真的看对页面了"的视窗测试。
代理请求全是 403,问题出在出口
代理直连站点时,反爬策略会把它挡在门外:请求返回 403,或者站点只给出地区默认页。这时候换模型、改提示词都没用,缺的是一条干净的出口。思路是把代理的浏览器流量从代理服务器出去,连通之后先让它访问类似 whatismyipaddress 的页面,报回出口 IP——IP 是代理的,链路才算通。
把项目跑起来:两条命令装好,一行代码连上代理
装好环境,配置才有落点,所以先走完这条操作链,这也是 Browser-Use 快速上手最快的路径:
git clone https://gitcode.com/GitHub_Trending/br/browser-use cd browser-use && pip install -e .最简代理配置只需在初始化浏览器会话时传入一行:
from browser_use.browser import BrowserSession session = BrowserSession(proxy="http://your-proxy-server:8080")✅ 启动后让代理打开 whatismyipaddress 页面,报回的 IP 是代理出口,说明 Browser-Use 代理配置已生效,可以继续往下走。
让代理更扛打:认证与绕过配置的三个入口
生产环境用的代理基本都要认证,同时你也不希望本地、内网地址被绕进代理。入口有三个:
- 认证代理:用
browser_use/browser/profile.py里的ProxySettings(server, username, password),BrowserSession 会自动应答代理认证挑战(实现在 browser_use/browser/session.py):
from browser_use.browser.profile import ProxySettings session = BrowserSession(proxy=ProxySettings( server="http://proxy.host:8080", username="u", password="p"))- 绕过列表:同一个文件的
bypass字段,逗号分隔,本地服务不经过代理。 - 环境变量免代码:
browser_use/config.py中的BROWSER_USE_PROXY_URL、BROWSER_USE_PROXY_USERNAME等,适合多环境切换。
若你走云端浏览器,则不需要自备代理:examples/cloud/04_proxy_usage.py里用use_proxy和proxy_country_code选国家出口,示例脚本会用 IP 验证任务帮你确认出口位置。
看见代理看见的:视窗测试怎么跑、结果怎么读
代理连通后,下一个问题是"代理到底看对页面没有"。视窗测试就是验证这一点:确认代理实际解析到、可交互的页面元素。
看截图。下图是 ad-use 示例任务中代理实际操作的页面截图,页面上的编号框就是代理识别出的可点击元素:
代理的"视野"不是原始截图,而是browser_use/dom/serializer/把页面 DOM 序列化出来的结构化元素列表。元素缺失、被隐藏或顺序错乱,代理就会点错位置——拿不准时先看序列化输出,再怀疑模型。
看成功率。static/accuracy_by_model_light.png对比了不同模型的任务成功率:
bu-ultra 一档在 78.0%。如果你的任务成功率明显低于这一档,先怀疑自己的代理稳定性和页面复杂度,再考虑换模型。
卡住了:代理连接与元素识别的三组"现象→原因→动作"
- 代理连不上:现象是浏览器启动即挂起或页面一直加载不出;原因多是代理地址、端口写错,或服务端不支持该协议;动作是核对
browser_use/browser/profile.py里的proxy参数,先在终端手动验证代理本身能通。 - 代理通了但认证不过:⚠️ 现象是首个请求就停在 407;原因是没传或没传全凭据;动作是用
ProxySettings补齐username和password,别只靠环境变量。 - 元素识别不准:现象是代理反复点错元素或找不到元素;原因是页面 DOM 序列化参数不合适;动作是调整
browser_use/dom/serializer/下的参数,重跑同一任务对比识别结果。
从 403 到稳定访问,接着读这两份文档
出口通了,视窗测试里元素也确认无误,开头那个 403 就只是普通加载页了。想继续往下挖:AGENTS.md 讲项目整体架构与约定,CLOUD.md 讲云端浏览器与代理国家配置怎么用。
【免费下载链接】browser-use🌐 Make websites accessible for AI agents. Automate tasks online with ease.项目地址: https://gitcode.com/GitHub_Trending/br/browser-use
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考