Prime Intellect 与 Browserbase 合作推出 BrowserEnv 浏览器智能体训练环境
Partnering with Browserbase to Train Browser and Computer Use Agents
Prime Intellect 与 Browserbase 合作推出 BrowserEnv,用于训练浏览器和计算机使用智能体,基于 Browserbase 的可扩展浏览器基础设施。
使用 BrowserEnv 训练浏览器智能体
我们与 Browserbase 合作,为浏览器和计算机使用智能体打造最佳训练体验。Browserbase 提供可扩展的浏览器基础设施,已在多家实验室的工作中发挥作用,包括 Microsoft 的 Fara-7B 和 Google 的 Gemini 2.5 CUA。借助 Browserbase,我们已将同样的基础设施开放给所有人。
实时网络训练
如今大多数浏览器智能体都是在静态数据集上训练的,而非实时网络交互。因此,在基准测试中表现良好的模型,一旦遇到带有动态内容、弹窗和从未见过的布局的真实页面,就会崩溃。针对真实网站进行训练需要大规模运行浏览器、管理会话、处理反机器人保护以及验证任务完成情况。BrowserEnv 处理了所有这些工作,让你可以专注于你的模型和任务。
全栈
为了验证整个技术栈,我们在 WebVoyager 基准测试的 600 个真实网络任务上微调了 Qwen3-VL-8B-Instruct,训练它浏览、搜索并从 Amazon、GitHub 和 Allrecipes 等实时网站中提取信息。训练运行和环境都在 Hub 上,完全可复现,完整指南见此处。

两种模式:CUA 和 DOM
BrowserEnv 支持两种模式,选择哪一种取决于你的模型。CUA 模式适用于视觉语言模型:智能体查看截图并通过屏幕坐标执行操作。DOM 模式适用于纯文本模型:智能体通过 Browserbase 的 Stagehand SDK 工作,该 SDK 提供一个子智能体,它接收完整的 DOM 上下文并执行操作,而主智能体无需处理图像。两种模式都运行在相同的 Browserbase 基础设施上,并适用于相同的数据集和评估标准。
你自己的运行
你可以从我们构建的示例环境开始,或者直接进入 WebVoyager 进行真实基准测试。在此基础上,你可以为你的自有任务扩展任何环境,例如自定义网站、内部工具或特定产品的工作流。带上你自己的模型,选择一个环境,开始训练。更多信息、文档和指南请访问 BrowserEnv.com。
export BROWSERBASE_API_KEY=your-browserbase-key
uv pip install verifiers[browser]
prime eval run browser-cua-example来源:Prime Intellect Blog · primeintellect.ai