icon of BrowserAct

BrowserAct

面向 Agent 的原生浏览器基础设施,用于 Web 自动化、结构化数据提取与已登录浏览。

社区:

产品概览

什么是BrowserAct?

BrowserAct preview

BrowserAct 为需要在真实网站上可靠运行的 AI Agent 提供浏览器层。它帮助 Agent 导航页面、提取干净的结构化数据、复用本地 Chrome 登录会话,并处理机器人检测、CAPTCHA 等常见网络障碍。BrowserAct 支持本地 Agent 集成、云端工作流以及 API 或 MCP 访问,适用于个人自动化场景和产品级浏览器能力构建。


主要功能

  • 抗封锁浏览器运行时

    使用隐身指纹、代理路由和 CAPTCHA 处理机制,帮助浏览器任务在受保护的网站上持续运行。

  • 面向 Agent 的干净数据

    将网页转换为经过索引、低 token 消耗的结构化内容,让 Agent 无需依赖原始 DOM 输出即可对页面进行推理。

  • 本地 Chrome 会话复用

    让 Agent 通过已保存 Cookie、SSO 登录、扩展程序和已登录账号的本地 Chrome 会话进行工作。

  • 隔离的浏览器身份

    运行具有独立指纹、代理、工作区和账号状态的并行浏览器会话,防止会话之间相互干扰。

  • Agent 指令接口

    支持通过 Agent 友好的指令执行导航、点击、输入、等待、上传文件和数据提取等浏览器操作。

  • API 与 MCP 集成

    通过 API 和 MCP 暴露浏览器任务与工作流,让 Web 自动化能力接入 Agent 产品和自动化技术栈。


使用场景

  • 网络调研自动化 : 调研类 Agent 可以从网站收集实时信息,整理提取到的内容,并返回数据用于分析或报告。
  • 电商数据采集 : 团队可以抓取商品列表、价格、排名、评论等电商数据,无需维护自定义爬虫代码。
  • 已登录场景的自动化工作流 : 用户可以让 Agent 复用可信的 Chrome 会话和 SSO 登录,在已登录的网站内自动执行任务。
  • 多账号运营 : 运营者可以通过持久化、隔离的身份和区域代理配置,跨多个账号管理浏览器相关工作。
  • AI Agent 产品开发 : 开发者可以通过 API 或 MCP,为自己的应用添加真实浏览器的导航、交互和结构化网页提取能力。

常见问题

BrowserAct的替代方案

🚀

BrowserAct网站分析