$ loading_
通过编号标注网页可交互元素,帮助 AI 执行浏览器自动化操作
复制安装指令,让 AI 自动完成配置 · 推荐新手
"browsercontrol" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
打开目标网页后,读取页面上的编号标记,点击编号 3 的按钮,然后告诉我页面发生了什么变化。
完成指定编号元素的点击,并返回页面变化或后续状态说明。
识别登录页中的编号标记,在用户名输入框和密码输入框对应编号处填写提供的信息,再点击提交按钮编号。
按编号定位输入框和按钮,完成表单填写与提交。
浏览当前网页,先点击编号 5 的导航项,再点击新页面上的编号 2 链接,并总结每一步进入了什么页面。
按编号连续执行多个网页操作,并返回导航路径摘要。
开发者在构建网页代理时,可以用编号标记可交互元素,让模型不必依赖模糊的视觉描述来点击或输入。这样更适合把网页操作拆解为明确步骤。
产品或研究人员需要让 AI 按步骤浏览页面、打开链接或提交表单时,可以通过元素编号下达更明确的操作指令。适合需要多步导航的网页任务。
在测试网页交互流程时,团队可以让 AI 依据编号依次触发页面控件,观察页面跳转和状态变化。它更适合关注操作过程而非手写选择器的场景。
它是一个用于浏览器自动化的 MCP server。其特点是先为网页中的可交互元素添加编号标记,再让 AI 通过引用编号来控制网页。
给定描述表明,它采用 vision-first 的方式,并通过编号标记交互元素。相比直接依赖文本描述或元素选择器,这种方式更便于 AI 明确指向页面上的目标元素。
当前提供的素材没有安装步骤或前置要求说明,见源码仓库。
让 AI 全面操控浏览器执行网页自动化、测试取证与页面检查任务
让 AI 控制本地真实浏览器执行网页自动化、采集与截图任务
让 AI 通过 MCP 全面操控浏览器,完成网页操作、表单填写与截图采集
通过浏览器自动化实现网页导航、交互与数据提取,辅助执行在线任务。
通过浏览器自动化、控制台日志抓取与截图,辅助网页调试和流程操作。
让 AI 直接控制浏览器执行网页操作、抓取信息与自动化测试。