通过 Rube MCP 连接并自动执行 Webscraping AI 抓取工作流。
复制安装指令,让 AI 自动完成配置 · 推荐新手
请帮我安装 askskill 上的 "webscraping-ai-automation" 技能: 1. 下载 https://raw.githubusercontent.com/ComposioHQ/awesome-claude-skills/master/composio-skills/webscraping-ai-automation/SKILL.md 2. 保存为 ~/.claude/skills/webscraping-ai-automation/SKILL.md 3. 装好后重载技能,告诉我可以用了
开发者或研究人员在开始网页抓取自动化前,可先搜索当前可用工具与参数定义,避免使用过期的 slug 或字段。这样更适合会变化的工具 schema 环境。
当团队通过 Composio 的 Webscraping AI 工具包运行任务时,可先检查连接是否为 ACTIVE。若未激活,系统会提示继续授权,减少执行时报错。
在同一工作流里复用 session ID,可以先发现工具、再检查连接、最后执行工具。这样更符合文档建议,也便于连续处理分页或多步操作。
文档介绍了如何通过 Rube MCP 接入 Composio 的 Webscraping AI 工具包来自动化网页抓取任务。内容涵盖前置条件、连接与授权流程、先用 RUBE_SEARCH_TOOLS 发现工具、再用 RUBE_MANAGE_CONNECTIONS 检查状态、最后用 RUBE_MULTI_EXECUTE_TOOL 执行的标准模式,并总结了 session 复用、memory 参数、schema 变化和分页处理等注意事项。
Automate Webscraping AI operations through Composio's Webscraping AI toolkit via Rube MCP.
Toolkit docs: composio.dev/toolkits/webscraping_ai
RUBE_MANAGE_CONNECTIONS with toolkit webscraping_aiRUBE_SEARCH_TOOLS first to get current tool schemasGet Rube MCP: Add https://rube.app/mcp as an MCP server in your client configuration. No API keys needed — just add the endpoint and it works.
RUBE_SEARCH_TOOLS respondsRUBE_MANAGE_CONNECTIONS with toolkit webscraping_aiAlways discover available tools before executing workflows:
RUBE_SEARCH_TOOLS
queries: [{use_case: "Webscraping AI operations", known_fields: ""}]
session: {generate_id: true}
This returns available tool slugs, input schemas, recommended execution plans, and known pitfalls.
RUBE_SEARCH_TOOLS
queries: [{use_case: "your specific Webscraping AI task"}]
session: {id: "existing_session_id"}
RUBE_MANAGE_CONNECTIONS
toolkits: ["webscraping_ai"]
session_id: "your_session_id"
RUBE_MULTI_EXECUTE_TOOL
tools: [{
tool_slug: "TOOL_SLUG_FROM_SEARCH",
arguments: {/* schema-compliant args from search results */}
}]
memory: {}
session_id: "your_session_id"
RUBE_SEARCH_TOOLSRUBE_MANAGE_CONNECTIONS shows ACTIVE status before executing toolsmemory in RUBE_MULTI_EXECUTE_TOOL calls, even if empty ({})| Operation | Approach |
|---|---|
| Find tools | RUBE_SEARCH_TOOLS with Webscraping AI-specific use case |
| Connect | RUBE_MANAGE_CONNECTIONS with toolkit webscraping_ai |
| Execute | RUBE_MULTI_EXECUTE_TOOL with discovered tool slugs |
| Bulk ops | RUBE_REMOTE_WORKBENCH with run_composio_tool() |
| Full schema | RUBE_GET_TOOL_SCHEMAS for tools with schemaRef |
Powered by Composio
它用于通过 Rube MCP 调用 Composio 的 Webscraping AI 工具包,自动化执行网页抓取相关操作。文档特别强调先搜索工具,再按最新 schema 执行。
需要已连接 Rube MCP,并且能使用 RUBE_SEARCH_TOOLS。还需要通过 RUBE_MANAGE_CONNECTIONS 为 toolkit `webscraping_ai` 建立并激活连接。
因为工具 schema 可能变化,不能硬编码 tool slug 或参数。先调用 RUBE_SEARCH_TOOLS 可以获取当前输入结构、推荐执行计划和已知陷阱。
通过先检索当前工具模式,自动化执行 Docupilot 文档生成与处理流程。
通过 Rube MCP 自动化执行 Documint 文档生成与处理相关任务。
通过 Rube MCP 自动处理 GitHub Gist 的创建、查询与管理任务。
通过 Rube MCP 自动执行 Reply.io 线索触达与外联流程任务。
通过 Rube MCP 自动执行 Griptape 任务并按最新工具 schema 调用。
通过 Rube MCP 自动执行 Cutt.ly 链接缩短与管理相关任务。
通过 Rube MCP 自动化执行 ScrapingBee 抓取任务与网页数据流程。
通过 Rube MCP 自动化执行 Scrapegraph AI 任务并先检索最新工具结构。
通过 Rube MCP 自动化执行 Scrapingant 抓取任务与相关流程。
通过 Rube MCP 自动化 BrowseAI 任务,批量抓取网页数据与监控变更
通过 Rube MCP 自动化执行 AI/ML API 任务,并先检索最新工具 schema。
通过 Rube MCP 自动执行 Scrape Do 抓取任务并获取结构化网页数据。