$ loading_
提供可自托管的网页爬取能力,绕过反爬与 JS 挑战并异步处理内容。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"CrawMcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请使用 CrawMcp 抓取这个站点的文章列表与正文内容,尽量绕过反爬和 JS 校验,并以结构化 JSON 返回标题、链接、发布时间和正文摘要: https://example.com/news
返回可解析的结构化文章数据,适合后续分析或入库。
请用 CrawMcp 异步抓取以下 URL 列表,提取页面标题、主文本和状态信息,并汇总失败任务及重试建议:[URL 列表]
输出批量抓取结果、任务状态汇总以及失败原因说明。
请说明如何部署 CrawMcp,并结合 RabbitMQ、MinIO 和 Redis 给出适合生产环境的架构建议、队列处理流程、存储策略与自动清理配置。
得到部署步骤、系统架构说明和运维配置建议。
提供网页抓取与多页爬取能力,帮助 AI 自动采集并整理站点内容。
抓取并爬取网页内容,输出适合大模型处理的干净 Markdown。
帮助用户礼貌抓取网页并提取链接、表格与结构化内容,支持受限异步爬取
可抓取、爬取并提取任意网站数据,适合搜索研究与自动化采集流程。
帮助用户进行网页抓取、深度爬取与自动信息提取研究
集成网页抓取与检索增强生成,帮助用户构建灵活的智能内容检索流程。