将扫描版 PDF 进行 OCR 识别,生成可搜索可复制的文档
复制安装指令,让 AI 自动完成配置 · 推荐新手
"ocrmypdf-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请使用 ocrmypdf-mcp 对这个扫描版 PDF 执行 OCR,并输出可搜索的 PDF 文件。
返回完成 OCR 的 PDF,可按关键词搜索并复制文本。
请对这些扫描论文 PDF 逐个执行 OCR,保留原始版式,并给出处理结果说明。
得到一组可检索的论文 PDF,并附简要处理结果。
请使用 ocrmypdf-mcp 在 Windows 环境中处理该扫描 PDF,如需依赖请使用工具的自动 PATH 处理能力。
完成 OCR 处理,并兼容 Windows 下的 Tesseract 与 Ghostscript 路径设置。
办公人员拿到扫描版合同、表单或档案时,可用它执行 OCR,让 PDF 支持搜索与复制文本。这样无需手动重录内容。
研究人员处理扫描版论文或历史资料时,可先进行 OCR,再用于检索关键信息。适合把图片型 PDF 转成更易利用的文档。
开发者可将该 MCP 工具接入 Claude Desktop,通过单一工具调用 ocrmypdf。它还针对 Windows 自动处理 Tesseract 和 Ghostscript 的 PATH 兼容性。
它把 ocrmypdf 暴露为一个单一 MCP 工具,用于对扫描版 PDF 执行 OCR 识别。目标是让 PDF 更适合搜索和文本提取。
原始描述说明它的 Windows 兼容处理是为了确保与 Claude Desktop 配合使用。也就是说,它面向在 Claude Desktop 中调用 OCR 的场景。
描述中明确提到会自动处理 Tesseract 和 Ghostscript 的 PATH,以提升兼容性。更详细的安装和依赖信息见源码仓库。
支持生成、解析、拆分、合并与编辑 PDF 文档的 MCP 工具。
将 PDF 文件夹快速变成可检索的 MCP 服务,支持语义、混合与关键词搜索。
将 PDF 转为可引用的结构化内容,支持解析、抽取、问答与渲染
用于高速读取、解析和处理 PDF 文档的 MCP 工具,适合自动化文档工作流。
帮助用户读取、生成并管理PDF、DOCX和表格文档,支持OCR与分类处理。
支持从 PDF 提取文本、图片和表格,并进行多语言分类与相似度分析。