$ loading_
让不具备视觉能力的模型识别截图与图片内容并返回结构化理解结果
复制安装指令,让 AI 自动完成配置 · 推荐新手
"image-recognition-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请识别这张剪贴板截图中的报错信息,提取错误代码、关键信息,并用中文总结可能原因。
返回截图中的报错文本、关键字段,以及简明的问题原因说明。
请识别这张图片里的表单内容,按字段名称和对应值整理成 JSON。
输出结构化的字段识别结果,便于后续存档或自动处理。
请查看这张应用界面截图,说明页面包含哪些主要模块、按钮和当前状态。
返回对界面布局与关键元素的清晰摘要,帮助快速理解页面内容。
让不具备视觉能力的 AI 客户端借助本地 Ollama 模型完成看图、OCR 与图像问答。
抓取网页或本地应用截图,并用本地视觉模型自动分析界面内容与问题
让大模型通过文件、链接或Base64识别并描述图片内容的视觉工具
用多种视觉模型识别和分析图片,并回答相关问题的 MCP 工具
通过图像识别生成文字描述,适合在应用中快速接入视觉理解能力。
通过单一图像分析工具识别截图、文本与界面稿内容,便于多模型视觉集成。