$ loading_
连接本地视觉大模型,提供图像分析、对比与 OCR 识别能力。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"gimmick-vision-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请使用视觉工具读取这张截图中的所有文字,并按段落整理输出;如果有表格,尽量保留原有结构。
返回结构化的 OCR 结果,包含截图中的主要文字内容与基本排版。
请对比这两张界面截图,列出视觉上的差异,包括文案、按钮位置、颜色、间距和缺失元素,并按严重程度排序。
输出一份清晰的差异清单,帮助快速定位两个版本之间的变化。
请分析这张图片的主要内容,识别其中的对象、场景和可能的用途,并用简洁中文总结要点。
得到一段图像内容摘要,包含关键对象、场景描述与用途判断。
为文本模型补充图像理解能力,可描述图片、提取文字并对比图像差异。
让不具备视觉能力的模型识别截图与图片内容并返回结构化理解结果
帮助用户识别图片内容、提取图片文字,并用自定义提示完成视觉分析。
用视觉大模型分析本地或远程图片并生成清晰文字描述。
用本地 Ollama 模型实现截图解析、OCR 识别与视觉监控自动化。
为 Claude Desktop 提供图像与视频理解分析能力的 MCP 服务器。