$ loading_
为编码助手提供本地照片理解、OCR、比对与元数据提取能力
复制安装指令,让 AI 自动完成配置 · 推荐新手
"photo-vlm-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请使用 photo-vlm-mcp 读取这张应用截图,提取所有可见文字,并按标题、按钮、正文分组输出。
返回结构化 OCR 结果,便于整理界面文案或排查问题。
请使用 photo-vlm-mcp 比较这两张网页截图,说明布局、文案、按钮状态和视觉元素的差异,并列出可能的回归问题。
输出清晰的差异清单和潜在问题说明,适合测试与评审。
请使用 photo-vlm-mcp 分析这张照片的场景内容,识别主要对象、环境特征,并提取可用的图片元数据。
返回场景描述、对象识别结果与元数据摘要,便于归档或后续处理。
让不具备视觉能力的 AI 客户端借助本地 Ollama 模型完成看图、OCR 与图像问答。
用多种视觉模型识别和分析图片,并回答相关问题的 MCP 工具
让纯文本 AI 通过本地 Ollama 离线完成图像理解、OCR 与多图对比。
用本地 Ollama 模型实现截图解析、OCR 识别与视觉监控自动化。
帮助用户分析视频内容,提取关键帧、检测场景并获取元数据
让大模型通过文件、链接或Base64识别并描述图片内容的视觉工具