$ loading_
用本地 Ollama 模型实现截图解析、OCR 识别与视觉监控自动化。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"vision-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请分析这张应用截图,识别界面中的主要元素、异常提示和潜在可用性问题,并按严重程度列出发现。
输出界面元素说明、错误信息提取及按优先级排序的问题清单。
对这张截图执行 OCR,提取所有可见文字,并按标题、正文、按钮文字分别整理输出。
返回结构化文字内容,便于复制、检索或进一步处理。
检查当前视觉分析服务是否正常,包括模型可用性、OCR 功能状态、截图分析能力和响应异常提示。
输出健康检查结果,指出可用模块、异常项及建议排查方向。
抓取网页或本地应用截图,并用本地视觉模型自动分析界面内容与问题
通过单一图像分析工具识别截图、文本与界面稿内容,便于多模型视觉集成。
让不具备视觉能力的 AI 客户端借助本地 Ollama 模型完成看图、OCR 与图像问答。
用视觉大模型分析本地或远程图片并生成清晰文字描述。
帮助用户截图并用视觉模型分析屏幕、窗口与图片内容。
让纯文本 AI 通过本地 Ollama 离线完成图像理解、OCR 与多图对比。