$ loading_
让纯文本大模型也能看图读字并分析截图内容的 MCP 工具
复制安装指令,让 AI 自动完成配置 · 推荐新手
"videre-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请读取这张应用报错截图,提取其中的错误信息、按钮文案和关键界面元素,并总结可能的问题原因。
返回截图中的文字内容、界面结构说明,以及对报错原因的简要分析。
请对这张图片执行 OCR,按原有顺序输出全部可识别文字,并标注不确定的部分。
返回结构化的文字提取结果,尽量保留原始排版顺序与不确定标记。
请描述这张产品界面的主要区域、组件层级和视觉重点,帮助我把它还原成前端页面。
返回清晰的界面描述,包括布局、组件位置、文本内容和可用于开发的结构信息。
为 AI 编码助手接入图像理解能力,识别截图并辅助开发分析。
使用 Florence-2 处理与解析图像内容,支持视觉理解与信息提取任务
用支持视觉的 AI 模型完成图像分析、OCR、场景描述与图片比对。
通过单一图像分析工具识别截图、文本与界面稿内容,便于多模型视觉集成。
让纯文本大模型接入视觉能力,解析本地或在线图片内容。
将截图和图片转成代码、文本与故障诊断结果,提升视觉理解自动化。