$ loading_
让 AI 通过视觉模型分析图片视频、识别文字并比较视觉内容。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"Vision MCP Server" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请分析这张图片,提取其中所有可见文字,并按标题、正文、表格内容分别整理输出。
输出结构化的 OCR 结果,并按内容类型分类整理。
请比较这两张设计稿,指出布局、颜色、文案和按钮样式上的差异,并总结对用户体验的影响。
输出逐项差异清单,并附带简要影响分析。
请分析这个视频,概括主要场景变化、关键事件和画面中的文字信息,并生成时间线摘要。
输出按时间顺序整理的视频摘要与关键信息提取结果。
帮助用户截图并用视觉模型分析屏幕、窗口与图片内容。
通过单一图像分析工具识别截图、文本与界面稿内容,便于多模型视觉集成。
用视觉大模型分析本地或远程图片并生成清晰文字描述。
让纯文本模型调用多模态 API,识别并描述图片内容。
帮助代理理解本地、网页或Base64图片内容并返回结构化分析结果
帮助用户识别图片内容、提取图片文字,并用自定义提示完成视觉分析。