$ loading_
让 AI 代理通过视觉模型完成图像分析、OCR、裁剪与对比处理
复制安装指令,让 AI 自动完成配置 · 推荐新手
"agent-vision-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请读取这张图片中的全部文字,按段落整理输出,并保留标题与列表结构。
返回结构清晰的 OCR 文字结果,便于复制、检索或继续处理。
请对比这两张产品界面截图,指出布局、文案、按钮状态和视觉层级上的差异,并总结主要变化。
输出详细差异清单与变化摘要,帮助检查版本更新或设计改动。
请先定位图片中右上角的图表区域,将其裁剪出来,再分析其中的关键数据点和异常信息。
返回裁剪区域的分析结果,说明图表内容、重点数据与潜在异常。
通过单一工具接入兼容接口,帮助 AI 代理完成图片分析与视觉理解任务。
通过 Gemini 与 Vertex AI 分析图片和视频内容,提取洞察并辅助自动化处理。
让 AI 通过视觉模型分析图片视频、识别文字并比较视觉内容。
帮助代理理解本地、网页或Base64图片内容并返回结构化分析结果
让纯文本编码代理读取图片、视频和截图并返回结构化分析结果
用本地 Ollama 模型实现截图解析、OCR 识别与视觉监控自动化。