$ loading_
为 MCP 客户端自动将图片转成文字描述,让仅文本模型也能处理图像问题。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"multimodal-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请使用 multimodal-mcp 先将这张报错截图转换为详细文字描述,再根据描述分析可能原因,并给出排查步骤。
先输出截图中的关键信息文字描述,再给出结构化的问题分析与排查建议。
请通过 multimodal-mcp 读取这张图表图片,提取主要趋势、异常点和可执行结论,整理成要点。
包含图表内容描述、趋势总结、异常发现和结论建议的要点清单。
请先用 multimodal-mcp 描述这张产品界面截图中的页面结构、控件和文案,再整理成功能需求说明。
一份基于截图内容整理的页面结构说明与功能需求摘要。
通过 MCP 为纯文本模型接入多模态视觉 API,实现图像理解与分析。
通过图像识别生成文字描述,适合在应用中快速接入视觉理解能力。
让不具备视觉能力的 AI 客户端借助本地 Ollama 模型完成看图、OCR 与图像问答。
用多种视觉模型识别和分析图片,并回答相关问题的 MCP 工具
让纯文本模型调用多模态 API,识别并描述图片内容。
通过 MCP 调用 gpt-image-2 生成和编辑图片,并将结果自动保存到本地。