$ loading_
提供视觉与视频分析能力,支持接入多种模型用于识别、理解与自动处理内容
复制安装指令,让 AI 自动完成配置 · 推荐新手
"vlm-mcp-server" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请分析这段监控视频,按时间轴列出关键事件、人物动作、异常行为,并输出结构化摘要。
一份按时间排序的事件摘要,包含异常片段与行为说明。
请识别这张产品界面截图中的主要按钮、输入框、导航区域和提示信息,并说明它们的功能。
一份界面元素清单,附带位置说明和功能解释。
请对这批视频进行内容分析,为每个视频提取主题、场景、对象和情绪标签,并输出为 JSON。
每个视频对应的结构化标签结果,便于检索、分类或下游自动化处理。
通过统一 MCP 服务调用多家视觉模型,完成图像分析与识别任务
通过单一图像分析工具识别截图、文本与界面稿内容,便于多模型视觉集成。
帮助用户分析视频内容,提取关键帧、检测场景并获取元数据
通过单一工具接入兼容接口,帮助 AI 代理完成图片分析与视觉理解任务。
让纯文本模型调用多模态 API,识别并描述图片内容。
可对千余平台视频进行转写、画面解析与元数据提取,支持自动化分析流程。