$ loading_
用 GLM-4.6V-Flash 识别图片内容并提取图中文字
复制安装指令,让 AI 自动完成配置 · 推荐新手
"glm-vision-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请读取这张本地截图中的全部文字,并按原有段落顺序输出;如果有标题和表格,也请分别标注。
返回截图中的 OCR 文本,并尽量保留原始结构。
分析这张文档图片的主要内容,概括核心信息,并列出其中出现的关键字段或结论。
输出图片内容摘要,以及文档中的重点信息清单。
请读取这个图片 URL 的内容,描述画面中有什么,并提取所有可见文字。
返回画面描述和可见文字提取结果。
办公人员或学生可把截图、文档照片等交给工具识别文字,减少手动录入。它适合处理截图、说明文档和其他图片中的文本提取需求。
研究员或开发者可让助手分析图片内容并总结重点,而不只做文字识别。它可用于理解截图、文档页或其他图像里的主要信息。
当图片来自链接、base64 数据或本地文件时,这个工具都可作为统一入口进行识别与分析。适合需要从不同来源接收图片的自动化流程。
它通过 GLM-4.6V-Flash 提供图像理解与 OCR 能力。可用于分析图片内容,并从截图、文档等图像中提取文字。
已知支持 URL、base64 和本地文件输入。也就是说,在线图片、本地图片和编码后的图片数据都可以作为来源。
给定信息里没有安装与配置细节。具体步骤请见源码仓库。
将图片转换为结构化描述与 OCR 文本,帮助纯文本大模型理解图像内容。
在 Claude Code 中调用 GLM-4.6V 进行图像分析。
让纯文本大模型借助云端视觉能力理解图片与视频内容
让不具备视觉能力的模型识别截图与图片内容并返回结构化理解结果
让纯文本大模型接入视觉能力,解析本地或在线图片内容。
通过视觉模型解析图片内容,支持链接、本地文件或 Base64 输入并按提示提取信息