$ loading_
为本地低功耗屏幕视觉提供OCR与界面检测,辅助识别受限屏幕内容
复制安装指令,让 AI 自动完成配置 · 推荐新手
"npu-vision-fallback" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
请通过 npu-vision-fallback 分析当前远程桌面画面,识别可点击按钮、输入框和主要文本,并按屏幕区域列出它们的位置与标签。
返回远程桌面中的界面元素清单,包含文本内容、控件类型和大致位置。
使用 npu-vision-fallback 对当前游戏画面执行 OCR,提取任务提示、菜单文字和状态信息,并整理成结构化摘要。
输出游戏界面中可识别的文字及其分类摘要,便于后续自动化处理。
调用 npu-vision-fallback 检测当前应用界面的关键控件与文本,判断登录页是否完整加载,并指出缺失或异常元素。
给出页面加载状态判断,以及关键控件是否存在的检测结果。
用本地 Ollama 模型实现截图解析、OCR 识别与视觉监控自动化。
通过单一图像分析工具识别截图、文本与界面稿内容,便于多模型视觉集成。
抓取网页或本地应用截图,并用本地视觉模型自动分析界面内容与问题
用支持视觉的 AI 模型完成图像分析、OCR、场景描述与图片比对。
让不具备视觉能力的 AI 客户端借助本地 Ollama 模型完成看图、OCR 与图像问答。
让不具备视觉能力的模型识别截图与图片内容并返回结构化理解结果