$ loading_
获取 NVIDIA GPU 利用率、显存、温度与功耗等监控指标,支持 MIG 环境。
复制安装指令,让 AI 自动完成配置 · 推荐新手
"GPU MCP Server" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
读取当前服务器上所有 NVIDIA GPU 的利用率、显存占用、温度和功耗,并按 GPU 编号整理为表格。
一份按 GPU 编号汇总的监控表,展示各项核心指标。
列出这台机器上的 MIG 实例及其对应的 GPU 资源使用情况,包括显存占用和利用率,并标记异常偏高的实例。
一份 MIG 实例级别的资源使用清单,并指出可能异常的实例。
检查所有 GPU 的温度和功耗,找出超过安全阈值的设备,并给出简要告警说明。
一份异常 GPU 告警结果,包含超限设备及对应原因说明。
获取本机 CPU、内存、磁盘、网络与进程等系统遥测指标
帮助管理 GPU 资源、虚拟机生命周期、账单、SSH 密钥与环境配置。
通过 NVIDIA 托管接口调用大模型对话、模型查询与图像生成能力。
让 AI 通过标准接口查询并分析 Prometheus 监控指标,辅助排障与运维决策。
通过 NVIDIA NIM 接入多种大模型,完成文本、多模态、图像生成与向量检索任务。
实时监控 Linux 系统资源、进程与 Docker 运行状态,辅助排障运维。