$ loading_
安全管理 SLURM 集群任务,支持传文件、提交作业、查日志与远程执行命令
复制安装指令,让 AI 自动完成配置 · 推荐新手
"secure-cluster-mcp" 暂无可直接复制的安装信息,请查看页面文档或源码仓库。
把本地的 train.py 和 requirements.txt 上传到集群项目目录,为 1 个 GPU 创建一个 SLURM 作业,作业名设为 bert-train,并持续返回队列状态与最新日志摘要。
完成文件传输、生成并提交作业,返回作业 ID、队列状态和日志关键信息。
检查昨天失败的 SLURM 作业 48291,读取 stdout、stderr 和相关调度信息,判断失败原因,并给出下一步修复建议;如果安全可行,再重新提交修复后的作业。
输出失败原因分析、关键日志片段、修复建议,以及可选的重新提交结果。
在登录节点安全执行只读检查命令:查看磁盘配额、当前队列占用、我的运行中作业和最近 24 小时的错误日志摘要,并整理成简明报告。
返回结构化健康检查报告,包含资源使用情况、异常提示和建议操作。
通过 SSH 管理 SLURM 集群,完成作业提交、监控、队列与文件操作。
连接 Slurm 集群,帮助用户查询作业、管理队列并执行 HPC 调度操作。
提供鉴权、限流及记录查询与集成管理的安全MCP服务。
让 AI 代理安全调用威胁分析、攻防演练与终端安全运营工具。
让 AI 通过 SSH 安全执行远程命令、传输文件与管理端口转发
为大模型与 MCP 工具交互提供零信任防护与策略管控。