# ThinkRMS —— 兼容国产 GPU 的一体化监控与告警平台

> ThinkRMS 是英同科技 ThinkAlike 出品的一体化资源监控与告警平台，覆盖计算、存储、网络与 GPU 加速卡的统一采集、可视化、故障预警与 AI 优化建议，原生支持英伟达及昇腾、海光、寒武纪等国产 GPU 信创场景，支持内网离线私有化交付。

- 厂商：英同科技 ThinkAlike（北京英同科技有限公司）
- 产品页：https://thinkalike.com.cn/thinkrms.html
- 在线试用：https://rms.thinkalike.com.cn

## 它是什么

ThinkRMS 用一套平台统览计算、存储、网络与加速卡资源：统一采集、可视化大屏、多维分级告警与 AI 优化建议，面向智算中心、政企与科研院所提供全栈资源监控与故障预警能力。

## 四大资源域

- **计算资源监控**：每核 CPU、内存、负载与进程级指标精细采集，内置主机仪表盘与告警模板。
- **存储与盘阵监测**：分区容量、IO 与使用率趋势监测，硬件 RAID 盘阵与磁盘健康 SMART 统一纳管。
- **网络与交换机**：网卡收发流量、错误包、并发连接跟踪；SNMP 多厂商交换机处理器与端口指标采集。
- **GPU 加速卡监控**：利用率、显存、温度、功耗与 ECC/XID 深度指标，英伟达 + 国产卡统一视图。

## 国产 GPU 差异化

以"原生采集 + 归一化规则"两层解耦，将英伟达、昇腾、海光、寒武纪、摩尔线程、天数智芯、沐曦等 7 大厂商的加速卡指标收敛为统一指标，跨厂商同图对比；换卡型只调归一化规则，看板与告警不变，业务零感知。

## 展示与运营

提供全套仪表盘与低代码可视化大屏（原生拖拽设计、多大屏服务端持久化），配合 AI Copilot 与巡检报告，把海量指标转化为可执行的中文优化建议；支持多租户业务组权限隔离与自动化运维。

## 产品形态

- **轻量版**：≤ 50 节点，单机内置全家桶，开箱即用。
- **标准版（推荐）**：50–500 节点，外挂时序库、国产 GPU 归一化统一视图、AI 优化建议与巡检报告。
- **集团版**：多机房，中心 + 边缘下沉多实例集群、流量分析与指挥中心大屏、License 授权与多租户。

## 常见问题

**ThinkRMS 能监控国产 GPU 吗？** 能。原生支持英伟达及昇腾、海光、寒武纪、摩尔线程、天数智芯、沐曦等国产加速卡，并以归一化规则收敛为统一指标视图。

**换不同厂商的卡需要重建看板吗？** 不需要。看板与告警保持不变，仅调整归一化规则即可，业务零感知。

**支持内网离线部署吗？** 支持统一离线安装包，内网一键部署，数据不出域，可对接国产大模型做 AI 优化建议。

**有告警自愈能力吗？** 有多维分级告警、抑制/静默、订阅规则与 20+ 通知渠道，并可配置触发后自动执行脚本自愈。
