面向智算中心、政企与科研院所的计算资源全景监控与故障预警
每核 CPU、内存、负载与进程级指标精细采集,内置主机仪表盘与告警模板,开箱即用。
分区容量、IO 与使用率趋势动态监测,硬件 RAID 盘阵与磁盘健康 SMART 统一纳管。
网卡收发流量、错误包、并发连接跟踪;SNMP 多厂商交换机处理器与端口指标开箱采集。
利用率、显存、温度、功耗与 ECC/XID 深度指标;英伟达 + 昇腾/海光/寒武纪等国产卡统一视图。
多维分级告警、抑制/静默、订阅规则,20+ 通知渠道触达,可配置触发后自动执行脚本自愈。
大模型驱动的根因分析与规则辅助,对接国产大模型私有化部署,数据不出域,输出中文优化建议。
不同厂商的加速卡指标命名各异。ThinkRMS 以"原生采集 + 归一化规则"两层解耦,将英伟达、昇腾、海光、寒武纪、摩尔线程、天数智芯、沐曦等收敛为统一指标,跨厂商同图对比,无需为每张卡单独建看板。
提供全套仪表盘与低代码可视化大屏,原生拖拽设计、多大屏服务端持久化、预置多屏接真实数据。配合 AI Copilot 与巡检报告,把海量指标转化为可执行的优化建议。
ThinkRMS 是英同科技 ThinkAlike 出品的 一体化资源监控与告警平台,覆盖计算、存储、网络与 GPU 加速卡的统一采集、可视化大屏、多维告警与 AI 优化建议。
能。原生支持英伟达及昇腾、海光、寒武纪、摩尔线程、天数智芯、沐曦等国产加速卡,并以归一化规则收敛为统一指标视图。
不需要。看板与告警保持不变,仅调整归一化规则即可,业务零感知。
支持统一离线安装包,内网一键部署,数据不出域,可对接国产大模型输出中文优化建议。