✖
每日一题
☺您本月已连续签到天,打败了0%的知了达人!
今日已答题
签到规则:
1.每日可签到答题一次,每签到一次可获得5积分,连续签到10天额外奖励50积分,连续签到20天以上额外奖励100积分;连续签到30天以上额外奖励200积分;
2.签到答题正确,获得经验值5点;
3.签到成功后,当天日期会有提示。
超融合管理平台首页存储集群IOPS和存储集群IO吞吐量没有显示
(0)
暂无评论
UIS超融合管理平台首页存储集群的IOPS和吞吐量没有显示,最常见的原因是负责采集性能指标的 prometheus-cluster 进程运行异常。
prometheus-cluster
这是一个已知问题,通常可以从以下几个方面入手解决。
这个问题通常由以下几个原因引起:
监控进程异常:prometheus-cluster 进程反复重启(例如每10秒一次),导致监控数据采集中断。
数据损坏或磁盘空间不足:存储监控数据的时序数据库文件损坏,或者系统磁盘(通常是CVM的系统盘)空间已满。
资源争抢:在双CVM(集群虚拟机)主备架构中,两个节点的 prometheus-cluster 进程可能因争抢同一份数据文件而发生冲突。
软件缺陷:特定版本的UIS平台可能存在已知的软件缺陷(Bug)。
你可以按照以下步骤进行排查和修复:
登录后台,检查进程状态通过SSH登录到UIS的CVM(控制台虚拟机)后台,使用以下命令检查 prometheus-cluster 进程的运行状态:
如果看到进程在 RUNNING 和 STARTING 等状态间反复切换,则说明进程异常。
RUNNING
STARTING
检查磁盘空间使用 df -h 命令检查系统盘分区(通常是根目录 /)的使用率。如果使用率过高(例如超过85%),需要清理空间。
df -h
/
尝试修复(核心步骤)如果确认是监控数据损坏,可以尝试以下方法,这也是很多场景下的有效解决方案:
停止进程:supervisorctl stop prometheus-cluster
supervisorctl stop prometheus-cluster
备份并清空数据目录:找到Prometheus的数据存储目录(通常为 /var/lib/prometheus/ 或类似路径),将其备份后清空。
/var/lib/prometheus/
重建权限并重启:确保目录权限正确后,重启进程:supervisorctl start prometheus-cluster
supervisorctl start prometheus-cluster
注意:如果你的环境是双CVM主备集群,需要同时在主备节点上执行上述清理操作,否则两个节点会互相备份损坏的数据,导致问题依旧。
验证与长效规避修复后,再次查看进程状态,确保其稳定运行。为了避免问题再次发生,建议:
调整数据留存周期:将监控数据的留存时间从默认的30天缩短到7天,以节省磁盘空间。
禁用备节点进程:在双CVM架构中,可以考虑只在主节点运行 prometheus-cluster,在备节点将其关闭,避免争抢。
升级系统版本:如果条件允许,将UIS升级到V7.0.07H03或更高版本,以彻底修复可能存在的软件缺陷。
首页存储 IOPS、IO 吞吐量空白,业务虚拟机不受影响。 1、优先打开【存储‑分布式存储‑性能】页面:如果这里也无数据,是后台采集进程om_monitor或者influxdb时序数据库异常;SSH 登录主节点重启两个服务,等待 10‑15 分钟观察。 2、如果存储性能页面图表正常,只有首页空白,是前端渲染问题,清除浏览器缓存或者换浏览器。 3、重启监控服务只能恢复之后的新监控数据,历史丢失的数据无法找回;频繁复现建议升级 UIS 平台版本。
om_monitor
influxdb
你正在编辑答案
如果你要对问题或其他回答进行点评或询问,请使用评论功能。
分享扩散:
亲~登录后才可以操作哦!
亲~检测到您登陆的账号未在http://hclhub.h3c.com进行注册
注册后可访问此模块
你的邮箱还未认证,请认证邮箱或绑定手机后进行当前操作
举报
×
侵犯我的权益
泄露了我的隐私
侵犯了我企业的权益
抄袭了我的内容
原文链接或出处
诽谤我
对根叔社区有害的内容
不规范转载
举报说明
暂无评论