您好,参考
onestor‑tool cache status,确认哪个 slot 状态为 error/fault;看缓存盘是否mounted、OSD 绑定是否正常。/var/log/onestor/cache.log,确认是元数据损坏还是分区残留。dmsetup remove <设备名>清理残留分区,不要直接删磁盘分区表H3C。
暂无评论
现象说明:
eall看物理盘硬件状态正常;sall、v4 show all看存储池逻辑盘、OSD 状态正常;但是告警报某节点 slot 缓存异常。 该告警属于闪存加速(读缓存)层状态异常,不是底层 OSD 磁盘硬件故障,eall/sall/v4 show all不会输出缓存层内部状态H3C。
注意:
eall/sall是看底层磁盘、OSD;缓存加速层有独立命令。
v4 cache show
输出会列出每个节点、每个 slot 缓存盘的 State:ok / abnormal / offline / broken,异常节点这里会直接显示abnormal。
v4 cache show --node 节点主机名
#示例:v4 cache show --node cvk‑node01
可以看到 slot 编号、SSD 设备路径、缓存分区、状态、模式(read‑cache)、命中率、脏块计数。
v4 cache list
查看 slot 与 /dev/sdX 设备对应关系,确认告警的 slot 对应的 SSD 盘。
v4 event show | grep‑i cache
v4 event show | grep‑i slot
定位缓存异常的原始事件,看是:分区识别失败、元数据损坏、缓存分区残留、IO 报错、缓存未挂载。
lsblk
dmesg | grep‑i sd
确认 SSD 缓存盘识别正常,看是否存在重复缓存分区残留(常见故障点:删除节点后残留旧缓存分区,重新加入集群导致 slot 状态异常)H3C。
sall看不到缓存层故障。⚠️闪存读缓存可以直接移除,不会丢失业务数据;只是性能下降,业务虚拟机不会损坏。
v4 cache show获取。#清理残留缓存分区(替换为实际设备)
dmsetup remove <缓存设备uuid>
如果 dmsetup remove 失败,重启该 CVK 节点后再执行清理H3C。
#移除异常slot缓存
v4 cache remove‑slot <slot‑id>
#重新添加slot缓存
v4 cache add‑slot <slot‑id>
执行完成后执行v4 cache show确认 state 变为 ok,查看平台告警是否清除。
警告:不要直接格式化正在正常工作的缓存 slot,只会对异常 slot 执行格式化。
v4 cache show > cache_info.txt
v4 event show > event.txt
lsblk > lsblk.txt
dmesg > dmesg.txt
eall:只检测物理磁盘硬件状态(电源、介质错误、坏块硬件状态),不检测闪存缓存元数据逻辑状态,硬件没问题就返回正常。sall / v4 show all:只看 OSD、存储池、数据分片逻辑,不包含 cache 闪存加速层状态。
所以会出现硬件、OSD 全部正常,但平台报 slot 缓存异常现象。
暂无评论
亲~登录后才可以操作哦!
确定你的邮箱还未认证,请认证邮箱或绑定手机后进行当前操作
举报
×
侵犯我的权益
×
侵犯了我企业的权益
×
抄袭了我的内容
×
原文链接或出处
诽谤我
×
对根叔社区有害的内容
×
不规范转载
×
举报说明
暂无评论