VxRail集群中未在VxRail管理中更换硬盘而是在vCenter的VSAN中使用磁盘管理直接移除磁盘后,VxRail物理视图中磁盘状态告警不消除问题处理
一、故障现象
在vCenter的VSAN中使用磁盘管理直接移除磁盘后,VxRail物理视图中磁盘状态告警不消除
二、故障原因
在vCenter的VSAN中使用磁盘管理直接移除磁盘后,因未在VxRail中执行自动更换磁盘脚本,未更新VxRail中相关数据库记录,实现更换磁盘成功但VxRail中仍显示磁盘为故障状态。
三、故障处理方法
运行VxRail 故障诊断工具箱 python vxtoolv7选择8,检查VxRail数据库,选择0,26查看当前活跃告警/错误信息,如果表里已经没有记录,说明告警是前端界面缓存问题;如果还有记录,说明系统仍认为该故障未解决。继续查询 serviceability.event 表(编号36),看看 Disk的事件是否已被归档
SELECT * FROM serviceability.event WHERE component LIKE '%Disk%' OR error_message LIKE '%Disk%' ORDER BY insert_time DESC LIMIT 10;
| 5730 | 2026-07-06 17:56:28 | Predictive failure(预测性故障) | f (已读) |
历史 |
| 5731 | 2026-07-07 01:10:40 | Disk 6 removed(被移除) | t (未读) ⚠️ |
活跃未读 |
| 5732 | 2026-07-07 01:10:50 | 空内容 (代码 VXR50DPDR16) |
f (已读) |
关联事件 |
| 5733 | 2026-07-07 01:10:50 | Drive 6 removed from bay 1(从槽位移除) | t (未读) ⚠️ |
活跃未读 |
| 5734 | 2026-07-07 01:11:18 | 空内容 (代码 VXR50DPDR1016) |
f (已读) |
关联事件 |
| 5736-5738 | 2026-07-07 01:18-01:32 | 空内容 (代码 MYSTIC12C005) |
t (未读) ⚠️ |
系统内部事件 |
关键发现:ID 5731 和 5733 两条记录的 unread 字段值为 t (true),表示这些事件在数据库中仍被标记为 "未读"。
尽管 rcs.active_error 表已经是空的(告警已被逻辑解决),但 serviceability.event 表中存在 unread = t 的历史事件记录,前端 UI 可能会将这些未读事件作为"待处理告警"继续显示,导致告警不自动消除。
解决方案:将未读事件标记为已读
既然数据库确认活跃告警已清,只需要将这些 unread 标记更新为 f,前端就会认为所有事件已处理。
操作步骤(在 VxRail Manager 的 PostgreSQL 数据库中执行):
-
在 VxTool 中退出当前查询:输入
q退出到主菜单,然后选择q退出 VxTool,或直接通过 SSH 登录到 VxRail Manager 虚拟机。 -
以 root 或 mystic 用户登录 VxRail Manager,然后连接到数据库:
sudo -u postgres psql vxrailUPDATE serviceability.event
SET unread = 'f'
WHERE id IN (5731, 5733);
验证结果
再次查询 serviceability.event 表中 Disk 6 相关记录的 unread 状态:
SELECT id, event_time, code, unread FROM serviceability.event WHERE id >= 5730 ORDER BY id;
如果所有记录的 unread 都已变为 f,前端告警应已消失。
数除据库后UI界面显示信息:无法联系此磁盘。当前信息不可用。
通过命令行强制更新磁盘信息
以root用户登录VxRail Manager,执行以下命令来强制同步新磁盘的序列号与插槽信息到ESXi主机的配置文件。请将<ESXi hostname>和<ESXi root password>替换为实际值:、
curl -X POST --unix-socket /var/lib/vxrail/nginx/socket/nginx.sock http://127.0.0.1/rest/vxm/internal/do/v1/hosts/baseline-update -H 'Content-Type: application/json' -d '[{"hostname":"<ESXi hostname>", "username":"root","password":"<ESXi root password>", "update_disk":true}]'
四、故障处理结果
3分钟后刷新VxRail页面,状态显示正常。
附:VxRail中使用物理视图更换磁盘过程中遇到内部错误问题处理方法
1、重启过VxRail服务器无任何效果,将要更换磁盘的ESXi主机进行维护模式后再退出维护模式也无任何效果,最后将要更换磁盘的ESXi主机进行维护模式后重启ESXi主机,再执行操作正常。

浙公网安备 33010602011771号