请按以下步骤排查处理:
1. 检查核心服务状态
命令:
systemctl status uis-core uis-taskd ceph-mon.target
systemctl status tgtd
观察服务是否为 active (running),若异常查看日志 /var/log/messages。
2. 检查Ceph健康状态
命令:
ceph -s
ceph osd tree
确认监控节点(MON)是否在 quorum 中,OSD状态是否 up 且 in。
3. 检查网络与时间同步
检查存储网络(通常是 eth1/eth2)连通性。
命令:chronyc sources -v,确认节点间时间误差小于 0.5秒。
4. 检查集群节点状态
命令:
pssh all 'date; systemctl status uis-core'
确认所有节点 uis-core 服务状态一致。
5. 查看监控节点具体日志
路径:/var/log/uis/uis-core/,搜索 ERROR/FATAL 级别日志。
如果以上步骤无效,请收集日志联系400技术支持或通过新华三论坛(www.h3c.com.cn)提交案例。
暂无评论