重启了 tomcat、uis-core 和 ceph-mon 都无效,说明问题可能不在这些应用层服务,而更可能出在 UIS 底层负责硬件/存储状态采集的监控进程,或是集群监控节点(MON)的配置上。
onestor-peonUIS 前台显示的节点状态,依赖于后台一个名为 onestor-peon 的进程来采集和上报。如果这个进程异常,即使 ceph -s 显示正常,前台也会报“监控节点状态异常”。
操作步骤:
SSH 登录到状态显示异常的那个节点的后台。
执行以下命令,重启存储监控进程:
有案例表明,前台存储界面显示异常但后台实际正常时,重启此进程后清理缓存刷新即可恢复。
重启后,等待 1-2 分钟,观察 UIS 前台节点的状态是否恢复正常。
UIS 集群的监控节点(Ceph MON)数量有严格的配比要求。如果 MON 节点配置不符合规范或状态异常,可能导致监控功能失灵。
检查配置是否符合要求:
集群节点数 小于 5 个:应配置 3 个 monitor 节点。
集群节点数 5~10 个:应配置 5 个 monitor 节点。
集群节点数 大于 10 个:应配置 7 个 monitor 节点。
检查 MON 进程状态:
在任意一个 CVK 节点的后台,执行以下命令查看 MON 进程是否正常运行:
如果 MON 进程缺失或状态异常,需要进一步检查 /var/log/ceph/ 下的相关日志。
如果 onestor-peon 重启后问题依旧,需要查看日志以获取更具体的错误信息。
关键日志路径:
UIS 管理平台日志:在主管理节点的 /var/log/uis/ 目录下,关注 uis-manager.log 或 tomcat8 相关日志。
存储监控日志:在异常节点上,检查 /var/log/onestor/ 或 supervisor 相关日志,搜索 onestor-peon 的错误输出。
Ceph 集群日志:在任意 MON 节点上,检查 /var/log/ceph/ceph-mon.*.log,搜索 HEALTH_ERR 或 slow 等关键词。
某些 UIS 版本的巡检或监控组件存在已知的误报或逻辑缺陷。
建议:核对你的 UIS 版本,如果恰好落在已知存在监控误报的版本范围内,升级到已修复的版本是根本的解决途径。
暂无评论
亲~登录后才可以操作哦!
确定你的邮箱还未认证,请认证邮箱或绑定手机后进行当前操作
举报
×
侵犯我的权益
×
侵犯了我企业的权益
×
抄袭了我的内容
×
原文链接或出处
诽谤我
×
对根叔社区有害的内容
×
不规范转载
×
举报说明
暂无评论