Atlas服务器硬盘故障处理及注意事项
收藏回复举报
Atlas服务器硬盘故障处理及注意事项
发表于2024-02-23 14:49:58
0 查看

一、关于更换/拔插硬盘

更换或拔插硬盘不应在开机或关机过程中操作,要么在关机状态下,要么在系统上电正常运行状态下;

系统上电正常运行状态下,非确认硬盘故障不要拔插硬盘,更换或拔插硬盘时,故障硬盘在脱离硬盘背板后,需要等待30秒后再完全拔出,然后再插入新硬盘,不要反复高频率拔插硬盘;

在Raid组降级的情况下,不要再拔出Raid组中剩余的正常成员盘。

5.png

二、硬盘故障处理:

(1)硬盘状态为failprefail

正常情况下,使能RAID控制卡的紧急备份功能后,任意一个具备冗余功能的RAID组中硬盘故障且没有指定热备盘时,该RAID控制卡下的与故障盘同类型的空闲盘会自动替代fail或prefail状态的成员盘并进行重构,避免数据丢失。

但当RAID控制卡未设置紧急热备时,成员盘状态显示为fail或prefail时,可使用以下方法处理。

  1. 使用StorCLI工具,具体操作请参考获取工具
  2. 执行以下命令,将RAID组成员盘状态设置为离线,具体操作请参考设置硬盘状态

storcli64 /ccontroller_id/eenclosure_id/sslot_id set offline [force]

    • controller_id硬盘所在RAID控制卡的ID
    • enclosure_id硬盘所在Enclosure的ID
    • slot_id:物理硬盘槽位ID
  1. 更换离线硬盘。
  2. RAID组自动执行重构。

等待重构完成。

三、硬盘状态为Unconfigured Bad或UBad

处理方法

  1. 使用StorCLI工具,具体操作请参见获取工具
  2. 执行以下命令,将RAID组成员盘状态设置为good,具体操作请参见恢复Frn-Bad状态的硬盘

storcli64 /ccontroller_id/eenclosure_id/sslot_id set good [force]

    • controller_id硬盘所在RAID控制卡的ID
    • enclosure_id硬盘所在Enclosure的ID
    • slot_id:物理硬盘槽位ID
  1. 重新查看硬盘状态是否更改为Unconfigured Good或Ugood。具体操作请参见DrivesDrive Management界面或查询RAID控制卡/RAID组/物理硬盘信息
    • 问题解决 => 处理完毕。
    • 问题未解决 => 4
  2. 查看硬盘是否存在外部配置,如存在外部配置则导入或清除外部配置。具体操作请参见导入/清除外部配置导入/清除外部配置查看/导入/清除外部配置
    • 问题解决 => 处理完毕。
    • 问题未解决 => 联系技术支持处理。

我要发帖子