Diagnostic et remplacement d'un disque dur défectueux (Serveur Dédié Linux ou Serveur Bare Metal Linux avec Raid Hardware)
Veuillez utiliser la fonction « Imprimer » au bas de la page pour créer un PDF.
Si vous recevez une notification signalant une défaillance du disque dur ou si vous constatez des anomalies au niveau du système, il est nécessaire d'agir rapidement afin de rétablir la redondance de votre matrice RAID. Dans cet article, vous apprendrez comment identifier un disque dur défectueux et préparer le serveur au remplacement du disque défectueux.
Remarque
Cet article suppose des connaissances de base en administration de serveurs sous Linux. Si vous avez des questions concernant le remplacement d'un disque dur défectueux ou si vous avez besoin d'aide, veuillez prendre contact avec le Service Client IONOS. Vous trouverez ses coordonnées sur la page suivante : Service Client IONOS
Cet article décrit principalement le diagnostic et la préparation du remplacement de disques SATA/SAS dans des systèmes RAID matériels. Dans le cas des disques NVMe, les commandes, les noms de périphériques, les valeurs SMART/d'intégrité et l'identification des disques défectueux peuvent varier.
Afin de garantir une fiabilité maximale, il est nécessaire que vous surveilliez le RAID matériel de votre Serveur Dédié ou Serveur Bare Metal. Si vous recevez un e-mail de notification signalant un disque dur défectueux ou si vous constatez vous-même une défaillance d’un disque dur, vous devez identifier le disque dur défectueux et préparer le serveur en vue du remplacement du disque défectueux. Prenez ensuite contact avec le Service Client IONOS afin d'organiser le remplacement du disque dur.
Attention
Les systèmes RAID offrent une meilleure fiabilité et/ou une vitesse plus élevée. Ils ne remplacent toutefois pas les sauvegardes régulières. Afin d'éviter toute perte de données, nous vous recommandons d'effectuer régulièrement une sauvegarde. Veillez également à effectuer une sauvegarde avant de suivre les étapes suivantes afin de garantir la sécurité de vos données.
Vous trouverez plus d'informations sur la création de sauvegardes dans la catégorie suivante du Centre d'Assistance IONOS : Solutions de sauvegarde
Contrôleurs RAID matériels : informations générales
Un contrôleur RAID matériel est un contrôleur physique intégré au serveur sous forme de composant matériel. Ce contrôleur dispose de son propre processeur pour le calcul des opérations RAID. Ce processeur organise et gère l'espace de stockage. Ainsi, le processeur central (CPU) du serveur n'est pas sollicité par les calculs RAID. Avec les contrôleurs RAID matériels, la fonctionnalité RAID est indépendante du système d'exploitation. Ils sont gérés via des programmes de ligne de commande spécifiques (Command Line Interface, ou CLI), qui peuvent varier selon le fabricant et le modèle.
Diagnostic des pannes de disque dur
Pour détecter les défaillances des disques durs, nous vous recommandons d'utiliser le programme smartctl. smartctl est un programme en ligne de commande permettant de surveiller les disques à l'aide de la technologie SMART (Self-Monitoring, Analysis and Reporting Technology). Ce programme vous permet de vérifier si un disque dur est défectueux. Il fait partie intégrante de Smartmontools. Les Smartmontools sont disponibles sous forme de paquets pour de nombreuses distributions Linux. Vous trouverez de plus amples informations sur la page suivante : Smartmontools Packages
Remarque
Dans certains cas, il peut arriver qu'un défaut du disque dur ne puisse pas être détecté à l'aide des valeurs SMART. C'est pourquoi nous vous recommandons d'analyser également les journaux système.
Installer Smartctl
Pour installer smartctl, connectez-vous au serveur en tant qu'administrateur.
Installez les paquets nécessaires en fonction de votre distribution :
AlmaLinux 9 et 10 ainsi que Rocky Linux 9 et 10 :dnf install smartmontools
Debian 12 et 13, ainsi qu'Ubuntu 24.04 et 26.04 :
sudo apt install smartmontools
Identifier le type de contrôleur matériel
Pour vérifier quel contrôleur matériel est installé sur votre serveur, vous pouvez utiliser le programme lshw. Ce programme fournit des informations détaillées sur les composants matériels.
Pour installer ce programme, saisissez la commande suivante :
AlmaLinux 9 et 10 ainsi que Rocky Linux 9 et 10 :
dnf install lshw
Debian 12 et 13, ainsi qu'Ubuntu 24.04 et 26.04 :
sudo apt-get install lshw
Afficher les informations matérielles
Pour afficher un résumé des informations matérielles, saisissez la commande suivante :
lshw –short
Pour exporter les informations matérielles dans un fichier texte, saisissez la commande suivante :
lshw > lshw_output.txt
Dans l'exemple suivant, un contrôleur matériel PERC H330 est intégré au serveur :
root@829F6DF:~# lshw -short
H/W path Device Class Description
==========================================================
system PowerEdge R230 (SKU=NotProvided;ModelName=PowerEdge R230)
/0 bus 0DWX9P
/0/0 memory 64KiB BIOS
/0/400 processor Intel(R) Xeon(R) CPU E3-1270 v6 @ 3.80GHz
/0/400/700 memory 256KiB L1 cache
/0/400/701 memory 1MiB L2 cache
/0/400/702 memory 8MiB L3 cache
/0/1000 memory 32GiB System Memory
/0/1000/0 memory 16GiB DIMM DDR4 Synchronous Unbuffered (Unregistered) 2133 MHz (0.5 ns)
/0/1000/1 memory 16GiB DIMM DDR4 Synchronous Unbuffered (Unregistered) 2133 MHz (0.5 ns)
/0/1000/2 memory [empty]
/0/1000/3 memory [empty]
/0/100 bridge Intel Corporation
/0/100/1 bridge Skylake PCIe Controller (x16)
/0/100/1/0 scsi0 storage MegaRAID SAS-3 3008 [Fury]
/0/100/1/0/2.0.0 /dev/sda disk 799GB PERC H330 Adp
/0/100/1/0/2.0.0/1 /dev/sda1 volume 2047KiB BIOS Boot partition
/0/100/1/0/2.0.0/2 /dev/sda2 volume 27GiB EXT3 volume
/0/100/1/0/2.0.0/3 /dev/sda3 volume 9536MiB Linux swap volume
/0/100/1/0/2.0.0/4 /dev/sda4 volume 707GiB LVM Physical Volume
/0/100/1.1 bridge Skylake PCIe Controller (x8)
/0/100/14 bus Sunrise Point-H USB 3.0 xHCI Controller
/0/100/14/0 usb1 bus xHCI Host Controller
/0/100/14/0/3 bus Gadget USB HUB
/0/100/14/1 usb2 bus xHCI Host Controller
/0/100/14.2 generic Sunrise Point-H Thermal subsystem
/0/100/16 communication Sunrise Point-H CSME HECI #1
/0/100/16.1 communication Sunrise Point-H CSME HECI #2
/0/100/17 storage Sunrise Point-H SATA controller [AHCI mode]
/0/100/1d bridge Sunrise Point-H PCI Express Root Port #9
/0/100/1d/0 eth0 network NetXtreme BCM5720 Gigabit Ethernet PCIe
/0/100/1d/0.1 eth1 network NetXtreme BCM5720 Gigabit Ethernet PCIe
/0/100/1d.2 bridge Sunrise Point-H PCI Express Root Port #11
/0/100/1d.2/0 bridge SH7758 PCIe Switch [PS]
/0/100/1d.2/0/0 bridge SH7758 PCIe Switch [PS]
/0/100/1d.2/0/0/0 bridge SH7758 PCIe-PCI Bridge [PPB]
/0/100/1d.2/0/0/0/0 display G200eR2
/0/100/1f bridge Sunrise Point-H LPC Controller
/0/100/1f.2 memory Memory controller
/0/100/1f.4 bus Sunrise Point-H SMBus
Programmes de gestion des contrôleurs RAID
Les logiciels nécessaires à la gestion des contrôleurs RAID correspondants sont installés par défaut. Si ces logiciels ne sont pas installés sur votre serveur, vous trouverez dans l'article suivant des liens vous permettant de les télécharger : Surveiller et reconstruire un RAID matériel (Linux)
Utiliser l'outil CLI pour afficher l'état de la matrice RAID
Utilisez l'outil CLI approprié pour consulter l'état de la matrice RAID (RAID 1, 5 ou 6) et des disques physiques.
Le contrôleur RAID Broadcom est géré et piloté à l'aide de l'outil en ligne de commande StorCLI. En fonction de la génération du contrôleur et du système d'exploitation, utilisez :
storcli64 : pour les contrôleurs Broadcom/LSI courants (par exemple MegaRAID, AVAGO)
storcli2 : pour la dernière génération de contrôleurs tri-mode (NVMe/SAS/SATA)
Le contrôleur RAID Dell est géré et piloté à l'aide de l'outil en ligne de commande PERCCLI. En fonction de la génération du contrôleur et du système d'exploitation, utilisez :
perccli64 : pour les contrôleurs RAID Dell des anciennes générations
perccli2 : pour la dernière génération de contrôleurs RAID Dell (par exemple, les systèmes GraniteRapids/Blackwell)
Remarque
Dans l'exemple suivant, nous utilisons storcli64. Si vous utilisez un contrôleur Dell ou un système plus récent, remplacez la commande par perccli64, storcli2 ou perccli2. La syntaxe reste pratiquement identique.
Si vous ne savez pas quel outil en ligne de commande est prévu pour votre contrôleur RAID, testez les commandes ci-dessous en y ajoutant « show ». L'exécution d'un « mauvais » outil entraînera simplement l'affichage d'un message d'erreur, sans causer de dommages.
Identifier un disque dur défectueux
La commande suivante vous permet d'identifier le disque dur défectueux : storcli64 /call show
Les informations suivantes, entre autres, s'affichent alors :
Controller = 0
Status = Success
...
Drive Groups = 1
TOPOLOGY :
========
-----------------------------------------------------------------------------
DG Arr Row EID:Slot DID Type State BT Size PDC PI SED DS3 FSpace TR
-----------------------------------------------------------------------------
0 - - - - RAID1 Optl N 931.000 GB dflt N N dflt N N
0 0 - - - RAID1 Optl N 931.000 GB dflt N N dflt N N
0 0 0 16:4 0 DRIVE Onln N 931.000 GB dflt N N dflt - N
0 0 1 16:6 1 DRIVE Onln N 931.000 GB dflt N N dflt - N
-----------------------------------------------------------------------------
DG=Disk Group Index|Arr=Array Index|Row=Row Index|EID=Enclosure Device ID
DID=Device ID|Type=Drive or RAID Type|Onln=Online|Rbld=Rebuild|Optl=Optimal
Dgrd=Degraded|Pdgd=Partially degraded|Offln=Offline|BT=Background Task Active PDC=PD Cache|PI=Protection Info|SED=Self Encrypting Drive|Frgn=Foreign DS3=Dimmer Switch 3|dflt=Default|Msng=Missing|FSpace=Free Space Present TR=Transport Ready
Virtual Drives = 1
Vérifiez le numéro du contrôleur. En règle générale, l'entrée « Controller = 0 » s'affiche. Si un autre numéro s'affiche, vous devez en tenir compte dans les commandes relatives au contrôleur RAID matériel. Recherchez ensuite dans la PD LIST les informations Slt (emplacement) et State. Un disque dur en bon état affiche le statut Onln (en ligne).
Un disque dur défectueux est souvent signalé comme « Failed », « Missing », « Offline » ou « Degraded ». Notez l 'EID:Slt (identifiant du boîtier et numéro d'emplacement), par exemple 252:1.
Afficher les informations relatives au disque dur
Pour consulter les informations relatives au disque dur à l'aide de smartctl, vous devez toujours spécifier la commande correspondante en combinaison avec une option et un périphérique cible. Le périphérique cible dépend du fabricant du contrôleur.
Les commandes ci-dessous vous permettent d'afficher les informations relatives au disque dur nécessaires au diagnostic :
ARECA :
Disque dur 1 : smartctl -iHAl error /dev/sg1 -d areca,1
Disque dur 2 : smartctl -iHAl error /dev/sg1 -d areca,2
LSI / 3Ware :
Disque dur 1 : smartctl -iHAl error /dev/twe0 -d 3ware,0
Disque dur 2 : smartctl -iHAl error /dev/twe0 -d 3ware,1
Adaptec :
Disque dur 1 : smartctl -iHAl error /dev/sg2 -d sat
Disque dur 2 : smartctl -iHAl error /dev/sg3 -d sat
Disque dur 3 : smartctl -iHAl error /dev/sg4 -d sat
Disque dur 4 : smartctl -iHAl error /dev/sg5 -d sat
Dell :
Disque dur 1 : smartctl -iHAl error -d sat+megaraid,0 /dev/sda
Disque dur 2 : smartctl -iHAl error -d sat+megaraid,1 /dev/sda
Broadcom :
Disque dur 1 : smartctl -iHAl error -d sat+megaraid,0 /dev/sda
Disque dur 2 : smartctl -iHAl error -d sat+megaraid,1 /dev/sda
Vous trouverez d'autres commandes pour les contrôleurs matériels pris en charge sur la page suivante :
https://www.smartmontools.org/wiki/Supported_RAID-Controllers
Exemple :
[root@localhost ~]# smartctl -iHAl error /dev/sg1 -d areca,1
smartctl 7.0 2018-12-30 r4883 [x86_64-w64-mingw32-2016] (sf-7.0-1)
Copyright (C) 2002-18, Bruce Allen, Christian Franke, www.smartmontools.org
=== START OF INFORMATION SECTION ===
Model Family: Hitachi/HGST Ultrastar 7K2
Device Model: HGST HUS722T1TALA604
Serial Number: WMC6M0JAUEV8
LU WWN Device Id: 5 0014ee 00482c2ec
Firmware Version: RAGNWA07
User Capacity: 1,000,204,886,016 bytes [1.00 TB]
Sector Size: 512 bytes logical/physical
Rotation Rate: 7200 rpm
Form Factor: 3.5 inches
Device is: In smartctl database [for details use: -P show]
ATA Version is: ACS-3 T13/2161-D revision 5
SATA Version is: SATA 3.1, 6.0 Gb/s (current: 6.0 Gb/s)
Local Time is: Thu Jan 17 06:17:05 2019 CAST
SMART support is: Available - device has SMART capability.
SMART support is: Enabled
=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED
SMART Attributes Data Structure revision number: 16
Vendor Specific SMART Attributes with Thresholds:
ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE
1 Raw_Read_Error_Rate 0x002f 200 200 051 Pre-fail Always - 0
3 Spin_Up_Time 0x0027 141 140 021 Pre-fail Always - 3933
4 Start_Stop_Count 0x0032 100 100 000 Old_age Always - 15
5 Reallocated_Sector_Ct 0x0033 200 200 140 Pre-fail Always - 0
7 Seek_Error_Rate 0x002e 200 200 000 Old_age Always - 0
9 Power_On_Hours 0x0032 100 100 000 Old_age Always - 34
10 Spin_Retry_Count 0x0032 100 253 000 Old_age Always - 0
11 Calibration_Retry_Count 0x0032 100 253 000 Old_age Always - 0
12 Power_Cycle_Count 0x0032 100 100 000 Old_age Always - 10
16 Gas_Gauge 0x0022 000 200 000 Old_age Always - 1822115874
183 Runtime_Bad_Block 0x0032 100 100 000 Old_age Always - 0
192 Power-Off_Retract_Count 0x0032 200 200 000 Old_age Always - 6
193 Load_Cycle_Count 0x0032 200 200 000 Old_age Always - 9
194 Temperature_Celsius 0x0022 113 109 000 Old_age Always - 30
196 Reallocated_Event_Count 0x0032 200 200 000 Old_age Always - 0
197 Current_Pending_Sector 0x0032 200 200 000 Old_age Always - 0
198 Offline_Uncorrectable 0x0030 100 253 000 Old_age Offline - 0
199 UDMA_CRC_Error_Count 0x0032 200 200 000 Old_age Always - 0
200 Multi_Zone_Error_Rate 0x0008 100 253 000 Old_age Offline - 0
SMART Error Log Version: 1
No Errors Logged
Interprétation des paramètres
Analysez les informations détaillées que vous venez d'afficher. La première section contient des informations qui vous permettent d'identifier le disque dur. Cette section affiche, par exemple, le modèle de l'appareil, le numéro de série et la capacité du disque dur testé.
Remarque
Les attributs SMART mentionnés sont des exemples valables pour les disques ATA/SATA/SAS. Les disques NVMe utilisent des paramètres d'intégrité différents.
=== START OF INFORMATION SECTION ===
Model Family: Hitachi/HGST Ultrastar 7K2
Device Model: HGST HUS722T1TALA604
Serial Number: WMC6M0JAUEV8
LU WWN Device Id: 5 0014ee 00482c2ec
Firmware Version: RAGNWA07
User Capacity: 1,000,204,886,016 bytes [1.00 TB]
Sector Size: 512 bytes logical/physical
Rotation Rate: 7200 rpm
Form Factor: 3.5 inches
Device is: In smartctl database [for details use: -P show]
ATA Version is: ACS-3 T13/2161-D revision 5
SATA Version is: SATA 3.1, 6.0 Gb/s (current: 6.0 Gb/s)
Local Time is: Thu Jan 17 06:17:05 2019 CAST
SMART support is: Available - device has SMART capability.
SMART support is: Enabled
Dans la deuxième étape, smartctl évalue l'état actuel du disque dur. Si la valeur affichée n'est pas « PASSED », mais par exemple « Failed » ou « UNKNOWN », vous devez faire remplacer le disque dur concerné dans les plus brefs délais.
=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED
La troisième section présente en détail les valeurs SMART calculées. À côté de chaque valeur actuelle exprimée en pourcentage (VALUE), figurent la pire valeur jamais mesurée (WORST) et la valeur seuil correspondante (THRESH). Si la valeur actuelle exprimée en pourcentage (VALUE) ou la pire valeur jamais mesurée (WORST) dépasse la valeur seuil (THRESH), un avertissement SMART s'affiche dans la colonne WHEN_FAILED (par exemple, FAILING_NOW).
SMART Attributes Data Structure revision number: 16
Vendor Specific SMART Attributes with Thresholds:
ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE
1 Raw_Read_Error_Rate 0x002f 200 200 051 Pre-fail Always - 0
3 Spin_Up_Time 0x0027 141 140 021 Pre-fail Always - 3933
4 Start_Stop_Count 0x0032 100 100 000 Old_age Always - 15
5 Reallocated_Sector_Ct 0x0033 200 200 140 Pre-fail Always - 0
7 Seek_Error_Rate 0x002e 200 200 000 Old_age Always - 0
9 Power_On_Hours 0x0032 100 100 000 Old_age Always - 34
10 Spin_Retry_Count 0x0032 100 253 000 Old_age Always - 0
11 Calibration_Retry_Count 0x0032 100 253 000 Old_age Always - 0
12 Power_Cycle_Count 0x0032 100 100 000 Old_age Always - 10
16 Gas_Gauge 0x0022 000 200 000 Old_age Always - 1822115874
183 Runtime_Bad_Block 0x0032 100 100 000 Old_age Always - 0
192 Power-Off_Retract_Count 0x0032 200 200 000 Old_age Always - 6
193 Load_Cycle_Count 0x0032 200 200 000 Old_age Always - 9
194 Temperature_Celsius 0x0022 113 109 000 Old_age Always - 30
196 Reallocated_Event_Count 0x0032 200 200 000 Old_age Always - 0
197 Current_Pending_Sector 0x0032 200 200 000 Old_age Always - 0
198 Offline_Uncorrectable 0x0030 100 253 000 Old_age Offline - 0
199 UDMA_CRC_Error_Count 0x0032 200 200 000 Old_age Always - 0
200 Multi_Zone_Error_Rate 0x0008 100 253 000 Old_age Offline - 0
Les paramètres suivants peuvent indiquer une défaillance imminente du disque dur avant même qu'un avertissement SMART ne s'affiche :
Reallocated_Sector_Ct : ce paramètre indique le nombre de secteurs qui ont déjà été réaffectés en raison d'erreurs de lecture. Lorsqu'un secteur ne peut plus être lu, écrit ou vérifié correctement, le contrôleur lui attribue automatiquement un secteur de remplacement provenant de la zone de réserve du disque dur. Le secteur d'origine, défectueux, est marqué de manière permanente comme défectueux et n'est plus utilisé.
Remarque
Une valeur supérieure à zéro n’est pas nécessairement préoccupante, à condition qu’elle reste stable sur une longue période. Cependant, un indicateur critique d’une défaillance imminente du disque dur est un nombre sans cesse croissant de secteurs réaffectés. Afin de détecter un défaut à un stade précoce, vous devez donc consigner régulièrement cette valeur et, en cas d’augmentation continue, procéder immédiatement au remplacement du disque.
Current_Pending_Sector_Ct : indique le nombre de secteurs instables en attente de remappage. Lorsqu'un secteur ne peut pas être lu ou écrit correctement, il se voit d'abord attribuer le statut « Current Pending Sector ». Dans cet état, le secteur n'est pas réaffecté, car les données qu'il contient sont inconnues. Ce n'est qu'après plusieurs tentatives infructueuses de lecture ou d'écriture qu'un secteur de remplacement est attribué et que le secteur défectueux est définitivement marqué comme illisible. La valeur « Current_Pending_Sector_Ct » est un indicateur important de la nécessité de remplacer un disque dur. Si cette valeur est différente de zéro, cela signifie souvent qu’une panne du disque dur est imminente.
Offline_Uncorrectable : indique le nombre d’erreurs non corrigibles lors des accès en écriture et en lecture aux secteurs.
La dernière section concerne le journal interne du disque dur. Les erreurs y sont consignées lorsque les tâches du serveur n’ont pas été traitées correctement par le disque dur. Si ce paragraphe affiche un nombre d’erreurs d’au moins deux chiffres, vous devez faire remplacer le disque dur dès que possible.
SMART Error Log Version: 1
No Errors Logged
Alternative à smartctl
Si smartctl ne permet pas d'afficher les informations, adaptez la commande suivante en fonction de votre configuration, puis exécutez-la :
Broadcom :
storcli64 /c[numéro du contrôleur]/e[ID du boîtier]/s[ID de l'emplacement] show smart
Exemple :
storcli64 /c0/e16/s4 show smart
Dell :
perccli64 /c[numéro du contrôleur]/e[ID du boîtier]/s[ID de l'emplacement] show smart
Exemple :
perccli64 /c0/e16/s4 show smart
Consulter les fichiers journaux
Pour plus d'informations sur la consultation des fichiers journaux, veuillez vous reporter à la documentation fournie par le fabricant concerné.
Areca
http://areca.starline.de/RaidCards/Documents/Manual_Spec/Software
3ware (désormais Broadcom)
http://www.3ware.com/support/userdocs.asp
Adaptec (désormais Microchip)
https://storage.microsemi.com/en-us/support/
Dell
https://www.dell.com/support/home/en-us
Broadcom
https://www.broadcom.com/products/storage/raid-controllers/
Préparer le remplacement du disque dur
Consulter les informations détaillées relatives au remplacement du disque dur
Afin de pouvoir procéder au remplacement du disque dur défectueux, les informations suivantes sont nécessaires :
Désignation du disque dur dans le RAID
Numéro de série
Modèle
Fichier journal (facultatif)
Créer un journal SMART
Les commandes ci-dessous vous permettent de générer un journal SMART complet :
Systèmes ARECA :
Disque dur 1 : utilisez la commande smartctl -x /dev/sg1 -d areca,1
Disque dur 2 : utilisez la commande smartctl -x /dev/sg1 -d areca,2
Systèmes LSI / 3Ware :
Disque dur 1 : utilisez la commande smartctl -x /dev/twe0 -d 3ware,0
Disque dur 2 : utilisez la commande smartctl -x /dev/twe0 -d 3ware,1
Systèmes Adaptec :
Disque dur 1 : utilisez la commande smartctl -x /dev/sg2 -d sat
Disque dur 2 : utilisez la commande smartctl -x /dev/sg3 -d sat
Disque dur 3 : utilisez la commande smartctl -x /dev/sg4 -d sat
Disque dur 4 : utilisez la commande smartctl -x /dev/sg5 -d sat
Systèmes Dell :
Disque dur 1 : utilisez la commande smartctl -x -d sat+megaraid,0 /dev/sda
Disque dur 2 : utilisez la commande smartctl -x -d sat+megaraid,1 /dev/sda
Systèmes Broadcom :
Disque dur 1 : utilisez la commande smartctl -x -d sat+megaraid,0 /dev/sda
Disque dur 2 : utilisez la commande smartctl -x -d sat+megaraid,1 /dev/sda
Remarques
Si le journal SMART a été généré comme décrit ci-dessus, ces informations suffisent. Vous pouvez ensuite procéder au remplacement du disque dur défectueux. Pour ce faire, veuillez prendre contact avec le Service Client IONOS.
Si vous ne parvenez pas à obtenir le numéro de série du disque dur défectueux à l'aide de smartctl, vous pouvez également communiquer au service client le numéro de série du ou des disques durs en bon état.
Si vous ne parvenez pas à obtenir les informations nécessaires au remplacement et que vous souhaitez faire remplacer le disque dur, le matériel doit être contrôlé avant le remplacement. Pendant ce contrôle, le serveur est généralement temporairement indisponible. Si un défaut du disque dur est constaté lors de ce contrôle, celui-ci sera remplacé.
Organiser le remplacement du disque dur
Vous pouvez ensuite demander le remplacement du disque dur défectueux. Pour ce faire, veuillez prendre contact avec le Service Client IONOS. Vous trouverez ses coordonnées sur la page suivante : Service Client IONOS
Étapes à suivre après le remplacement du disque dur
Une fois le disque dur défectueux remplacé, la reconstruction du système RAID démarre généralement automatiquement. Veuillez vérifier si la reconstruction du système RAID a bien démarré et s'effectue correctement. Pour cela, surveillez la progression à l'aide de l'outil du contrôleur :
Broadcom :
storcli64 /c0 /eall /sall show rebuild
Dell :
perccli64 /c0 /eall /sall show rebuild
Vous trouverez de plus amples informations sur la surveillance des RAID matériels dans l'article suivant du Centre d'Assistance : Surveiller / reconstruire un RAID matériel (Linux)