Si vous recevez une notification signalant une défaillance du disque dur ou si vous constatez des anomalies au niveau du système, il est nécessaire d'agir rapidement afin de rétablir la redondance de votre matrice RAID. Dans cet article, vous apprendrez comment identifier un disque dur défectueux et préparer le serveur au remplacement du disque défectueux.

Remarque

  • Cet article suppose des connaissances de base en administration de serveurs sous Linux. Si vous avez des questions concernant le remplacement d'un disque dur défectueux ou si vous avez besoin d'aide, veuillez prendre contact avec le Service Client IONOS. Vous trouverez ses coordonnées sur la page suivante : Service Client IONOS

  • Cet article décrit principalement le diagnostic et la préparation du remplacement de disques SATA/SAS dans des systèmes RAID matériels. Dans le cas des disques NVMe, les commandes, les noms de périphériques, les valeurs SMART/d'intégrité et l'identification des disques défectueux peuvent varier.

Afin de garantir une fiabilité maximale, il est nécessaire que vous surveilliez le RAID matériel de votre Serveur Dédié ou Serveur Bare Metal. Si vous recevez un e-mail de notification signalant un disque dur défectueux ou si vous constatez vous-même une défaillance d’un disque dur, vous devez identifier le disque dur défectueux et préparer le serveur en vue du remplacement du disque défectueux. Prenez ensuite contact avec le Service Client IONOS afin d'organiser le remplacement du disque dur.

Attention

Les systèmes RAID offrent une meilleure fiabilité et/ou une vitesse plus élevée. Ils ne remplacent toutefois pas les sauvegardes régulières. Afin d'éviter toute perte de données, nous vous recommandons d'effectuer régulièrement une sauvegarde. Veillez également à effectuer une sauvegarde avant de suivre les étapes suivantes afin de garantir la sécurité de vos données.

Vous trouverez plus d'informations sur la création de sauvegardes dans la catégorie suivante du Centre d'Assistance IONOS : Solutions de sauvegarde
 

Contrôleurs RAID matériels : informations générales

Un contrôleur RAID matériel est un contrôleur physique intégré au serveur sous forme de composant matériel. Ce contrôleur dispose de son propre processeur pour le calcul des opérations RAID. Ce processeur organise et gère l'espace de stockage. Ainsi, le processeur central (CPU) du serveur n'est pas sollicité par les calculs RAID. Avec les contrôleurs RAID matériels, la fonctionnalité RAID est indépendante du système d'exploitation. Ils sont gérés via des programmes de ligne de commande spécifiques (Command Line Interface, ou CLI), qui peuvent varier selon le fabricant et le modèle.

Diagnostic des pannes de disque dur

Pour détecter les défaillances des disques durs, nous vous recommandons d'utiliser le programme smartctl. smartctl est un programme en ligne de commande permettant de surveiller les disques à l'aide de la technologie SMART (Self-Monitoring, Analysis and Reporting Technology). Ce programme vous permet de vérifier si un disque dur est défectueux. Il fait partie intégrante de Smartmontools. Les Smartmontools sont disponibles sous forme de paquets pour de nombreuses distributions Linux. Vous trouverez de plus amples informations sur la page suivante : Smartmontools Packages

Remarque

Dans certains cas, il peut arriver qu'un défaut du disque dur ne puisse pas être détecté à l'aide des valeurs SMART. C'est pourquoi nous vous recommandons d'analyser également les journaux système.

Installer Smartctl

  • Pour installer smartctl, connectez-vous au serveur en tant qu'administrateur.

  • Installez les paquets nécessaires en fonction de votre distribution :

    AlmaLinux 9 et 10 ainsi que Rocky Linux 9 et 10 :

    dnf install smartmontools

    Debian 12 et 13, ainsi qu'Ubuntu 24.04 et 26.04 :

    sudo apt install smartmontools

 

Identifier le type de contrôleur matériel

Pour vérifier quel contrôleur matériel est installé sur votre serveur, vous pouvez utiliser le programme lshw. Ce programme fournit des informations détaillées sur les composants matériels.

Pour installer ce programme, saisissez la commande suivante :

AlmaLinux 9 et 10 ainsi que Rocky Linux 9 et 10 :

dnf install lshw

Debian 12 et 13, ainsi qu'Ubuntu 24.04 et 26.04 :

sudo apt-get install lshw

 

Afficher les informations matérielles

Pour afficher un résumé des informations matérielles, saisissez la commande suivante :

lshw –short

Pour exporter les informations matérielles dans un fichier texte, saisissez la commande suivante :

lshw > lshw_output.txt

Dans l'exemple suivant, un contrôleur matériel PERC H330 est intégré au serveur :


			root@829F6DF:~# lshw -short
H/W path             Device     Class          Description
==========================================================
                                system         PowerEdge R230 (SKU=NotProvided;ModelName=PowerEdge R230)
/0                              bus            0DWX9P
/0/0                            memory         64KiB BIOS
/0/400                          processor      Intel(R) Xeon(R) CPU E3-1270 v6 @ 3.80GHz
/0/400/700                      memory         256KiB L1 cache
/0/400/701                      memory         1MiB L2 cache
/0/400/702                      memory         8MiB L3 cache
/0/1000                         memory         32GiB System Memory
/0/1000/0                       memory         16GiB DIMM DDR4 Synchronous Unbuffered (Unregistered) 2133 MHz (0.5 ns)
/0/1000/1                       memory         16GiB DIMM DDR4 Synchronous Unbuffered (Unregistered) 2133 MHz (0.5 ns)
/0/1000/2                       memory         [empty]
/0/1000/3                       memory         [empty]
/0/100                          bridge         Intel Corporation
/0/100/1                        bridge         Skylake PCIe Controller (x16)
/0/100/1/0           scsi0      storage        MegaRAID SAS-3 3008 [Fury]
/0/100/1/0/2.0.0     /dev/sda   disk           799GB PERC H330 Adp
/0/100/1/0/2.0.0/1   /dev/sda1  volume         2047KiB BIOS Boot partition
/0/100/1/0/2.0.0/2   /dev/sda2  volume         27GiB EXT3 volume
/0/100/1/0/2.0.0/3   /dev/sda3  volume         9536MiB Linux swap volume
/0/100/1/0/2.0.0/4   /dev/sda4  volume         707GiB LVM Physical Volume
/0/100/1.1                      bridge         Skylake PCIe Controller (x8)
/0/100/14                       bus            Sunrise Point-H USB 3.0 xHCI Controller
/0/100/14/0          usb1       bus            xHCI Host Controller
/0/100/14/0/3                   bus            Gadget USB HUB
/0/100/14/1          usb2       bus            xHCI Host Controller
/0/100/14.2                     generic        Sunrise Point-H Thermal subsystem
/0/100/16                       communication  Sunrise Point-H CSME HECI #1
/0/100/16.1                     communication  Sunrise Point-H CSME HECI #2
/0/100/17                       storage        Sunrise Point-H SATA controller [AHCI mode]
/0/100/1d                       bridge         Sunrise Point-H PCI Express Root Port #9
/0/100/1d/0          eth0       network        NetXtreme BCM5720 Gigabit Ethernet PCIe
/0/100/1d/0.1        eth1       network        NetXtreme BCM5720 Gigabit Ethernet PCIe
/0/100/1d.2                     bridge         Sunrise Point-H PCI Express Root Port #11
/0/100/1d.2/0                   bridge         SH7758 PCIe Switch [PS]
/0/100/1d.2/0/0                 bridge         SH7758 PCIe Switch [PS]
/0/100/1d.2/0/0/0               bridge         SH7758 PCIe-PCI Bridge [PPB]
/0/100/1d.2/0/0/0/0             display        G200eR2
/0/100/1f                       bridge         Sunrise Point-H LPC Controller
/0/100/1f.2                     memory         Memory controller
/0/100/1f.4                     bus            Sunrise Point-H SMBus
		
Programmes de gestion des contrôleurs RAID

Les logiciels nécessaires à la gestion des contrôleurs RAID correspondants sont installés par défaut. Si ces logiciels ne sont pas installés sur votre serveur, vous trouverez dans l'article suivant des liens vous permettant de les télécharger : Surveiller et reconstruire un RAID matériel (Linux)

Utiliser l'outil CLI pour afficher l'état de la matrice RAID

Utilisez l'outil CLI approprié pour consulter l'état de la matrice RAID (RAID 1, 5 ou 6) et des disques physiques.

Le contrôleur RAID Broadcom est géré et piloté à l'aide de l'outil en ligne de commande StorCLI. En fonction de la génération du contrôleur et du système d'exploitation, utilisez :

storcli64 : pour les contrôleurs Broadcom/LSI courants (par exemple MegaRAID, AVAGO)
storcli2 : pour la dernière génération de contrôleurs tri-mode (NVMe/SAS/SATA)

Le contrôleur RAID Dell est géré et piloté à l'aide de l'outil en ligne de commande PERCCLI. En fonction de la génération du contrôleur et du système d'exploitation, utilisez :

perccli64 : pour les contrôleurs RAID Dell des anciennes générations
perccli2 : pour la dernière génération de contrôleurs RAID Dell (par exemple, les systèmes GraniteRapids/Blackwell)

Remarque

  • Dans l'exemple suivant, nous utilisons storcli64. Si vous utilisez un contrôleur Dell ou un système plus récent, remplacez la commande par perccli64, storcli2 ou perccli2. La syntaxe reste pratiquement identique.

  • Si vous ne savez pas quel outil en ligne de commande est prévu pour votre contrôleur RAID, testez les commandes ci-dessous en y ajoutant « show ». L'exécution d'un « mauvais » outil entraînera simplement l'affichage d'un message d'erreur, sans causer de dommages.

Identifier un disque dur défectueux

La commande suivante vous permet d'identifier le disque dur défectueux : storcli64 /call show

Les informations suivantes, entre autres, s'affichent alors :

Controller = 0 
Status = Success
... 
Drive Groups = 1

TOPOLOGY : 
========
-----------------------------------------------------------------------------
DG Arr Row EID:Slot DID Type  State BT Size PDC  PI SED DS3  FSpace      TR 
-----------------------------------------------------------------------------
0 -   -   -        -   RAID1 Optl  N  931.000 GB dflt N  N   dflt N      N  
0 0   -   -        -   RAID1 Optl  N  931.000 GB dflt N  N   dflt N      N  
0 0   0   16:4     0   DRIVE Onln  N  931.000 GB dflt N  N   dflt -      N  
0 0   1   16:6     1   DRIVE Onln  N  931.000 GB dflt N  N   dflt -      N  
-----------------------------------------------------------------------------

DG=Disk Group Index|Arr=Array Index|Row=Row Index|EID=Enclosure Device ID
DID=Device ID|Type=Drive or RAID Type|Onln=Online|Rbld=Rebuild|Optl=Optimal
Dgrd=Degraded|Pdgd=Partially degraded|Offln=Offline|BT=Background Task Active PDC=PD Cache|PI=Protection Info|SED=Self Encrypting Drive|Frgn=Foreign DS3=Dimmer Switch 3|dflt=Default|Msng=Missing|FSpace=Free Space Present TR=Transport Ready

Virtual Drives = 1

Vérifiez le numéro du contrôleur. En règle générale, l'entrée « Controller = 0 » s'affiche. Si un autre numéro s'affiche, vous devez en tenir compte dans les commandes relatives au contrôleur RAID matériel. Recherchez ensuite dans la PD LIST les informations Slt (emplacement) et State. Un disque dur en bon état affiche le statut Onln (en ligne).

Un disque dur défectueux est souvent signalé comme « Failed », « Missing », « Offline » ou « Degraded ». Notez l 'EID:Slt (identifiant du boîtier et numéro d'emplacement), par exemple 252:1.

Afficher les informations relatives au disque dur

Pour consulter les informations relatives au disque dur à l'aide de smartctl, vous devez toujours spécifier la commande correspondante en combinaison avec une option et un périphérique cible. Le périphérique cible dépend du fabricant du contrôleur.

Les commandes ci-dessous vous permettent d'afficher les informations relatives au disque dur nécessaires au diagnostic :

ARECA :

  • Disque dur 1 : smartctl -iHAl error /dev/sg1 -d areca,1

  • Disque dur 2 : smartctl -iHAl error /dev/sg1 -d areca,2

LSI / 3Ware :

  • Disque dur 1 : smartctl -iHAl error /dev/twe0 -d 3ware,0

  • Disque dur 2 : smartctl -iHAl error /dev/twe0 -d 3ware,1

Adaptec :

  • Disque dur 1 : smartctl -iHAl error /dev/sg2 -d sat

  • Disque dur 2 : smartctl -iHAl error /dev/sg3 -d sat

  • Disque dur 3 : smartctl -iHAl error /dev/sg4 -d sat

  • Disque dur 4 : smartctl -iHAl error /dev/sg5 -d sat

Dell :

  • Disque dur 1 : smartctl -iHAl error -d sat+megaraid,0 /dev/sda

  • Disque dur 2 : smartctl -iHAl error -d sat+megaraid,1 /dev/sda

Broadcom :

  • Disque dur 1 : smartctl -iHAl error -d sat+megaraid,0 /dev/sda

  • Disque dur 2 : smartctl -iHAl error -d sat+megaraid,1 /dev/sda

Vous trouverez d'autres commandes pour les contrôleurs matériels pris en charge sur la page suivante :

https://www.smartmontools.org/wiki/Supported_RAID-Controllers

Exemple :


					[root@localhost ~]# smartctl -iHAl error /dev/sg1 -d areca,1

smartctl 7.0 2018-12-30 r4883 [x86_64-w64-mingw32-2016] (sf-7.0-1)
Copyright (C) 2002-18, Bruce Allen, Christian Franke, www.smartmontools.org

=== START OF INFORMATION SECTION ===
Model Family:     Hitachi/HGST Ultrastar 7K2
Device Model:     HGST HUS722T1TALA604
Serial Number:    WMC6M0JAUEV8
LU WWN Device Id: 5 0014ee 00482c2ec
Firmware Version: RAGNWA07
User Capacity:    1,000,204,886,016 bytes [1.00 TB]
Sector Size:      512 bytes logical/physical
Rotation Rate:    7200 rpm
Form Factor:      3.5 inches
Device is:        In smartctl database [for details use: -P show]
ATA Version is:   ACS-3 T13/2161-D revision 5
SATA Version is:  SATA 3.1, 6.0 Gb/s (current: 6.0 Gb/s)
Local Time is:    Thu Jan 17 06:17:05 2019 CAST
SMART support is: Available - device has SMART capability.
SMART support is: Enabled

=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED

SMART Attributes Data Structure revision number: 16
Vendor Specific SMART Attributes with Thresholds:
ID# ATTRIBUTE_NAME          FLAG     VALUE WORST THRESH TYPE      UPDATED  WHEN_FAILED RAW_VALUE
  1 Raw_Read_Error_Rate     0x002f   200   200   051    Pre-fail  Always       -       0
  3 Spin_Up_Time            0x0027   141   140   021    Pre-fail  Always       -       3933
  4 Start_Stop_Count        0x0032   100   100   000    Old_age   Always       -       15
  5 Reallocated_Sector_Ct   0x0033   200   200   140    Pre-fail  Always       -       0
  7 Seek_Error_Rate         0x002e   200   200   000    Old_age   Always       -       0
  9 Power_On_Hours          0x0032   100   100   000    Old_age   Always       -       34
 10 Spin_Retry_Count        0x0032   100   253   000    Old_age   Always       -       0
 11 Calibration_Retry_Count 0x0032   100   253   000    Old_age   Always       -       0
 12 Power_Cycle_Count       0x0032   100   100   000    Old_age   Always       -       10
 16 Gas_Gauge               0x0022   000   200   000    Old_age   Always       -       1822115874
183 Runtime_Bad_Block       0x0032   100   100   000    Old_age   Always       -       0
192 Power-Off_Retract_Count 0x0032   200   200   000    Old_age   Always       -       6
193 Load_Cycle_Count        0x0032   200   200   000    Old_age   Always       -       9
194 Temperature_Celsius     0x0022   113   109   000    Old_age   Always       -       30
196 Reallocated_Event_Count 0x0032   200   200   000    Old_age   Always       -       0
197 Current_Pending_Sector  0x0032   200   200   000    Old_age   Always       -       0
198 Offline_Uncorrectable   0x0030   100   253   000    Old_age   Offline      -       0
199 UDMA_CRC_Error_Count    0x0032   200   200   000    Old_age   Always       -       0
200 Multi_Zone_Error_Rate   0x0008   100   253   000    Old_age   Offline      -       0

SMART Error Log Version: 1
No Errors Logged
		

Interprétation des paramètres

Analysez les informations détaillées que vous venez d'afficher. La première section contient des informations qui vous permettent d'identifier le disque dur. Cette section affiche, par exemple, le modèle de l'appareil, le numéro de série et la capacité du disque dur testé.

Remarque

Les attributs SMART mentionnés sont des exemples valables pour les disques ATA/SATA/SAS. Les disques NVMe utilisent des paramètres d'intégrité différents.


						=== START OF INFORMATION SECTION ===
Model Family:     Hitachi/HGST Ultrastar 7K2
Device Model:     HGST HUS722T1TALA604
Serial Number:    WMC6M0JAUEV8
LU WWN Device Id: 5 0014ee 00482c2ec
Firmware Version: RAGNWA07
User Capacity:    1,000,204,886,016 bytes [1.00 TB]
Sector Size:      512 bytes logical/physical
Rotation Rate:    7200 rpm
Form Factor:      3.5 inches
Device is:        In smartctl database [for details use: -P show]
ATA Version is:   ACS-3 T13/2161-D revision 5
SATA Version is:  SATA 3.1, 6.0 Gb/s (current: 6.0 Gb/s)
Local Time is:    Thu Jan 17 06:17:05 2019 CAST
SMART support is: Available - device has SMART capability.
SMART support is: Enabled
		

Dans la deuxième étape, smartctl évalue l'état actuel du disque dur. Si la valeur affichée n'est pas « PASSED », mais par exemple « Failed » ou « UNKNOWN », vous devez faire remplacer le disque dur concerné dans les plus brefs délais.


			
			=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED
		

La troisième section présente en détail les valeurs SMART calculées. À côté de chaque valeur actuelle exprimée en pourcentage (VALUE), figurent la pire valeur jamais mesurée (WORST) et la valeur seuil correspondante (THRESH). Si la valeur actuelle exprimée en pourcentage (VALUE) ou la pire valeur jamais mesurée (WORST) dépasse la valeur seuil (THRESH), un avertissement SMART s'affiche dans la colonne WHEN_FAILED (par exemple, FAILING_NOW).


			SMART Attributes Data Structure revision number: 16
Vendor Specific SMART Attributes with Thresholds:
ID# ATTRIBUTE_NAME          FLAG     VALUE WORST THRESH TYPE      UPDATED  WHEN_FAILED RAW_VALUE
  1 Raw_Read_Error_Rate     0x002f   200   200   051    Pre-fail  Always       -       0
  3 Spin_Up_Time            0x0027   141   140   021    Pre-fail  Always       -       3933
  4 Start_Stop_Count        0x0032   100   100   000    Old_age   Always       -       15
  5 Reallocated_Sector_Ct   0x0033   200   200   140    Pre-fail  Always       -       0
  7 Seek_Error_Rate         0x002e   200   200   000    Old_age   Always       -       0
  9 Power_On_Hours          0x0032   100   100   000    Old_age   Always       -       34
 10 Spin_Retry_Count        0x0032   100   253   000    Old_age   Always       -       0
 11 Calibration_Retry_Count 0x0032   100   253   000    Old_age   Always       -       0
 12 Power_Cycle_Count       0x0032   100   100   000    Old_age   Always       -       10
 16 Gas_Gauge               0x0022   000   200   000    Old_age   Always       -       1822115874
183 Runtime_Bad_Block       0x0032   100   100   000    Old_age   Always       -       0
192 Power-Off_Retract_Count 0x0032   200   200   000    Old_age   Always       -       6
193 Load_Cycle_Count        0x0032   200   200   000    Old_age   Always       -       9
194 Temperature_Celsius     0x0022   113   109   000    Old_age   Always       -       30
196 Reallocated_Event_Count 0x0032   200   200   000    Old_age   Always       -       0
197 Current_Pending_Sector  0x0032   200   200   000    Old_age   Always       -       0
198 Offline_Uncorrectable   0x0030   100   253   000    Old_age   Offline      -       0
199 UDMA_CRC_Error_Count    0x0032   200   200   000    Old_age   Always       -       0
200 Multi_Zone_Error_Rate   0x0008   100   253   000    Old_age   Offline      -       0
		

Les paramètres suivants peuvent indiquer une défaillance imminente du disque dur avant même qu'un avertissement SMART ne s'affiche :

Reallocated_Sector_Ct : ce paramètre indique le nombre de secteurs qui ont déjà été réaffectés en raison d'erreurs de lecture. Lorsqu'un secteur ne peut plus être lu, écrit ou vérifié correctement, le contrôleur lui attribue automatiquement un secteur de remplacement provenant de la zone de réserve du disque dur. Le secteur d'origine, défectueux, est marqué de manière permanente comme défectueux et n'est plus utilisé.

Remarque

Une valeur supérieure à zéro n’est pas nécessairement préoccupante, à condition qu’elle reste stable sur une longue période. Cependant, un indicateur critique d’une défaillance imminente du disque dur est un nombre sans cesse croissant de secteurs réaffectés. Afin de détecter un défaut à un stade précoce, vous devez donc consigner régulièrement cette valeur et, en cas d’augmentation continue, procéder immédiatement au remplacement du disque.

Current_Pending_Sector_Ct : indique le nombre de secteurs instables en attente de remappage. Lorsqu'un secteur ne peut pas être lu ou écrit correctement, il se voit d'abord attribuer le statut « Current Pending Sector ». Dans cet état, le secteur n'est pas réaffecté, car les données qu'il contient sont inconnues. Ce n'est qu'après plusieurs tentatives infructueuses de lecture ou d'écriture qu'un secteur de remplacement est attribué et que le secteur défectueux est définitivement marqué comme illisible. La valeur « Current_Pending_Sector_Ct » est un indicateur important de la nécessité de remplacer un disque dur. Si cette valeur est différente de zéro, cela signifie souvent qu’une panne du disque dur est imminente.

Offline_Uncorrectable : indique le nombre d’erreurs non corrigibles lors des accès en écriture et en lecture aux secteurs.

La dernière section concerne le journal interne du disque dur. Les erreurs y sont consignées lorsque les tâches du serveur n’ont pas été traitées correctement par le disque dur. Si ce paragraphe affiche un nombre d’erreurs d’au moins deux chiffres, vous devez faire remplacer le disque dur dès que possible.


						SMART Error Log Version: 1
No Errors Logged
		
Alternative à smartctl

Si smartctl ne permet pas d'afficher les informations, adaptez la commande suivante en fonction de votre configuration, puis exécutez-la :

Broadcom :

storcli64 /c[numéro du contrôleur]/e[ID du boîtier]/s[ID de l'emplacement] show smart

Exemple :

storcli64 /c0/e16/s4 show smart

Dell :

perccli64 /c[numéro du contrôleur]/e[ID du boîtier]/s[ID de l'emplacement] show smart

Exemple :

perccli64 /c0/e16/s4 show smart

Consulter les fichiers journaux

Pour plus d'informations sur la consultation des fichiers journaux, veuillez vous reporter à la documentation fournie par le fabricant concerné.

Areca
http://areca.starline.de/RaidCards/Documents/Manual_Spec/Software

3ware (désormais Broadcom)
http://www.3ware.com/support/userdocs.asp

Adaptec (désormais Microchip)
https://storage.microsemi.com/en-us/support/

Dell
https://www.dell.com/support/home/en-us

Broadcom
https://www.broadcom.com/products/storage/raid-controllers/

Préparer le remplacement du disque dur

Consulter les informations détaillées relatives au remplacement du disque dur

Afin de pouvoir procéder au remplacement du disque dur défectueux, les informations suivantes sont nécessaires :

  • Désignation du disque dur dans le RAID

  • Numéro de série

  • Modèle

  • Fichier journal (facultatif)

Créer un journal SMART

Les commandes ci-dessous vous permettent de générer un journal SMART complet :

Systèmes ARECA :

  • Disque dur 1 : utilisez la commande smartctl -x /dev/sg1 -d areca,1

  • Disque dur 2 : utilisez la commande smartctl -x /dev/sg1 -d areca,2

Systèmes LSI / 3Ware :

  • Disque dur 1 : utilisez la commande smartctl -x /dev/twe0 -d 3ware,0

  • Disque dur 2 : utilisez la commande smartctl -x /dev/twe0 -d 3ware,1

Systèmes Adaptec :

  • Disque dur 1 : utilisez la commande smartctl -x /dev/sg2 -d sat

  • Disque dur 2 : utilisez la commande smartctl -x /dev/sg3 -d sat

  • Disque dur 3 : utilisez la commande smartctl -x /dev/sg4 -d sat

  • Disque dur 4 : utilisez la commande smartctl -x /dev/sg5 -d sat

Systèmes Dell :

  • Disque dur 1 : utilisez la commande smartctl -x -d sat+megaraid,0 /dev/sda

  • Disque dur 2 : utilisez la commande smartctl -x -d sat+megaraid,1 /dev/sda

Systèmes Broadcom :

  • Disque dur 1 : utilisez la commande smartctl -x -d sat+megaraid,0 /dev/sda

  • Disque dur 2 : utilisez la commande smartctl -x -d sat+megaraid,1 /dev/sda

Remarques

  • Si le journal SMART a été généré comme décrit ci-dessus, ces informations suffisent. Vous pouvez ensuite procéder au remplacement du disque dur défectueux. Pour ce faire, veuillez prendre contact avec le Service Client IONOS.

  • Si vous ne parvenez pas à obtenir le numéro de série du disque dur défectueux à l'aide de smartctl, vous pouvez également communiquer au service client le numéro de série du ou des disques durs en bon état.

  • Si vous ne parvenez pas à obtenir les informations nécessaires au remplacement et que vous souhaitez faire remplacer le disque dur, le matériel doit être contrôlé avant le remplacement. Pendant ce contrôle, le serveur est généralement temporairement indisponible. Si un défaut du disque dur est constaté lors de ce contrôle, celui-ci sera remplacé.

Organiser le remplacement du disque dur

Vous pouvez ensuite demander le remplacement du disque dur défectueux. Pour ce faire, veuillez prendre contact avec le Service Client IONOS. Vous trouverez ses coordonnées sur la page suivante : Service Client IONOS

Étapes à suivre après le remplacement du disque dur

Une fois le disque dur défectueux remplacé, la reconstruction du système RAID démarre généralement automatiquement. Veuillez vérifier si la reconstruction du système RAID a bien démarré et s'effectue correctement. Pour cela, surveillez la progression à l'aide de l'outil du contrôleur :

Broadcom :

storcli64 /c0 /eall /sall show rebuild

Dell :

perccli64 /c0 /eall /sall show rebuild

Vous trouverez de plus amples informations sur la surveillance des RAID matériels dans l'article suivant du Centre d'Assistance : Surveiller / reconstruire un RAID matériel (Linux)