Le RAID ne sauvegarde rien : ce qu'il protège, et les six risques qu'il ignore

Le RAID couvre exactement un scénario : la panne d'un disque. Suppression, corruption, rançongiciel, vol, erreur de manipulation : il ne fait rien. Et la reconstruction est le moment où l'on perd des grappes entières.

« Mes données sont en RAID, elles sont protégées. » Le raccourci est si répandu qu'il en paraît raisonnable. Il repose pourtant sur une confusion de nature entre deux propriétés qui n'ont presque rien à voir.

Ce que le RAID fait réellement

Le RAID répartit les données sur plusieurs disques avec de la redondance, de sorte que la perte d'un disque — parfois deux selon le niveau — n'interrompe pas le service. Vous remplacez l'élément défaillant, la grappe se reconstruit, personne n'a rien remarqué.

C'est de la disponibilité, et c'est précieux : cela évite une immobilisation et une restauration complète à chaque disque mort.

Mais notez ce que cela implique : il n'existe qu'une seule version de vos données, la version courante. Le RAID la maintient accessible malgré une panne matérielle. Il ne conserve aucun état antérieur.

Les six scénarios qu'il ne couvre pas

La suppression. Vous effacez un répertoire par erreur. Le RAID exécute la suppression sur tous les disques, fidèlement et instantanément. La redondance ne conserve pas d'ancienne version.

La corruption applicative. Une base de données écrit des données incohérentes, une mise à jour ratée détruit une configuration : le RAID stocke fidèlement ce qui lui est donné. Il ne juge pas le contenu.

Le rançongiciel. Le chiffrement est une écriture légitime. Le RAID l'applique sur toute la grappe, sans ralentir. La redondance sert ici l'attaquant.

Le vol, l'incendie, le dégât des eaux. Tous les disques sont dans le même boîtier, au même endroit. Un événement physique les emporte ensemble.

L'erreur de commande. Un formatage sur le mauvais volume, un partitionnement sur le mauvais périphérique : c'est appliqué à la grappe entière.

La corruption silencieuse. Un bloc s'altère sans que personne ne le remarque. Un RAID classique n'a en général aucun moyen de savoir quelle copie est la bonne — il peut même propager la mauvaise lors d'une reconstruction. Seuls les systèmes de fichiers à sommes de contrôle détectent et corrigent réellement ce cas, et c'est une propriété du système de fichiers, pas du RAID.

La reconstruction : le moment le plus dangereux

Voici le point que les discussions sur les niveaux de RAID escamotent le plus souvent.

Un disque meurt, vous le remplacez, la reconstruction démarre. Pour recalculer les données manquantes, le système doit lire l'intégralité des disques survivants. C'est la sollicitation la plus intense qu'ils connaîtront, pendant des heures voire des jours sur de grosses capacités.

Or ces disques ont le même âge, viennent souvent du même lot, et ont subi exactement la même charge depuis le premier jour. Ils sont dans le même état d'usure que celui qui vient de lâcher.

Si un secteur illisible traîne quelque part, la reconstruction le rencontrera — et sur une grappe ne tolérant qu'une panne, elle échoue. On perd alors toute la grappe, pas un disque.

Précaution simple : panachez les lots à l'achat, voire les modèles. Des disques qui n'ont pas vieilli ensemble ne tombent pas ensemble. C'est une des rares mesures gratuites en fiabilité.

Le contrôleur, point de défaillance oublié

Sur un RAID matériel, la carte contrôleur écrit ses métadonnées dans un format qui lui est propre. Si elle tombe, il faut souvent un modèle compatible pour relire la grappe. Sur du matériel ancien, cela peut signifier chercher une pièce sur le marché de l'occasion — avec des disques parfaitement intacts et inexploitables.

Un RAID logiciel géré par le système d'exploitation n'a pas ce défaut : les disques se remontent sur n'importe quelle machine capable de faire tourner le même système. Pour un homelab, où l'on ne garde pas une carte de rechange sous la main, c'est un argument décisif.

Alors, faut-il du RAID ?

Oui — pour ce qu'il fait. Il évite une immobilisation à chaque panne de disque, et sur une machine qui rend un service permanent, c'est un vrai confort.

Simplement, la question à se poser n'est pas « suis-je protégé ? » mais « de quoi suis-je protégé ? ». Le RAID répond à un seul scénario sur sept. Les six autres exigent des copies indépendantes, versionnées, dont au moins une hors de portée de la machine.

Et si vous devez choisir entre les deux faute de budget, le choix est clair : une sauvegarde sans RAID vaut mieux qu'un RAID sans sauvegarde. Le premier cas vous coûte une interruption de service. Le second vous coûte vos données.

Questions fréquentes

Quelle est la différence entre disponibilité et sauvegarde ?
La disponibilité répond à « le service continue-t-il de fonctionner malgré une panne ? ». La sauvegarde répond à « puis-je récupérer mes données après un désastre ? ». Le RAID adresse la première question uniquement : un disque meurt, le service continue, vous remplacez sans interruption. Il n'apporte aucune réponse à la seconde, parce qu'il n'existe qu'une seule version des données — la version courante, avec ses erreurs incluses.
Pourquoi la reconstruction est-elle si risquée ?
Parce qu'elle impose de lire l'intégralité des disques restants pour recalculer les données manquantes. C'est la sollicitation la plus intense qu'ils subiront jamais, appliquée à des disques du même âge, du même lot, ayant subi la même charge. Si un secteur illisible se trouve quelque part sur l'un d'eux, il sera rencontré — et sur une grappe ne tolérant qu'une seule panne, la reconstruction échoue. Statistiquement, c'est le moment le plus dangereux de la vie d'une grappe.
Faut-il éviter d'acheter tous ses disques en même temps ?
C'est une précaution réelle et peu coûteuse. Des disques du même modèle, du même lot de production, mis en service le même jour et soumis à la même charge partagent leurs caractéristiques de vieillissement. Une seconde panne peu après la première n'est alors pas de la malchance, c'est la conséquence attendue. Panacher les lots, voire les modèles, désynchronise les courbes de défaillance.
Un RAID logiciel est-il moins fiable qu'une carte contrôleur ?
Généralement non, et il présente un avantage décisif en récupération. Une carte contrôleur écrit des métadonnées dans un format qui lui est propre : si elle tombe et que vous ne retrouvez pas un modèle compatible, la grappe peut devenir illisible alors que tous les disques sont intacts. Un RAID logiciel géré par le système se remonte sur n'importe quelle machine capable de faire tourner le même système. Pour un homelab, c'est un argument sérieux.
Le RAID protège-t-il de la corruption silencieuse des données ?
Un RAID classique, non : il stocke fidèlement ce qu'on lui donne, y compris des données déjà corrompues, et n'a en général aucun moyen de savoir laquelle des copies est la bonne. Les systèmes de fichiers à sommes de contrôle intégrées changent la donne : ils vérifient chaque bloc à la lecture, détectent l'altération et la réparent à partir de la redondance. C'est une propriété du système de fichiers, pas du RAID.

Cet article vous a plu ?

Commentaires

Morgann Riu

Expert en cybersécurité et administration Linux. J'aide les entreprises à sécuriser et optimiser leurs infrastructures critiques.

Retour au blog

Checklist Sécurité Linux

30 points essentiels pour sécuriser un serveur Linux. Recevez aussi les nouveaux tutoriels par email.

Pas de spam. Désabonnement en 1 clic.