Français
Électronique industrielle

S.M.A.R.T.

Acronyme de « self-monitoring, analysis and reporting technology »: un système de surveillance inclus dans les disques durs et les SSD des ordinateurs afin de détecter et de signaler divers indicateurs de fiabilité du disque dans le but d'anticiper les pannes matérielles imminentes.

S.M.A.R.T. : rapport sur l'état de santé du disque dur depuis le disque lui-même

Le S.M.A.R.T. est un micrologiciel intégré aux périphériques de stockage, disques durs et disques SSD, qui mesure en continu les paramètres physiques et électriques pendant le fonctionnement et les signale au système hôte. Le disque ne cesse pas de fonctionner lorsque les valeurs dérivent; il enregistre plutôt les tendances de dégradation afin que la défaillance puisse être prédite avant que la perte de données ne se produise. Un technicien ou un logiciel de surveillance lit ces attributs via des protocoles standard, généralement ATA (pour les HDD) ou NVMe (pour les SSD), pour évaluer la durée de vie utile restante.

Le système suit des dizaines d'indicateurs mesurables selon le type de disque. Dans les disques durs mécaniques, ceux-ci incluent la hauteur de vol des têtes, le taux d'erreur de recherche, le temps de démarrage, la température, le nombre de secteurs réalloués et les heures de mise sous tension. Les SSD surveillent l'usure des cellules de mémoire flash, les cycles de programmation-effacement et la santé du contrôleur. Chaque attribut a une valeur brute (la mesure réelle), une valeur normalisée sur une échelle de 1 à 253 et un seuil de défaillance. Lorsqu'une valeur normalisée tombe en dessous de son seuil, le disque se signale comme étant à risque.

Détection et réponse

Le S.M.A.R.T. ne prédit pas les défaillances avec une précision parfaite. Un disque peut signaler des attributs sains et pourtant tomber en panne de manière catastrophique en raison d'un défaut de fabrication ou d'un choc mécanique soudain. Inversement, un disque qui semble se dégrader peut fonctionner de manière fiable pendant des années si les paramètres se stabilisent. Le système est un avertissement précoce probabiliste, pas une garantie. Il est plus efficace lorsqu'il est surveillé en continu sur des semaines ou des mois, permettant aux tendances d'émerger plutôt que de se fier à un instantané unique.

Les contrôleurs de stockage d'entreprise et les périphériques NAS implémentent l'interrogation S.M.A.R.T. dans le cadre de leurs routines de gestion des pannes. Les systèmes d'exploitation grand public tels que Windows et macOS fournissent des outils de rapport S.M.A.R.T., mais n'alertent souvent les utilisateurs que lorsqu'un disque est en détresse grave. Un logiciel de surveillance tiers peut récupérer les données S.M.A.R.T. brutes et appliquer des seuils personnalisés pour déclencher des avertissements plus tôt. La maintenance prédictive dans les centres de données planifie systématiquement le remplacement des disques lorsque les attributs S.M.A.R.T. commencent à montrer un déclin systématique.

L'acronyme a été introduit par Compaq, IBM, Maxtor, Quantum et Seagate en 1995 et est devenu universel dans l'industrie. Les données S.M.A.R.T. sont l'un des rares indicateurs de santé standardisés qui relient le micrologiciel, le système d'exploitation et les couches d'application, ce qui en fait un maillon essentiel dans les chaînes de fiabilité du stockage.

Sources

Entrée IG719701/11/2013

Autres termes : Électronique industrielle

Tout voir

Recevez le mot du jour

Un terme industriel chaque jour, avec le métier auquel il appartient et pourquoi il mérite d'être connu. Sans publicité.