S.M.A.R.T.
Acrónimo de self-monitoring, analysis and reporting technology: un sistema de monitoreo incluido en los discos duros y SSD de las computadoras para detectar e informar varios indicadores de confiabilidad de la unidad con la intención de anticipar fallas inminentes del hardware.
S.M.A.R.T.: informes de estado del disco duro desde el propio disco
S.M.A.R.T. es un firmware integrado en dispositivos de almacenamiento, discos duros (HDD) y unidades de estado sólido (SSD), que mide continuamente parámetros físicos y eléctricos durante el funcionamiento y los reporta al sistema anfitrión. La unidad no deja de funcionar cuando los valores se desvían; en su lugar, registra las tendencias de degradación para que se pueda predecir una falla antes de que ocurra la pérdida de datos. Un técnico o software de monitoreo lee estos atributos a través de protocolos estándar, generalmente ATA (para HDD) o NVMe (para SSD), para evaluar la vida útil restante.
El sistema rastrea docenas de indicadores medibles según el tipo de unidad. En los discos duros mecánicos, estos incluyen la altura de vuelo del cabezal, la tasa de error de búsqueda, el tiempo de giro, la temperatura, el recuento de sectores reasignados y las horas de encendido. Los SSD monitorean el desgaste de las celdas de memoria flash, los ciclos de programa-borrado y el estado del controlador. Cada atributo tiene un valor bruto (la medición real), un valor normalizado en una escala de 1 a 253 y un umbral de falla. Cuando un valor normalizado cae por debajo de su umbral, la unidad se marca a sí misma como en riesgo.
Detección y respuesta
S.M.A.R.T. no predice fallas con perfecta precisión. Una unidad puede reportar atributos saludables y, sin embargo, fallar catastróficamente debido a un defecto de fabricación o un choque mecánico repentino. Por el contrario, una unidad que parece estar degradándose puede funcionar de manera confiable durante años si los parámetros se estabilizan. El sistema es una advertencia temprana probabilística, no una garantía. Es más efectivo cuando se monitorea continuamente durante semanas o meses, permitiendo que surjan tendencias en lugar de depender de una sola instantánea.
Los controladores de almacenamiento empresariales y los dispositivos NAS implementan el sondeo S.M.A.R.T. como parte de sus rutinas de gestión de fallas. Los sistemas operativos de consumo como Windows y macOS proporcionan herramientas de informe S.M.A.R.T., pero a menudo no alertan a los usuarios hasta que una unidad está en una situación de estrés grave. El software de monitoreo de terceros puede recuperar datos S.M.A.R.T. brutos y aplicar umbrales personalizados para activar advertencias antes. El mantenimiento predictivo en los centros de datos programa rutinariamente el reemplazo de unidades cuando los atributos S.M.A.R.T. comienzan a mostrar un declive sistemático.
El acrónimo fue introducido por Compaq, IBM, Maxtor, Quantum y Seagate en 1995 y se ha vuelto universal en toda la industria. Los datos S.M.A.R.T. son uno de los pocos indicadores de estado estandarizados que unen el firmware, el sistema operativo y las capas de aplicación, lo que lo convierte en un eslabón crítico en las cadenas de confiabilidad del almacenamiento.
Fuentes
- Fuente de la definiciónWiktionary