COTNAS
Diagnóstico de hardware

Cómo revisar la salud de un HDD, SSD o NVMe con SMART

Introducción práctica a smartmontools y smartctl para consultar información SMART, ejecutar pruebas internas y detectar señales de degradación en discos.

Portada COTNAS del artículo Cómo revisar la salud de un HDD, SSD o NVMe con SMART

Cómo revisar la salud de un HDD, SSD o NVMe con SMART

SMART es un sistema de monitorización integrado en muchas unidades de almacenamiento. El proyecto smartmontools incluye smartctl, una utilidad para consultar información, iniciar pruebas internas y revisar registros de discos ATA, SCSI y NVMe compatibles.

SMART ayuda a detectar señales de degradación, pero no garantiza que una unidad no vaya a fallar. Un disco puede dejar de funcionar sin avisos previos, por lo que nunca sustituye a las copias de seguridad.

1. Instalar smartmontools

En Debian y Ubuntu:

sudo apt update
sudo apt install smartmontools

En otras distribuciones utiliza el gestor de paquetes correspondiente. El proyecto también publica versiones para otros sistemas.

2. Detectar los dispositivos

En Linux:

sudo smartctl --scan-open

También puedes revisar:

lsblk -o NAME,SIZE,MODEL,SERIAL,TRAN

Identifica correctamente el disco. En Linux puede aparecer como /dev/sda o /dev/nvme0.

3. Consultar toda la información disponible

Para una unidad ATA/SATA:

sudo smartctl -a /dev/sda

Para NVMe:

sudo smartctl -a /dev/nvme0

La salida puede incluir:

  • modelo y firmware;
  • horas de funcionamiento;
  • temperatura;
  • estado general;
  • atributos del fabricante;
  • errores registrados;
  • historial de pruebas.

4. Comprobar el estado general

sudo smartctl -H /dev/sda

Un resultado positivo no significa que el disco esté perfecto. La propia documentación de smartmontools explica que una unidad puede fallar una prueba interna aunque el estado general todavía aparezca como aprobado.

5. Ejecutar una prueba corta

sudo smartctl -t short /dev/sda

La herramienta indicará cuándo debería terminar. Después consulta el resultado:

sudo smartctl -l selftest /dev/sda

Para una prueba más extensa, cuando la unidad lo permita:

sudo smartctl -t long /dev/sda

Durante la prueba, evita apagar el equipo y revisa el tiempo estimado antes de iniciar una operación larga en un servidor de producción.

Atributos que suelen requerir atención

Los nombres y significados exactos dependen del fabricante, pero conviene investigar:

  • sectores reasignados;
  • sectores pendientes;
  • errores no corregibles;
  • fallos de pruebas internas;
  • temperatura excesiva;
  • porcentaje de vida restante;
  • errores de integridad en NVMe.

No compares valores normalizados entre fabricantes como si fueran equivalentes. Consulta siempre la documentación del modelo cuando una métrica sea ambigua.

Señales para actuar con urgencia

  • SMART informa de fallo.
  • Aparecen sectores pendientes o no corregibles y aumentan.
  • Las pruebas internas fallan repetidamente.
  • El sistema registra errores de entrada/salida.
  • El disco desaparece o se desconecta.
  • Se escuchan ruidos anómalos en un HDD.

En esos casos, prioriza la copia de datos. No sometas un disco físicamente inestable a pruebas repetitivas si la información es irremplazable.

Monitorización continua

smartd, incluido en smartmontools, puede vigilar unidades y generar avisos. En servidores resulta útil integrarlo con correo, syslog o una plataforma de monitorización.

La alerta debe acompañarse de un procedimiento: responsable, copia inmediata, sustitución y verificación de restauración.

Conclusión

SMART ofrece visibilidad, no inmunidad. La combinación correcta es monitorización, pruebas periódicas, revisión de tendencias y copias restaurables. Cuando aparecen errores que evolucionan, el objetivo no es demostrar cuánto tiempo más aguantará el disco, sino reducir el riesgo antes de que falle.

Fuentes oficiales

#smartctl#smart#ssd#hdd#nvme#salud disco#diagnostico
Este contenido es informativo y está orientado a administración defensiva, auditorías autorizadas y mejora de la seguridad. Adapta cualquier cambio a tu entorno y conserva una copia de seguridad antes de aplicarlo.