Un NAS puede seguir siendo accesible mientras zpool status comienza a informar sobre errores de lectura o de checksum. Antes de concluir que un disco está muerto, ejecute un scrub en el pool correcto. Esta verificación lee los bloques del pool y comprueba sus sumas de control.
En un servidor que alberga máquinas virtuales, copias de seguridad o comparticiones, elegiría una ventana I/O tranquila. Un scrub utiliza los discos, y ZFS se niega a ejecutar uno al mismo tiempo que un resilver. El objetivo es saber si el pool sigue siendo saludable, no reiniciar un comando para eliminar una alerta.

Antes del scrub, confirmar el nombre del pool
Comience por leer el estado actual. No invente el nombre del pool a partir de un montaje o un disco visto en lsblk. El comando zpool list da los pools importados, luego zpool status -v muestra su estado y los errores conocidos.
sudo zpool list
sudo zpool status -v tank
Reemplace tank por el nombre devuelto por su máquina. En la salida, observe la línea scan, el estado general del pool y los contadores READ, WRITE y CKSUM de los vdevs. La variante -v también puede listar los archivos implicados cuando ZFS conoce su ruta.
Un pool ya en resilver reconstruye un disco añadido o reemplazado. Espere a que esta operación finalice antes de solicitar un scrub: OpenZFS permite solo una operación de este tipo a la vez. Si los discos sirven una base de datos o máquinas virtuales muy solicitadas, posponga el control en lugar de crear una saturación I/O en plena jornada.
Iniciar el scrub durante un período tranquilo
El siguiente comando inicia un scrub normal en tank :
sudo zpool scrub tank
El scrub recorre los datos y verifica los checksums. En un espejo, un RAIDZ o un dRAID, ZFS puede reparar los bloques dañados si tiene una copia válida. Un disco aislado o una corrupción sin réplica sigue siendo un incidente a tratar con una copia de seguridad o un reemplazo de hardware.
El comando vuelve casi de inmediato. Es normal: el trabajo continúa en segundo plano. Si la carga se vuelve incómoda, OpenZFS permite pausar el scrub y luego reanudarlo más tarde con el mismo comando.
sudo zpool scrub -p tank
sudo zpool scrub tank
Evite zpool scrub -a para un primer control. Esta opción inicia, pausa o detiene la operación en todos los pools, y puede cargar fuertemente una máquina que aloje varios.
Seguir el progreso y leer los errores
Vuelva a ejecutar zpool status durante el scrub :
sudo zpool status tank
sudo zpool status -v tank
La línea scan indica el inicio de la operación, el volumen escaneado, el progreso, el rendimiento y una estimación del tiempo restante. Un progreso superior al 100 % puede aparecer en un pool activo, ya que los datos cambian durante la lectura.
Al final, revise los contadores de los discos y la lista detallada. Un resultado limpio se parece a un scrub terminado con 0 errors. Los errores reparados aún merecen una revisión del historial del disco, los cables y el controlador. Los mensajes del núcleo suelen ser útiles en esta fase: la guía dmesg en Linux muestra cómo aislar las advertencias de almacenamiento.
- READ o WRITE que aumenta : verifique el disco, el cable y el controlador antes de realizar otra operación pesada.
- CKSUM que aumenta : busque un error de transferencia o de lectura, incluso si ZFS ha reparado los bloques gracias a una copia sana.
- Archivos listados después del scrub : restaurarlos desde una copia de seguridad verificada, luego reemplazar el hardware en cuestión si los errores persisten.
Después de un error permanente, salir del control simple
Un scrub valida la integridad observable del pool en un momento dado. No reemplaza una copia de seguridad fuera del NAS, y no convierte un disco inestable en un disco fiable. Si zpool status -v tank sigue enumerando errores después de finalizar el escaneo, copie primero los datos aún legibles a un destino sano.
La documentación OpenZFS sobre zpool scrub aclara que los controles de checksum recorren todos los bloques y que las reparaciones automáticas requieren una copia redundante válida. Para un pool sin redundancia, la decisión razonable sigue siendo la restauración desde una copia de seguridad y el reemplazo del soporte defectuoso.