Un NAS puede seguir siendo accesible mientras que zpool status comienza a informar errores de lectura o de checksum. Antes de concluir que un disco está muerto, ejecute un scrub sobre el buen pool. Esta verificación lee los bloques del pool y verifica sus sumas de comprobación.
En un servidor que aloja VM, copias de seguridad o comparticiones, elegiría una ventana de I/O tranquila. Un scrub moviliza los discos, y ZFS se niega a ejecutar uno al mismo tiempo que un resilver. El objetivo es saber si el pool permanece sano, no reiniciar un comando para hacer desaparecer una alerta.

Antes del scrub, confirme el nombre del pool
Comience por leer el estado actual. No invente el nombre del pool a partir de un montaje o un disco visto en lsblk. El comando zpool list muestra los pools importados, luego zpool status -v muestra su estado y los errores conocidos.
sudo zpool list
sudo zpool status -v tank
Reemplace tank por el nombre devuelto por su máquina. En la salida, observe la línea scan, el estado general del pool y los contadores READ, WRITE y CKSUM de los vdevs. La variante -v también puede listar los archivos afectados cuando ZFS conoce su ruta.
Un pool ya en resilver reconstruye un disco añadido o reemplazado. Espere esta operación antes de solicitar un scrub: OpenZFS solo permite una operación de este tipo a la vez. Si los discos sirven una base de datos o VM muy solicitadas, retrase el control en lugar de crear una saturación de I/O durante el día.
Iniciar el scrub durante un período tranquilo
El siguiente comando inicia un scrub normal sobre tank:
sudo zpool scrub tank
El scrub recorre los datos y verifica los checksums. En un espejo, un RAIDZ o un dRAID, ZFS puede reparar los bloques dañados si tiene una copia válida. Un disco aislado o una corrupción sin réplicas sigue siendo un incidente que debe tratarse con una copia de seguridad o un reemplazo de hardware.
El comando regresa casi de inmediato. Es normal: el trabajo continúa en segundo plano. Si la carga se vuelve molesta, OpenZFS permite pausar el scrub y reanudarlo más tarde con el mismo comando.
sudo zpool scrub -p tank
sudo zpool scrub tank
Evite zpool scrub -a para un primer control. Esta opción inicia, pausa o detiene la operación en todos los pools y puede sobrecargar mucho una máquina que alberga varios.
Seguimiento del avance y lectura de errores
Relance zpool status durante el scrub:
sudo zpool status tank
sudo zpool status -v tank
La línea scan indica el inicio de la operación, el volumen escaneado, el progreso, la velocidad y una estimación restante. Un progreso superior al 100 % puede aparecer en un pool activo, ya que los datos cambian durante la lectura.
Al final, vuelva a leer los contadores de los discos y la lista detallada. Un resultado limpio se parece a un scrub terminado con 0 errors. Los errores reparados aún merecen una verificación del historial del disco, los cables y el controlador. Los mensajes del núcleo son a menudo útiles en esta etapa: la guía dmesg en Linux muestra cómo aislar las advertencias de almacenamiento.
- READ o WRITE que aumenta: verifique el disco, el cable y el controlador antes de una nueva operación pesada.
- CKSUM que aumenta: busque un error de transferencia o de lectura, incluso si ZFS ha reparado los bloques gracias a una copia sana.
- Archivos listados después del scrub: restáurelos desde una copia de seguridad verificada, luego reemplace el hardware comprometido si los errores persisten.
Después de un error permanente, salir del simple control
Un scrub valida la integridad observable del pool en un momento dado. No reemplaza una copia de seguridad fuera del NAS, y no convierte un disco inestable en un disco confiable. Si zpool status -v tank sigue enumerando errores después de que finaliza el escaneo, copie primero los datos aún legibles a un destino saludable.
La documentación OpenZFS sobre zpool scrub especifica que los controles de checksum recorren todos los bloques y que las reparaciones automáticas requieren una copia redundante válida. Para un pool sin redundancia, la decisión razonable sigue siendo la restauración desde una copia de seguridad y el reemplazo del medio defectuoso.