Um globalmount CIFS num share SMB do TrueNAS ficou obsoleto em todo node k3s ao mesmo tempo, e o csi-driver-smb continuou fazendo bind-mount do handle morto em todo pod novo — corrigido com noserverino, um liveness probe que checa o mount de verdade e um DaemonSet que força umount de globalmounts CIFS obsoletos.
Três modos de falha de storage sem relação entre si, no mesmo cluster k3s, todos se apresentam como um nó que não responde — stalls de iSCSI do Longhorn sob pressão de memória, mounts CIFS entrando em estado D, e kubelet medindo ephemeral-storage no disco errado. Como diferenciá-los antes de apertar o botão de energia.
Mounts CIFS no Kubernetes não têm opção de timeout confiável na maioria dos kernels. Cada correção óbvia falha. Isso documenta o que foi tentado, o que o kernel realmente suporta e o padrão sidecar que funciona.