Erros do Kubernetes
Uma página por erro, com o mesmo formato: o que significa, causas comuns, comandos de diagnóstico, a correção em YAML e como o erro aparece no Kubepier. 2 de 12 publicadas; as outras chegam em breve.
Aparece na coluna STATUS
kubectl get pods. Estados de espera do container: CrashLoopBackOff, ImagePullBackOff, ErrImagePull, CreateContainerConfigError; e do pod: Pending, Evicted, Terminating.
Aparece no describe
kubectl describe pod. Motivo do último término em Last State › Reason: OOMKilled, Error, Completed. Condições do Job em describe job.
Aparece nos eventos
kubectl get events. Probes (Unhealthy, Killing), agendamento (FailedScheduling) e nó (NodeNotReady). Retidos por 1 hora por padrão.
CrashLoopBackOff
O container termina, o kubelet reinicia e espera cada vez mais entre tentativas: 10 s, 20 s, 40 s, até 5 minutos.
ImagePullBackOff
Puxar a imagem falhou mais de uma vez e o kubelet espera com back-off (teto de 5 minutos) antes de tentar de novo.
ErrImagePull
A primeira tentativa de puxar a imagem falhou: tag inexistente, nome errado, registry privado sem imagePullSecrets ou limite de pull.
OOMKilled
O container passou do limite de memória e o kernel o matou com SIGKILL. Exit code 137, Reason OOMKilled.
Pending (FailedScheduling)
Nenhum nó atende ao pod: CPU ou memória insuficiente, taint sem toleration, PVC não vinculado, afinidade impossível.
CreateContainerConfigError
Um ConfigMap ou Secret referenciado em env ou volume não existe, ou a chave pedida não existe nele.
Evicted
O kubelet removeu o pod por pressão no nó: memória, disco ou PIDs. Pods BestEffort e os que passam do request saem primeiro.
Terminating preso
O pod não conclui o término: finalizer pendente, volume que não desmonta ou nó fora do ar. O grace period padrão é 30 s.
Node NotReady
O kubelet parou de reportar. Após 50 s (node-monitor-grace-period) o nó vira NotReady; após 300 s de toleration os pods são despejados.
BackoffLimitExceeded
O Job falhou mais vezes que backoffLimit (padrão 6) e o controlador parou de criar pods novos.
Liveness probe failed
A liveness probe falhou failureThreshold vezes (padrão 3, a cada 10 s) e o kubelet reiniciou o container.
Readiness probe failed
O container roda, mas não recebe tráfego: o pod sai dos endpoints do Service até a probe voltar a passar.
Fontes dos números: documentação do Kubernetes, seções "Pod Lifecycle" (back-off de 10 s a 5 min), "Configure Liveness, Readiness and Startup Probes" (period 10 s, timeout 1 s, failureThreshold 3), "Node-pressure Eviction", "Jobs" (backoffLimit 6), "kube-controller-manager" (node-monitor-grace-period 50 s) e "Taints and Tolerations" (tolerationSeconds 300). Verificado em set/2026.