No Linux o load average conta os processos em sono ininterrupto além dos executáveis, então uma carga alta com CPUs ociosas quase sempre significa processos bloqueados em I/O. Cheque iowait e utilização de dispositivo com iostat, procure processos em estado D, e considere um disco lento, um sistema de arquivos de rede travado ou um volume de armazenamento saturado. Ocasionalmente é contenção de lock ou um mount pendurado em vez de throughput.
Por que os entrevistadores perguntam isso
Esta é uma sondagem clássica de fundamentos de Linux que muitos candidatos de infraestrutura erram, porque presumem que carga é igual a demanda de CPU. O entrevistador quer o detalhe do sono ininterrupto e depois um caminho de diagnóstico metódico com ferramentas nomeadas. Isso também mostra se você consegue raciocinar sobre uma máquina ao vivo em vez de reiniciar na hora e torcer para o sintoma sumir.
Como estruturar sua resposta
- Corrija a premissa: no Linux a carga inclui sono ininterrupto.
- Cite bloqueio de I/O como a causa provável.
- Dê a sequência de diagnóstico com comandos específicos.
- Mencione as causas menos comuns antes de concluir.
Exemplo de resposta
Load average no Linux não é uma fila de CPU, ele conta processos executáveis mais os ininterruptíveis, então processos presos esperando disco ou um mount de rede inflam a carga enquanto as CPUs ficam ociosas. Então meu primeiro movimento é confirmar isso: ps procurando processos em estado D, e vmstat ou top para checar a coluna de iowait. Depois iostat para ver se algum dispositivo está a cem por cento de utilização com um await feio, o que aponta para um disco saturado ou defeituoso, ou para um volume de nuvem que ficou sem créditos de burst, coisa que eu já peguei mais de uma vez em um volume de propósito geral que estava ok por meses e de repente não estava mais. Se os processos em estado D estão todos tocando o mesmo mount, eu olho o sistema de arquivos de rede, porque um export NFS travado produz exatamente esse quadro, carga enorme e nada acontecendo. Se o armazenamento parece saudável eu abro para contenção de lock ou problema de driver. O ponto principal é que reiniciar a aplicação aqui não me diria nada, porque a aplicação é a vítima e não a causa.
Vai encarar essa entrevista em breve? O GhostPilot escuta a sua chamada ao vivo, identifica a pergunta no instante em que ela é feita e coloca uma resposta estruturada na sua tela em tempo real. Teste na sua próxima entrevista simulada ou pegue um Session Pass de $29, sem assinatura, para a hora da verdade.
Veja como funcionaPerguntas de acompanhamento que você pode esperar
- Como você diferenciaria um volume saturado de um defeituoso?
- O que um processo em estado D significa para um sinal de kill?
- Em qual métrica você de fato alertaria no lugar do load average?
Mais perguntas para Engenheiro DevOps
Seu entrevistador vai fazer a própria versão desta. Cole a descrição real da vaga no Question Predictor gratuito e receba as 20 perguntas que essa vaga tem mais chance de fazer, com o que cada uma está de fato sondando.
Prever minhas perguntas