Pergunta de entrevista para Engenheiro DevOps

Explique SLIs, SLOs e orçamentos de erro, e como você os usaria no dia a dia.

O que o entrevistador está avaliando, como estruturar sua resposta e um exemplo falado que você pode adaptar.

Resposta rápida

Um SLI é uma medição da experiência do usuário, como a proporção de requisições atendidas com sucesso abaixo de trezentos milissegundos. Um SLO é a meta para essa medição em uma janela, digamos 99,9 por cento em vinte e oito dias. O orçamento de erro é o restante, então 99,9 por cento deixa uns quarenta e três minutos de falha por mês. Quando o orçamento está saudável você entrega mais rápido; quando ele acaba, trabalho de confiabilidade vira prioridade.

Por que os entrevistadores perguntam isso

Esta pergunta verifica se você consegue conectar confiabilidade a decisões de negócio em vez de perseguir uptime por si só. O entrevistador quer ver que você escolhe indicadores do ponto de vista do usuário, que você sabe que cem por cento é a meta errada e, de preferência, que você consegue descrever alertas por taxa de queima em vez de paginar a cada violação do limiar.

Como estruturar sua resposta

  • Defina os três termos com clareza e um número concreto.
  • Explique por que o orçamento torna o tradeoff explícito.
  • Descreva como o orçamento muda o comportamento do time na prática.
  • Cite alertas por taxa de queima em vez de alertas de limiar puro.

Exemplo de resposta

Exemplo falado, em primeira pessoa

O indicador é o que você mede do lado do usuário, então para uma API normalmente é a fatia de requisições que são bem sucedidas e rápidas o bastante. O objetivo é a meta em uma janela móvel, e o orçamento é o que sobra. Três noves em vinte e oito dias dá mais ou menos quarenta e três minutos de coisa ruim que você pode gastar, e enquadrar como orçamento é o ponto principal, porque transforma confiabilidade de discussão em aritmética. Se a gente gastou cinco por cento do orçamento neste mês, entregamos funcionalidades e assumimos riscos razoáveis. Se a gente queimou oitenta por cento até o dia dez, a próxima sprint é trabalho de confiabilidade e lançamentos arriscados esperam. Para alertas eu uso taxas de queima em múltiplas janelas em vez de paginar no instante em que a razão cai, então uma queima rápida que esgotaria o orçamento em uma hora pagina na hora, enquanto uma queima lenta gera um ticket. Isso matou a maior parte do nosso barulho noturno. A parte mais difícil é escolher o indicador com honestidade, porque uma meta em algo que os usuários não sentem é teatro.

Vai encarar essa entrevista em breve? O GhostPilot escuta a sua chamada ao vivo, identifica a pergunta no instante em que ela é feita e coloca uma resposta estruturada na sua tela em tempo real. Teste na sua próxima entrevista simulada ou pegue um Session Pass de $29, sem assinatura, para a hora da verdade.

Veja como funciona

Perguntas de acompanhamento que você pode esperar

  • Como você escolheria um SLI para um pipeline batch assíncrono?
  • O que você faz quando a indisponibilidade de uma dependência queima o seu orçamento?
  • Como você define o primeiro objetivo quando não há dados históricos?

Mais perguntas para Engenheiro DevOps

Seu entrevistador vai fazer a própria versão desta. Cole a descrição real da vaga no Question Predictor gratuito e receba as 20 perguntas que essa vaga tem mais chance de fazer, com o que cada uma está de fato sondando.

Prever minhas perguntas

Ensaie as perguntas difíceis antes que elas apareçam

Pratique com um copiloto ao vivo e depois entre pronto. Um Session Pass de $29 te leva até o fim da entrevista, sem assinatura e sem amarras.

Instalar o GhostPilot