Decida pela frescura e pelo formato da requisição. Se as features e a população são conhecidas de antemão e as previsões continuam válidas por horas, precompute em lote e sirva de uma tabela de lookup, o que é mais simples, mais barato e muito mais confiável. Vá para tempo real quando as features dependem da requisição atual, quando o conjunto de entidades é ilimitado, ou quando a defasagem prejudica materialmente a decisão.
Por que os entrevistadores perguntam isso
Esta é uma pergunta de julgamento de arquitetura, e entrevistadores querem ver você optar pela opção mais simples por padrão. Muitos candidatos apelam para um serviço de baixa latência onde um job noturno e um lookup resolveriam, o que multiplica custo operacional à toa. As respostas mais fortes citam o padrão híbrido, precomputando features pesadas em lote e combinando com sinais do momento da requisição.
Como estruturar sua resposta
- Comece pelos requisitos de frescura e pela disponibilidade das features.
- Defenda o lote como padrão mais barato quando ele serve.
- Cite as condições que forçam tempo real.
- Ofereça o padrão híbrido como o meio termo comum.
Exemplo de resposta
Eu começo com duas perguntas: quão defasada a previsão pode estar, e eu sei de antemão quem estou pontuando. Para algo como um score semanal de churn sobre uma base de clientes existente, as duas respostas favorecem o lote. Eu rodo um job noturno, escrevo os scores numa tabela, e o serving vira um lookup por chave primária que basicamente não tem como falhar. Nenhum acelerador no caminho da requisição, nenhum cold start, e se o job quebrar eu ainda tenho os scores de ontem, o que é uma falha muito mais suave do que um timeout. Tempo real se paga quando as features vêm da própria requisição, como o que o usuário acabou de digitar ou o que está no carrinho dele agora, ou quando a entidade pode nem existir ainda, como uma sessão novinha. A maioria dos sistemas que eu construí acabou híbrida: agregados pesados calculados em lote e cacheados, unidos no momento da requisição com um punhado de sinais ao vivo, e aí pontuados. Isso mantém o caminho online barato e ainda reage ao que acabou de acontecer. O erro que eu tento evitar é escolher tempo real por causa de um diagrama de arquitetura mais bonito quando nada lá na frente consome a frescura.
Vai encarar essa entrevista em breve? O GhostPilot escuta a sua chamada ao vivo, identifica a pergunta no instante em que ela é feita e coloca uma resposta estruturada na sua tela em tempo real. Teste na sua próxima entrevista simulada ou pegue um Session Pass de $29, sem assinatura, para a hora da verdade.
Veja como funcionaPerguntas de acompanhamento que você pode esperar
- Como você lidaria com um job em lote que falha no meio do caminho?
- O que o padrão híbrido te custa em complexidade?
- Como você impede que o cálculo de features em lote e online divirjam?
Mais perguntas para Engenheiro de Machine Learning
Seu entrevistador vai fazer a própria versão desta. Cole a descrição real da vaga no Question Predictor gratuito e receba as 20 perguntas que essa vaga tem mais chance de fazer, com o que cada uma está de fato sondando.
Prever minhas perguntas