Plat est un résultat, présentez-le comme tel. Vérifiez d'abord que le test était valide : décalage du ratio d'échantillons, instrumentation, et puissance réelle pour l'effet qui vous intéressait. Regardez ensuite si l'intervalle de confiance exclut un effet significatif ou s'il est simplement trop large pour dire quoi que ce soit. Enfin, ne regardez que les segments pré-enregistrés, sans partir à la pêche.
Pourquoi les recruteurs posent cette question
La façon dont vous gérez un résultat nul révèle à la fois votre intégrité et votre rigueur. Le recruteur veut vous voir distinguer une preuve d'absence d'effet d'une absence de preuve d'effet, ce qui dépend de la largeur de l'intervalle. Il veut aussi les contrôles de validité, en particulier le décalage du ratio d'échantillons, et une ligne ferme contre le découpage jusqu'à ce que quelque chose apparaisse pour sauver le lancement.
Comment structurer votre réponse
- Traitez un résultat nul comme un vrai constat, pas comme un test raté.
- Faites les contrôles de validité, dont le ratio d'échantillons et l'instrumentation.
- Lisez l'intervalle de confiance pour séparer absence d'effet et manque de puissance.
- Ne regardez que les segments pré-enregistrés, et dites-le à voix haute.
- Recommandez une décision, pas seulement une analyse.
Exemple de réponse
D'abord je m'assure que c'est un vrai résultat nul et pas un test cassé. Je vérifie le ratio d'échantillons : si j'attendais du cinquante-cinquante et que j'obtiens 50,8 contre 49,2 sur quelques centaines de milliers d'utilisateurs, l'affectation a un problème et tout le résultat devient suspect. Je vérifie que l'instrumentation s'est déclenchée dans les deux bras et que les indicateurs garde-fous ont l'air sains. En supposant que ça tienne, je vais à l'intervalle plutôt qu'à la p-value. Si le gain est de 0,1% avec un intervalle de plus ou moins 0,4, c'est vraiment informatif : on peut exclure tout ce qui vaudrait un déploiement. Si c'est plus ou moins 6%, le test n'y voyait tout simplement rien, et dire aucun effet serait faux. Ensuite je regarde les segments qu'on avait nommés avant le lancement, et seulement ceux-là. Je ne découperai pas jusqu'à ce que quelque chose devienne significatif, et je le dis à voix haute, parce qu'il y a en général une pression pour trouver un survivant. Puis je donne une recommandation. En général c'est ne pas déployer, voici ce que je changerais à l'hypothèse, et honnêtement un résultat nul propre qui nous évite de passer un trimestre de plus sur une idée morte est un bon résultat.
Vous passez cet entretien bientôt ? GhostPilot écoute votre appel en direct, repère la question dès qu'elle est posée et affiche une réponse structurée à l'écran en temps réel. Essayez-le lors de votre prochain entretien blanc, ou prenez un Session Pass à $29, sans abonnement, pour le jour J.
Voir comment ça marcheQuestions de relance à prévoir
- Qu'est-ce qui provoque en pratique un décalage du ratio d'échantillons ?
- Comment décidez-vous s'il faut relancer avec plus de trafic ou abandonner l'idée ?
- Comment rédigeriez-vous cela pour un public de dirigeants ?
Autres questions pour Data Scientist
Votre recruteur posera sa propre version de celle-ci. Collez votre véritable fiche de poste dans le Question Predictor gratuit et obtenez les 20 questions que ce poste a le plus de chances de poser, avec ce que chacune cherche vraiment à sonder.
Prédire mes questions