La question arrive presque toujours après le troisième entretien : quel modèle de feedback adopter ? SBI, le sandwich, l’un des sigles qui circulent en formation au management. Les modèles existent, l’un d’eux est réellement utile, et pourtant la question arrive trop tard. Un modèle met en forme un jugement. Il ne le produit pas.
La thèse de cet article tient en une phrase : dans un processus de recrutement, le feedback ne rate presque jamais à cause du format. Il rate parce que quatre personnes ont mené des entretiens sans s’accorder au préalable sur ce qu’elles évaluaient. Après coup, n’importe quel modèle s’applique, et le résultat reste une impression découpée en trois morceaux.
Ce que dit la recherche
Le feedback n’aide pas de façon fiable. La méta-analyse de Kluger et DeNisi, parue dans Psychological Bulletin, a traité 607 tailles d’effet issues de 23 663 observations. L’effet moyen est positif, d = .41. Mais dans plus d’un tiers des cas, la performance a baissé après l’intervention.
L’explication vaut mieux que le chiffre. L’efficacité du retour diminue à mesure que l’attention de la personne qui le reçoit s’éloigne de la tâche pour se porter sur elle-même. Un retour qui reste sur ce qui a été fait fonctionne. Un retour qui arrive comme un verdict sur quelqu’un ne fonctionne pas, et fait souvent des dégâts.
C’est ce mécanisme qui départage les modèles, et qui explique pourquoi la préparation pèse plus lourd que la formulation.
Là où ça casse réellement
Reprenons un déroulé ordinaire. Quatre personnes rencontrent la même candidature sur une semaine. Personne n’a écrit ce que « bon profil » signifie pour ce poste, au-delà de l’annonce. Chacune se forge une impression. Au débriefing, trois jours plus tard, il en reste un ressenti auquel on cherche une justification a posteriori.
Cela se lit dans les comptes rendus : « communique bien, j’avais un doute sur la profondeur technique ». Cette phrase n’est pas inexploitable parce qu’on aurait retenu la mauvaise trame. Elle est inexploitable parce que personne n’a jamais défini à quoi se reconnaît la profondeur technique pour ce poste précis.
L’ordre des opérations est donc inverse de celui qu’on enseigne. D’abord les critères, ensuite les notes prises pendant l’entretien, et enfin le modèle, qui à ce stade ne fait plus que mettre en forme une matière déjà concrète. C’est aussi la seule condition dans laquelle le retour agit, si l’on suit Kluger et DeNisi : il reste sur la tâche.
L’objection : les modèles ne sont pas neutres pour autant
L’objection évidente, c’est que deux personnes disposant des mêmes notes peuvent restituer la même observation de manières très différentes, et que c’est précisément à cela que servent les modèles. Elle est fondée.
SBI — situation, comportement, impact — est le modèle qui remplit cet office. Il vient du CCL, une organisation américaine à but non lucratif spécialisée dans le développement des dirigeant·e·s, et il fonctionne pour la raison exacte que la méta-analyse laisse prévoir : ses trois composantes sont des faits relatifs à un événement, la phrase n’a donc nulle part où glisser vers le jugement de personne. Une extension ajoute l’intention comme quatrième élément, ce qui transforme la restitution en question plutôt qu’en verdict.
La différence en pratique. « Vous avez manqué de structure pendant l’entretien » ne contient aucun événement. « Dans l’exercice de conception, vous avez commencé par le schéma avant d’avoir clarifié les besoins, et je n’ai pas su pour quelles contraintes vous conceviez » nomme une situation, un comportement et un impact : c’est exploitable.
Le sandwich (éloge, critique, éloge) est le modèle le plus recommandé et le plus attaqué. Ce qu’on lui reproche, c’est que l’emballage déplace l’attention vers l’évaluation de la personne au lieu de l’événement. Les données sont pourtant plus minces que la critique ne le suggère : une étude expérimentale de 2020 parue dans Learning and Instruction a observé une meilleure performance ultérieure après un feedback en sandwich qu’après une correction seule ou aucun retour. Son vrai défaut est moins d’échouer que de servir de substitut quand on n’a rien de précis à dire.
Quoi faire
Quatre ou cinq critères par poste, formulés comme des comportements observables : « explique un arbitrage technique à un auditoire non technique » plutôt que « communication ». Les mêmes pour tout le monde. Des notes prises pendant l’entretien et non après, parce qu’une note rédigée trois jours plus tard est une reconstruction, et qu’une reconstruction dérive systématiquement vers l’impression d’ensemble. Puis SBI pour tout ce sur quoi quelqu’un devra agir.
Divulgation, puisqu’elle est pertinente ici : chez Join nous vendons un ATS doté de grilles d’évaluation. Pondérez ce qui suit en conséquence. Le logiciel fait une seule chose sur ce terrain : il retient les critères avant l’entretien, donne les mêmes à chaque personne du panel avec un champ de notes par critère, et regroupe les évaluations sur le profil de la candidature, pour que les désaccords restent visibles au lieu d’être moyennés en réunion. Il n’offre pas aujourd’hui de tableau comparatif entre plusieurs candidatures : il faut passer d’un profil à l’autre.
Ce n’est pas la partie décisive. Les critères dans un document partagé, arrêtés avant le premier entretien, apportent l’essentiel du bénéfice pour le prix d’une réunion. Si vos retours sont vagues aujourd’hui, un outil présentera ce flou plus proprement.
La moitié la plus difficile se joue de toute façon dans l’autre sens : recevoir le feedback que votre propre processus produit, sans le contester aussitôt.


