Deux personnes rendent un texte de qualité identique. L'une y a passé six heures, l'autre dix minutes avec de l'aide. Faut-il les évaluer pareil ? Notre réflexe dit non, et pourtant nous serions bien en peine d'expliquer ce que nous récompensons exactement : le résultat, ou la peine ?
Nous avons traité les conséquences pratiques de l'IA à l'école et dans le recrutement. Voici la question de fond qui les traverse toutes.
Ce que nous récompensons réellement
Notre intuition du mérite mélange deux choses distinctes, et cette confusion passait inaperçue tant qu'elles allaient ensemble.
Le résultat. Ce qui est produit, sa qualité, son utilité. C'est ce qui compte quand vous achetez un objet : vous vous fichez de savoir combien de temps il a fallu.
L'effort. Ce que la personne a investi, la difficulté surmontée. C'est ce que récompense une médaille, une note, une promotion au mérite.
Pendant longtemps, ces deux dimensions étaient corrélées : un bon résultat supposait généralement un effort. On pouvait récompenser l'un en croyant récompenser l'autre, sans avoir à choisir.
L'IA découple ces deux choses. Et nous découvrons que nous ne savions pas laquelle nous valorisions.
L'argument qui dérange
Il existe une objection sérieuse à l'idée même de mérite, et elle est antérieure à l'IA. Une bonne part de ce qui produit un résultat ne relève déjà pas du mérite : le milieu d'origine, l'éducation reçue, la santé, les rencontres, les dispositions naturelles. Personne ne mérite d'avoir eu des parents qui lisaient.
De ce point de vue, l'IA n'introduit pas une injustice nouvelle : elle ajoute un facteur à une liste déjà longue de choses qui expliquent les résultats sans relever de la vertu personnelle. On pourrait même soutenir qu'elle réduit certaines inégalités, en donnant à ceux qui n'ont pas eu les bons codes un accès à ce que d'autres tenaient de leur milieu. Nous l'avons observé pour l'accessibilité et pour la rédaction de candidatures.
L'argument tient. Il ne suffit pourtant pas, pour une raison précise.
Nous l'avons développé dans notre article sur le temps gagné : certains efforts ne produisent que leur résultat, d'autres transforment aussi celui qui les accomplit. Écrire une dissertation ne sert pas à produire une dissertation. Quand on récompense un devoir, on ne récompense pas le texte : on vérifie qu'une transformation a eu lieu. Si le texte arrive sans la transformation, ce n'est pas une tricherie sur le résultat, c'est que le résultat ne prouve plus rien.
Trois réponses possibles
Évaluer autrement. Si le produit fini ne prouve plus la compétence, il faut vérifier la compétence directement : oral, mise en situation, capacité à défendre et à critiquer son travail. C'est ce qui se dessine à l'école, et cela demande davantage de temps d'enseignant, ce qui est le vrai obstacle.
Assumer de valoriser le résultat. Dans beaucoup de contextes professionnels, c'est déjà le cas et c'est légitime. Un client veut un problème résolu, pas une preuve de souffrance. Reconnaître cela franchement vaut mieux que de maintenir une fiction sur l'effort.
Déplacer le mérite vers ce qui reste rare. Si produire devient facile, ce qui distingue est ailleurs : savoir quoi produire, juger si c'est bon, décider dans l'incertitude, engager sa responsabilité. Ce sont exactement les critères que nous identifiions dans notre article sur les métiers.
Le risque à surveiller
Une dérive mérite d'être nommée. Si le résultat seul compte et que l'outil est accessible à tous, l'évaluation se déplace vers des différences de plus en plus fines : qui a le meilleur outil, qui sait mieux s'en servir, qui a le temps d'itérer davantage.
Ces différences-là ne sont pas plus méritoires que les précédentes, et elles risquent de recouper les inégalités existantes. Un outil qui égalise l'accès à la production peut très bien recréer une hiérarchie sur l'accès à la qualité.
Ce qu'il faut retenir
Cette question n'a pas de réponse unique, et c'est plutôt une bonne nouvelle qu'elle soit posée. Nous fonctionnions avec une notion de mérite confortable parce qu'elle n'était jamais examinée.
Ce qui semble solide : dans les contextes d'apprentissage, l'effort est l'objet même, et une production sans effort ne prouve rien. Dans les contextes de production, le résultat compte, et il n'y a pas de honte à utiliser ce qui existe.
Le problème vient du fait que nous confondons les deux. Un diplôme prétend certifier une compétence et se juge sur des productions. Un entretien d'embauche prétend évaluer une personne et se juge sur un CV. Ces dispositifs reposaient sur l'hypothèse que le résultat témoignait du reste. Cette hypothèse ne tient plus, et c'est cela qu'il faut reconstruire, plutôt que de chercher qui a triché.