LIVRE BLANC N° 3
Lecture : 10 minutes · le développement complet : 30
L'intelligence agencée
Ce que rend possible une chaîne d'intelligence qui lit tout, n'oublie rien et se vérifie elle-même — et ce qu'il faut concevoir pour que cette puissance vaille quelque chose
Objectiver le facteur humain dans les décisions qui n'ont pas de seconde chance.
Sommaire
01 · L'ARGUMENT
La thèse, en trois minutes
La reconnaissance
Vous avez déjà eu, sur votre bureau, un dossier que personne n'avait entièrement lu. Pas par négligence : parce que le lire entièrement aurait demandé des semaines que le calendrier ne donnait pas. On lit ce qu'on peut, on résume le reste, et on tranche — en sachant que la pièce qui aurait tout changé dormait peut-être à la page quatre cents.
Le renversement
Ce qui vient de devenir possible ne se raconte pas comme une performance, mais comme une levée de contrainte : une chaîne qui lit l'intégralité, n'oublie rien, et — c'est le point qui compte — cherche la contradiction au lieu de l'attendre. Un agent est chargé d'attaquer la conclusion du précédent ; ce qui résiste est retenu ; chaque chiffre remonte à sa pièce, sa date et sa formule.
Cela déplace un dilemme dans lequel on vous enferme depuis dix ans : l'artisan qui juge sans tout lire, ou le logiciel qui lit tout sans juger. Ce dilemme n'a jamais été un choix — c'était une contrainte de coût, et elle vient de tomber.
Le principe qui rend cette puissance utilisable
Une chaîne qui peut tout lire pourrait aussi tout conclure. C'est là que la conception décide de tout, et le principe est unique : l'instruction, jamais le verdict. La machine instruit ce qui s'instruit — lire, structurer, recouper, contredire, mettre en forme ; le jugement retient ce qui n'appartient qu'à lui — la pondération du contexte, la recommandation, la signature. Ce n'est pas une précaution ajoutée après coup : c'est l'architecture elle-même, et c'est ce qui rend la production délégable sans que la pensée le soit.
Ce qui s'ensuit — et ce que vous êtes en droit d'exiger
Une revendication de puissance sans sa gouvernance ne vaut rien, et vous avez raison de vous en méfier. Elle se prouve par l'acte, pas par la déclaration : par où l'intelligence entre et ce qu'elle a le droit de toucher, ce qu'elle doit rapporter et quand, ce qu'elle ne conclut jamais, d'où vient chaque fait et comment on le vérifie, qui répond nommément de ce qui est produit. Cinq questions — et vous pouvez les poser, dès cette semaine, à quiconque vous propose de l'intelligence artificielle, nous compris.
Échanger 30 minutes sur une situation réelle — prendre rendez-vous
02 · LA DÉMONSTRATION
1. Ce qui vient de devenir possible
Lire tout, et non un échantillon. Une chaîne instruite prend en charge la totalité d'un corpus : les entretiens transcrits au mot près, le plan stratégique et ses trois révisions, deux ans de comptes rendus de comité. Non pas un résumé des pièces — les pièces.
Ne rien oublier. L'esprit le plus rigoureux perd le fil au-delà de quelques dizaines d'éléments. Une chaîne tient tout le dossier simultanément : elle rapproche deux phrases dites par deux personnes différentes, à six mois d'intervalle, dans deux contextes sans rapport.
Chercher la contradiction au lieu de l'attendre. Elle se découvrait par accident ; elle se cherche désormais, sur toutes les pièces, en croisant ce qui est dit, ce qui est écrit et ce qui a été fait.
Trianguler à une échelle nouvelle. Le même signal — un dirigeant qui décrit sa manière de trancher — se retrouve dans son entretien, dans les comptes rendus où on le voit trancher, et dans les propos de ceux qui travaillent avec lui. L'écart entre ces trois sources est une information de première qualité.
Instruire le cas particulier au prix du cas général. L'instruction devenue abondante, on n'applique plus une grille générique : on instruit cette situation-là, contre cette thèse-là.
Ne jamais s'arrêter. Une veille continue sur les opérations, les mouvements de dirigeants, l'environnement d'une participation ne demande plus un abonnement et deux personnes : elle tourne. Le dossier cesse d'être une photographie prise à la date de la mission.
Et maintenant, la mauvaise nouvelle. Chacune de ces capacités a une pathologie jumelle, déclenchée par l'absence de conception. Lire tout produit un volume que personne ne relit. Chercher la contradiction en fabrique. Et la veille continue, sans destinataire ni seuil, devient un bruit de fond que l'on finit par couper.
Une capacité sans agencement n'est pas un avantage : c'est une charge de travail supplémentaire, arrivée plus vite.
03 · LA DÉMONSTRATION
2. L'atelier, poste par poste
Dans une mission conduite à l'ancienne, la praticienne passe la majorité de son temps sur des tâches qui n'exigent aucune présence : lire, noter, réécouter, recopier, vérifier des cohérences. Les heures rares — l'entretien, l'arbitrage, la restitution — sont comprimées par les heures abondantes.
D'où le principe de partage : l'humain porte tout ce qui crée la confiance et engage le jugement ; la machine porte tout ce qui consomme du temps sans exiger de présence. Cinq postes, chacun avec sa frontière explicite.
La préparation. La machine lit toute la documentation, le projet que l'équipe est censée servir, et produit les dossiers de briefing et les guides d'entretien, dérivés de la trame structurée standard. La frontière : le guide est une proposition que la praticienne amende, et la trame validée n'est jamais modifiée par la machine.
Les entretiens. Conduits par la praticienne, enregistrés après consentement écrit préalable et spécifique, transcrits automatiquement. Frontière la plus stricte de la chaîne, volontairement asymétrique : ce que la machine reçoit est un texte ; ce que la praticienne a vu est une personne. Et c'est là que passe l'interdiction d'inférence émotionnelle.
L'analyse. Codage assisté des verbatims sur les six dimensions du fuseki « human capital assessment », croisement avec les instruments et les pièces, détection des convergences et des contradictions. La frontière : la machine propose et ne conclut pas ; elle rapporte des passages traçables jusqu'à leur source. Reconnaître le régime dans lequel se trouve l'organisation — vertueux, rompu, inversé — et l'état de la boucle de transmission entre la gouvernance et la vision est un acte de jugement, jamais une sortie de modèle. La machine sait dire où quatorze passages divergent sur la relation entre deux directeurs ; elle ne sait pas dire ce que cette relation fait à l'entreprise, ni où appuyer pour la changer.
La production du livrable. Génération dans le modèle standard, puis réécriture de jugement. Frontière la plus subtile, et la plus souvent franchie par inadvertance : la machine écrit ce qui rapporte — ce qui a été dit, mesuré, établi — et jamais ce qui conclut — ce que cela signifie, ce qu'il faut faire, à quel point d'appui agir. Les phrases qui concluent sont écrites par la personne qui les signe.
La capitalisation. Un corpus méthodologique gouverné — verbatims anonymisés, régularités observées, calibrage — améliore la mission suivante. La frontière : de la matière anonymisée seulement, sous règles de conservation, et jamais un modèle tiers nourri, l'exclusion de l'entraînement étant contractuelle chez chaque sous-traitant.
Des jours deviennent des heures, et les heures rendues repartent vers l'entretien, l'arbitrage et la restitution. Les honoraires ne rémunèrent pas la production : ils rémunèrent le jugement, la responsabilité et la signature.
04 · LA DÉMONSTRATION
3. Le cadre, et pourquoi il vous protège
L'évaluation des personnes au travail figure dans l'AI Act parmi les usages qualifiés de haut risque ; le paquet dit Digital Omnibus, adopté en 2026, en reporterait l'application — pour le point 4 de l'annexe III — au 2 décembre 2027 (réserve : à confirmer — avocat). Un report déplace une échéance, il ne change pas un cahier des charges. Une disposition, elle, ne bénéficie d'aucun report et s'applique depuis le 2 février 2025 : l'interdiction des systèmes visant à inférer les émotions d'une personne sur le lieu de travail (règlement (UE) 2024/1689, art. 5). Elle figure parmi les pratiques prohibées, celles qui portent, selon les indications disponibles, le plafond de sanction le plus élevé du règlement (réserve sur l'article de sanction invoqué : à confirmer — avocat). Le même texte impose d'informer les personnes lorsqu'elles interagissent avec un système d'intelligence artificielle ou qu'un contenu est produit par une machine.
S'y ajoute le point que presque personne n'anticipe : le règlement général sur la protection des données interdit qu'une décision produisant des effets significatifs soit fondée exclusivement sur un traitement automatisé — et la Cour de justice de l'Union européenne a jugé, dans sa jurisprudence sur le scoring (réserve : à confirmer — avocat), que lorsqu'un tiers produit un score et que le destinataire s'en sert de manière déterminante pour trancher, c'est le score lui-même qui constitue la décision automatisée. Un dirigeant qui achète des notes achète aussi le risque qui va avec.
L'état du droit résumé ici est celui de l'été 2026 et il continuera de bouger ; les dates et les périmètres se vérifient à la source avant chaque décision. Le cadre européen décrit, en creux, exactement l'architecture décrite plus haut.
La conformité documentée n'est donc pas un coût de mise en règle : c'est la forme qu'a prise une exigence antérieure, et, pour qui l'a construite avant les autres, une barrière à l'entrée.
Échanger 30 minutes sur une situation réelle — prendre rendez-vous
05 · LA DÉMONSTRATION
4. La science aux entrées, le jugement à l'intégration
Il y a dans cette activité une tentation qui vend bien : annoncer un indice maison calibré sur des milliers de profils. Nous ne la prenons pas, et le refus est raisonné.
La science des instruments ne se réinvente pas par qui dispose de puissance de calcul. La recherche a établi une hiérarchie de validité que l'on ne contourne pas : l'entretien structuré au sommet des méthodes de prédiction de la performance, très au-dessus de l'entretien libre ; les cinq grands facteurs pour les traits, dont la conscienciosité reste le prédicteur le plus robuste ; des mesures de niveau collectif validées pour les propriétés de l'équipe. Tout en bas, les typologies de séminaire d'entreprise, qui ne satisfont pas les standards psychométriques élémentaires. Un instrument propriétaire non validé se rangerait dans cette dernière catégorie, avec une meilleure interface.
L'intelligence artificielle industrialise l'instruction autour d'instruments validés ; elle n'en ajoute aucun. Gain d'instruction, pas d'évaluation.
Une limite, enfin, que la profession énonce peu : aucun instrument ne lit un collectif. Les tests profilent des personnes, une par une ; quelques instruments mesurent une propriété de l'équipe — la qualité de ses conditions de fonctionnement, la sécurité psychologique. Aucun ne produit la lecture-système : les complémentarités réelles, les lignes de fracture, le point où une action limitée produirait l'effet maximal. Une équipe n'est pas la somme de ses profils — c'est un système ; le Goban en est la lecture. Cette lecture est un geste humain, et c'est celui-là qu'on achète.
La tentation la plus actuelle. Une pratique se répand, que nous refusons : faire produire par un modèle de langage, à partir d'une transcription, des scores de personnalité. Trois raisons cumulatives l'excluent. Scientifique : la validité est une propriété de la construction et de la validation sur des populations, pas de la sortie — le nombre ressemble à un score, il n'en est pas un. Juridique : c'est exactement l'inférence, par une machine, de caractéristiques d'une personne, que notre ligne exclut. Pratique : le score déduit d'un texte ne peut être ni contesté par la personne, ni réexaminé par un contradicteur. C'est, littéralement, l'objet que personne ne peut signer.
La science se choisit, elle ne se fabrique pas ; l'intégration se juge, elle ne se calcule pas. La couche qui ne s'achète à personne est la seconde.
06 · LA DÉMONSTRATION
5. La gouvernance prouvable
Le dossier existe, ou le dispositif ne vaut rien. Il contient le consentement écrit spécifique à l'enregistrement, distinct de l'accord donné au principe de l'évaluation, avec l'information sur les destinataires, les finalités et les durées. Il contient la trace de la restitution individuelle : chaque personne évaluée reçoit ce qui la concerne — c'est le meilleur test de sérieux d'un dispositif. Ce qui empêche la restitution n'est pas la confidentialité, mais l'embarras.
Tout cela demeure invérifiable de l'extérieur ; la seule réponse consiste à ouvrir. Nous acceptons trois choses qui ne sont pas d'usage dans le secteur : que le protocole soit examiné avant la mission par le délégué à la protection des données du client ou par son conseil ; que la chaîne soit montrée — montrée, non décrite — poste par poste, à qui le demande ; et qu'un contradicteur désigné par le client puisse interroger la méthode au moment de la restitution. Aucune de ces ouvertures ne coûte rien à qui a construit correctement ; toutes trois sont impraticables pour qui a construit autrement.
Le double registre — ce que la frontière promet, ce que le jugement garantit — n'est pas un slogan : c'est un dispositif auditable. La frontière promet une profondeur d'instruction hors de portée artisanale, une mémoire sans faille, une triangulation exhaustive, un coût de production qui finance le jugement plutôt que de le remplacer. Le jugement garantit qu'aucune personne n'est évaluée par une machine, que le processus est consenti et restitué, et qu'une conclusion humaine, motivée et opposable, est signée par quelqu'un qui en répond. La première moitié de cette phrase sans la seconde décrit un produit dangereux ; la seconde sans la première décrit un artisanat dépassé. Elles ne se citent qu'ensemble.
07 · LA CHUTE
L'intelligence agencée
Revenons à la machine du début, celle qui a tout lu. On la croit bridée. Elle est agencée — et c'est cet agencement, précisément défini, qui rend le reste possible : la profondeur sans l'arbitraire, la vitesse sans la précipitation, la mémoire sans le fichage.
Ce que cela promet à ceux qui décident, dirigeants, conseils ou investisseurs, tient en deux propositions solidaires. Une instruction que personne ne pouvait produire il y a trois ans, parce qu'aucune attention humaine ne couvrait ce volume dans ce délai. Et, au bout, une conclusion que quelqu'un signe et dont ce quelqu'un répond — devant le comité qui décide, devant la personne évaluée, devant le juge s'il le faut.
La question qui séparera bientôt les prestataires sérieux des autres n'est déjà plus « que sait faire votre intelligence artificielle ? ». Elle est double, et il faut poser les deux moitiés ensemble : qu'est-ce que votre agencement rend possible — et que lui avez-vous interdit ? Montrez-moi les deux. C'est une question que tout décideur peut poser dès demain, à nous comme à quiconque, et dont la réponse — un dossier, ou une gêne — en dit plus long que n'importe quelle démonstration.
Il n'y a pas de jugement sans quelqu'un pour en répondre. Tout le reste — la vitesse, la profondeur, la mémoire, l'exhaustivité — la machine le donne, et elle le donnera de mieux en mieux. Celui-là, non. C'est pour cela qu'on l'agence.
Échanger 30 minutes sur une situation réelle : une décision d'équipe qui n'a pas de seconde chance, une succession à préparer, un dispositif d'évaluation à mettre à l'épreuve. Sans dossier à préparer, sans engagement — prendre rendez-vous
L'appareil
Ce qui rend ce texte défendable plutôt que persuasif : l'ouverture en entier, le faux dilemme, le principe d'architecture au complet, les limites de la pratique et le cadre juridique tel qu'il est écrit.
La machine qui a tout lul'ouverture, en entier
Le statut de ce texte, dit d'emblée parce qu'il commande la lecture : c'est une démonstration théorique. La scène qui suit est une situation type, inspirée de situations réelles. Ce document n'invoque aucun résultat de mission, aucun cas client, aucune donnée propriétaire.
À la fin d'une mission d'évaluation d'une équipe dirigeante, la machine a tout lu. Les quatorze heures d'entretiens, transcrites au mot près. Le plan stratégique et ses trois révisions successives. Deux ans de comptes rendus de comité de direction. L'organigramme officiel, et celui que personne n'a jamais dessiné mais que les échanges laissent apparaître. Les restitutions des instruments. La documentation du projet que cette équipe est censée porter. Elle a tout en mémoire, simultanément, sans fatigue et sans oubli.
Il lui faudrait quelques secondes pour produire ce qu'on lui demande partout ailleurs : un classement des cinq dirigeants, une note par personne, un indice de risque de départ, une recommandation de remplacement.
Elle ne le fera pas. Non parce qu'elle en serait incapable — elle en est parfaitement capable, et c'est très exactement le problème — mais parce que la chaîne dans laquelle elle travaille a été construite pour qu'elle ne le fasse jamais, et parce que cette interdiction est vérifiable ligne à ligne.
Cette machine-là n'existait pas il y a trois ans, et le fait qu'elle existe est le sujet d'un autre de nos documents : Ce monde qui vient soutient que l'intelligence a toujours été rationnée, que la rareté se lève, et que ce qui s'ouvre alors n'est pas d'abord une ère de remplacement mais d'élargissement. Restait à savoir ce qu'on en fait quand ce qu'on instruit, ce sont des personnes. C'est l'objet de celui-ci.
Reste la question que personne ne pose dans cet ordre. Non pas « qu'est-ce qu'on lui interdit ? », qui viendra — mais : qu'est-ce que cela rend possible ? Car une machine qui a lu quatorze heures d'entretiens, deux ans de comptes rendus et le projet que cette équipe est censée porter, sans fatigue et sans oubli, met à disposition quelque chose qui n'a jamais existé : un dossier instruit en entier, à l'échelle d'une décision réelle, dans le temps d'une décision réelle.
Ce que ce document décrit est cette capacité, et le travail qu'elle exige. Car elle ne se ramasse pas : une chaîne d'intelligence branchée sans conception sur un problème produit du volume, du plausible et de la confusion — plus vite qu'avant. Ce qui transforme la puissance en valeur porte un nom, et c'est le métier de cet atelier : le design de l'intelligence, la conception de l'interface entre une capacité et les humains qui décident.
On juge d'ordinaire un dispositif d'intelligence artificielle à ce qu'il sait faire. Nous soutiendrons qu'il faut le juger à deux choses ensemble : ce qu'il rend possible, et ce qu'on lui a interdit — les deux étant liés plus étroitement qu'on ne le croit, puisque, dans un métier qui porte sur des personnes, c'est l'interdit qui produit la matière. Ce n'est pas une plaquette : c'est la description d'une architecture, livrée avec ses limites et exposée à la contradiction. Le lecteur qui voudra la mettre en défaut trouvera ici de quoi le faire — c'est la condition pour qu'elle vaille quelque chose.
Le faux dilemmel'artisan, le logiciel, et pourquoi les deux survivent
Cette exigence d'agencement, le marché la satisfait aujourd'hui par deux offres, et aucune des deux ne tient. Tout dirigeant qui a cherché de l'aide sur une décision humaine difficile — recruter un membre de son comité de direction, arbitrer une succession, savoir si l'équipe en place portera la phase qui s'ouvre — a rencontré deux familles de réponses, et les a trouvées l'une et l'autre insatisfaisantes sans toujours parvenir à dire pourquoi.
D'un côté, la pratique à la main : un jugement d'expert exprimé avec assurance. Quatre entretiens conduits, ce qui peut être lu l'est, et un avis rendu dont la qualité tient à une finesse personnelle. La démarche est sincère et souvent juste. Mais elle est seule devant un volume qu'aucune attention humaine ne couvre : le plan stratégique lu en diagonale, retenu de l'entretien de mardi ce qui rimait avec celui de jeudi, triangulé ce dont on se souvient. La confiance dans un jugement d'expert, la recherche l'établit depuis longtemps, est très faiblement corrélée à sa justesse. Ce n'est pas un défaut de compétence : c'est la condition normale d'un cerveau humain devant trop de matière.
De l'autre, le logiciel. Une plateforme qui fait passer des tests, agrège, et rend un tableau de bord : des scores, un indice d'adéquation, parfois un feu tricolore. Le volume, cette fois, n'est plus le problème. Mais l'objet produit n'est signé par personne. Il ne s'explique pas à la personne concernée autrement qu'en lui lisant sa propre note. Il ne s'oppose pas devant un conseil, parce qu'aucun contradicteur ne peut interroger la chaîne qui l'a produit. Et il déplace, en silence, un risque juridique sur celui qui s'en sert — nous y reviendrons, c'est le point le plus mal connu du sujet.
L'erreur consiste à croire qu'il faut choisir. Les deux réponses échouent sur le même point, par des chemins opposés : elles confondent le volume de l'instruction avec la qualité du jugement. L'artisan a le jugement et lui refuse le volume qui le rendrait solide. Le logiciel a le volume et croit qu'il produit du jugement.
Si ces deux offres survivent côte à côte, ce n'est pas par inattention du marché : chacune répond à une ligne budgétaire réelle. L'artisan est acheté quand la décision est trop sensible pour être confiée à un outil, et il l'est souvent à titre presque confidentiel, par une personne plutôt que par une organisation. Le logiciel est acheté quand le volume est trop grand pour être traité autrement, et il l'est par une direction qui doit rendre compte d'un processus. Les deux besoins sont légitimes ; ils ne sont simplement jamais servis ensemble. Et c'est aux étages où les décisions sont à la fois rares et lourdes — le comité de direction, le conseil, l'équipe d'une participation — que l'absence d'une troisième réponse se paie le plus cher, puisqu'on y a besoin des deux à la fois : de la profondeur qu'aucun homme seul ne produit, et de l'engagement qu'aucun logiciel ne porte.
Or l'époque vient de rebattre les cartes de ce faux dilemme, et elle les rebat des deux côtés à la fois. Le travail cognitif d'analyse a été reprécié à la baisse, définitivement : ce qui se vendait hier en jours-homme se produit aujourd'hui en heures-machine — ce qui retire à l'artisan son excuse. Et ce qui se raréfie en proportion est précisément ce que la machine ne portera pas : le jugement qui engage une responsabilité, l'accès consenti aux personnes, la confiance d'un comité, la signature au bas d'une conclusion — ce qui retire au logiciel sa prétention. Nous avons argumenté ce mouvement pour lui-même dans Ce monde qui vient ; il suffit ici d'en retenir qu'aucune des deux offres existantes n'en sort intacte.
D'où le cadre de tout ce document : l'intelligence de frontière élargit ce qu'un praticien peut instruire ; le jugement gouverné est ce qui en fait une décision. L'écart ne se rattrape plus à la main. Le logiciel ne peut pas produire ce qu'un décideur achète réellement, qui n'est pas une probabilité mais quelqu'un qui répond de sa lecture. Le différenciant n'est donc ni l'outil ni l'expert : c'est le design qui les articule — et un design, contrairement à un talent, se décrit, se vérifie et se conteste.
Le principe d'architecture, en entierla grammaire des verbes, l'interdit d'inférence émotionnelle, l'objection du signataire
Nous arrivons au choix de conception qui commande tous les autres, et il faut dire d'emblée pourquoi il figure ici et non dans un chapitre de conformité. Ce n'est pas une prudence ajoutée à une capacité : c'est ce qui rend la capacité productive. Une chaîne qui note assèche sa propre source — un dirigeant qui se sait évalué par une machine livre la version présentable de lui-même, et il n'y a plus rien à instruire. L'interdit n'ampute pas la performance du dispositif : il la produit. Tout le reste de ce chapitre est la traduction de cette idée en spécifications.
Deux ateliers peuvent employer les mêmes modèles, lire le même corpus, mobiliser la même puissance de calcul, et produire des objets de natures opposées. L'un rend une note sur une personne. L'autre rend un dossier instruit qu'un être humain conclut et signe. La différence ne tient pas à la technologie : elle tient à l'endroit où la ligne a été tracée, et à la rigueur avec laquelle elle est tenue.
Notre ligne est la suivante, et elle est invariante : la machine n'évalue jamais une personne · aucune décision n'est automatisée · le processus est consenti et restitué · chaque conclusion est signée.
Ce n'est pas une prudence morale ajoutée après coup. Trois nécessités d'ordres différents convergent vers cette règle, et c'est cette convergence qui la rend solide.
La condition du matériau. Un dirigeant ne se livre pas à un système qui le note. Il se livre à une praticienne qui l'écoute, dans un processus dont il connaît les règles, et dont il sait qu'il recevra ce qui le concerne. Cette évidence a une conséquence d'architecture que l'on mesure rarement : l'interdit ne se pose pas par-dessus la collecte, il est ce qui rend la collecte possible. Une chaîne qui note assèche sa propre source — elle obtient des entretiens de façade, des réponses calibrées, la version présentable de chacun. Autrement dit, la qualité de ce que la machine aura à instruire est fonction de ce qu'on lui a interdit. C'est le renversement le plus contre-intuitif de tout le sujet : la restriction n'ampute pas la performance du dispositif, elle la produit.
La protection juridique de tous. C'est l'objet de la section 5 et il suffit de le rappeler : la ligne maintient le service du bon côté de deux régimes — celui des systèmes à haut risque, celui de la décision automatisée — et elle protège le client autant que le prestataire, puisque l'exposition voyage avec celui qui s'appuie de manière déterminante sur le résultat.
La définition de ce qui s'achète. Un comité de direction, un conseil, un comité d'investissement n'achètent pas un score. Ils achètent une conclusion que quelqu'un signe et dont ce quelqu'un répondra — devant eux, devant la personne évaluée, devant un juge le cas échéant. Une machine ne peut pas signer, non pour des raisons techniques mais parce que la responsabilité n'est pas une fonctionnalité : c'est une relation juridique et morale entre des personnes. On n'achète pas une probabilité ; on achète quelqu'un qui répond de sa lecture. La ligne rouge n'est donc pas une contrainte qui pèse sur le produit : elle est la définition du produit.
Reste à traduire tout cela dans une chaîne réelle, car un principe qui ne descend pas dans les spécifications n'est qu'une intention.
La grammaire des verbes. Un prompt n'est pas une manière de parler à une machine : c'est une spécification. La chaîne est donc écrite avec les verbes de l'instruction — veiller, préparer, transcrire, structurer, croiser, recouper, relever, contrôler, mettre en forme — et jamais avec ceux du verdict — évaluer, noter, classer, prédire, qualifier, recommander. Ce n'est pas une précaution de vocabulaire. Une consigne qui demande à un modèle d'« évaluer la solidité du directeur général » a construit un système d'évaluation, quoi qu'en dise la plaquette commerciale, et la qualification juridique suivra la réalité de l'instruction, pas son habillage. Une consigne qui demande de « relever tous les passages où le directeur général décrit sa manière de trancher, avec leurs références » a construit un système d'instruction. Même modèle, même corpus, deux produits, deux régimes de droit. C'est pourquoi les formulations commerciales elles-mêmes engagent : un marketing qui laisse entendre que l'IA évalue peut requalifier le service que l'atelier, lui, avait correctement construit.
La règle la plus stricte de l'atelier : aucune inférence émotionnelle par la machine. Nous nous plaçons ici volontairement au-dessus du minimum légal. Ce qui est autorisé, c'est l'analyse du contenu : ce que la personne dit, les faits qu'elle rapporte, la structure et la cohérence de son récit, les convergences et les contradictions entre les entretiens, les instruments et les pièces. Ce qui est interdit à la machine, c'est l'inférence d'un état affectif ou psychologique — anxiété, tension, enthousiasme, abattement — à partir de la voix, du visage, du rythme, des hésitations, de tout signal para-verbal, et, dans notre règle maison, à partir de quelque canal que ce soit, y compris le seul choix des mots. En pratique : la transcription est verbatim et rien d'autre, sans annotation de ton ni marqueur affectif ; aucune analyse prosodique, faciale ou vidéo ; aucun module d'analyse de sentiment dans l'atelier, et tout outil tiers qui en embarquerait un le voit désactivé contractuellement ou se voit écarté.
Et lorsqu'un modèle produit spontanément une qualification de cette nature — « semble mal à l'aise », « ton défensif » —, le passage n'est ni retenu, ni reformulé, ni discrètement recyclé : il est écarté, et l'incident est consigné au journal de la mission, avec sa date, le poste de la chaîne concerné et le remède apporté. Ce détail paraît mineur ; il est le seul qui prouve quoi que ce soit. Une règle dont on ne consigne pas les manquements n'est pas une règle, c'est une intention.
Où passe, alors, l'observation humaine ? Toute observation d'ordre affectif ou psychologique figurant dans un livrable est une observation faite en entretien par la praticienne, rédigée et signée par elle, et le livrable en documente la provenance. La machine ne propose jamais de premier jet sur ce registre — il n'existe aucune exception de premier jet, parce que le premier jet est précisément l'endroit où le jugement de la machine entrerait sans bruit dans celui de l'humain, sous couvert de gain de temps.
L'objection sérieuse : et si l'humain se contentait de signer ? C'est la seule objection qui compte vraiment, et il faut l'affronter, parce que tout le secteur invoque aujourd'hui l'humain dans la boucle. Le droit lui-même ne demande pas une intervention humaine, il demande une intervention humaine significative — le qualificatif fait tout le travail. Or la recherche sur le biais d'automatisation établit qu'un opérateur chargé de valider une proposition machine tend à l'accepter, et d'autant plus que cette proposition est bien écrite, assurée, et coûteuse à contredire. Une synthèse bien formée est un ancrage remarquablement efficace. Affirmer « c'est l'humain qui décide » ne prouve donc rien : c'est précisément ce qu'il faut démontrer, par la construction de la chaîne.
Trois dispositions y pourvoient. L'ordre des opérations, d'abord : la praticienne forme et écrit sa propre lecture avant de recevoir la structuration de la machine, jamais après. Un jugement formé en premier peut être corrigé par la matière ; un jugement formé en second est presque toujours une ratification. La nature de ce qui remonte aux postes conclusifs, ensuite : la machine ne remet pas des synthèses mais des passages, avec leurs références. Une synthèse invite à l'acquiescement ; un ensemble de citations sourcées oblige à relire. Le design rend délibérément le chemin commode un peu plus coûteux que le chemin juste. L'exposition des contradictions, enfin : là où les sources divergent, la tâche de la machine est de rapporter la divergence intacte, jamais de l'harmoniser. Une chaîne qui lisse les contradictions produit un document confortable et un diagnostic inutilisable.
Le contrôle qui en découle est vérifiable : les phrases qui concluent doivent se rattacher à des sources que le signataire a relues. Voilà ce que signifie concrètement une intervention humaine significative — non pas une case cochée en fin de parcours, mais un ordre de travail dans lequel ratifier coûte plus cher que juger. Une réserve d'honnêteté, pour finir : aucun design n'élimine le biais d'automatisation, il ne peut que le rendre coûteux et visible. Qui prétend l'avoir supprimé ne l'a pas cherché.
La ligne rouge n'est donc pas une contrainte posée sur l'architecture : elle est l'architecture. Elle ne se déclare pas dans une brochure — elle se lit dans les consignes, dans les journaux et dans les points de contrôle, où n'importe quel contradicteur sérieux peut aller la vérifier.
Ce que la pratique ne résout pasprésence, cadrage, prédiction, accès consenti
Ce que l'atelier ne résout pas. La frontière déplace le coût de l'instruction ; elle ne déplace pas les limites du métier, et un document qui les tairait ne mériterait pas d'être lu. Elle ne remplace pas la présence : ce qu'une personne accepte de dire, et ce qu'elle laisse voir, dépend de qui se trouve en face d'elle — un entretien mal conduit sera instrumenté à la perfection, et il restera un mauvais matériau. La chaîne amplifie la qualité de la collecte, dans les deux sens. Elle ne corrige pas davantage un cadrage manqué : si la mission a été cadrée sur la mauvaise question — et le sujet présenté est rarement le vrai sujet —, tout l'appareil instruira la mauvaise question avec une rigueur exemplaire. La profondeur d'instruction est un multiplicateur du cadrage, jamais son substitut. Elle ne rend pas la prédiction certaine : toute lecture d'un être humain demeure probabiliste, et le restera. Une évaluation structurée améliore la qualité d'un pari ; elle ne le transforme pas en certitude, et le prestataire qui laisse croire l'inverse prépare une déception, parfois un contentieux. Elle ne dispense pas, enfin, d'un accès consenti aux personnes : là où cet accès n'existe pas — et il existe des situations où il ne peut pas exister —, la réponse honnête est que la mission ne se fait pas, non qu'elle se ferait sur pièces.
Ces limites ne sont pas des réserves d'usage reléguées en bas de page. Elles appartiennent au design au même titre que les interdits : un dispositif qui prétend les avoir levées a simplement cessé de les regarder.
Le cadre juridique, en entierla catégorie, l'interdit en vigueur, la transparence, et le point que personne n'anticipe
Un lecteur qui a suivi jusqu'ici peut légitimement demander ce que le droit européen dit de tout cela. La réponse tient en peu de lignes, et elle est favorable à qui a conçu correctement.
L'évaluation des personnes au travail figure dans l'AI Act parmi les usages qualifiés de haut risque ; le paquet dit Digital Omnibus, adopté en 2026, en reporterait l'application — pour le point 4 de l'annexe III — au 2 décembre 2027 (réserve : à confirmer — avocat). Un report déplace une échéance, il ne change pas un cahier des charges. Une disposition, elle, ne bénéficie d'aucun report et s'applique depuis le 2 février 2025 : l'interdiction des systèmes visant à inférer les émotions d'une personne sur le lieu de travail (règlement (UE) 2024/1689, art. 5). Elle figure parmi les pratiques prohibées, celles qui portent, selon les indications disponibles, le plafond de sanction le plus élevé du règlement (réserve sur l'article de sanction invoqué : à confirmer — avocat). Le même texte impose d'informer les personnes lorsqu'elles interagissent avec un système d'intelligence artificielle ou qu'un contenu est produit par une machine.
S'y ajoute le point que presque personne n'anticipe, et qui concerne le lecteur autant que son prestataire : le règlement général sur la protection des données interdit qu'une décision produisant des effets significatifs soit fondée exclusivement sur un traitement automatisé — et la Cour de justice de l'Union européenne a jugé, dans sa jurisprudence sur le scoring (réserve : à confirmer — avocat), que lorsqu'un tiers produit un score et que le destinataire s'en sert de manière déterminante pour trancher, c'est le score lui-même qui constitue la décision automatisée. Autrement dit : celui qui déploie répond, pas seulement celui qui fournit. Un dirigeant qui achète des notes achète aussi le risque qui va avec.
Dernier point, souvent mal réglé : dans une relation de subordination, le consentement d'un salarié est une base juridique fragile, parce que le déséquilibre entre les parties fragilise la liberté du refus. Cela ne dispense pas d'obtenir un accord loyal — cela oblige à documenter par ailleurs la base légale du traitement, dans le registre et l'analyse d'impact.
L'état du droit résumé ici est celui de l'été 2026 et il continuera de bouger ; les dates et les périmètres se vérifient à la source avant chaque décision. Ce qu'il faut en retenir n'est pas une liste d'obligations : c'est que le cadre européen décrit, en creux, exactement l'architecture décrite plus haut. Qui l'a construite avant les autres n'a rien à rattraper.
La conformité documentée n'est donc pas un coût de mise en règle : c'est la forme qu'a prise une exigence antérieure, et, pour qui l'a construite avant les autres, une barrière à l'entrée.
Où aller ensuiteles deux autres volets du triptyque
Où aller ensuite. La thèse générale dont ce document est l'application technique se lit dans Ce monde qui vient (livre blanc n° 1). Son application aux décisions de capital se lit dans L'angle mort (livre blanc n° 2), où figure aussi le développement complet de l'appareil scientifique mobilisé ici.
Frontière — frontiere.ai — alice@frontiere.ai
Références. Les travaux mobilisés en filigrane dans ce document sont ceux qui fondent la hiérarchie de validité des méthodes d'évaluation (Schmidt et Hunter sur la validité prédictive des méthodes de sélection ; Barrick et Mount sur le modèle en cinq facteurs), la lecture des équipes dirigeantes comme systèmes (Hambrick et Mason sur les échelons supérieurs ; Wageman et Hackman sur les conditions de fonctionnement des équipes de direction ; Edmondson sur la sécurité psychologique) et l'analyse des organisations en boucles de rétroaction (Burns et Stalker ; Forrester ; Senge). Le développement complet de cet appareil figure dans notre livre blanc n° 1, Ce monde qui vient.
Ce texte est l'argument. Son développement — les élaborations, le cadre en entier, les objections traitées une à une — se télécharge.
Le développement complet — 30 minutes (PDF)