{"id":325632,"date":"2026-09-02T05:07:11","date_gmt":"2026-09-02T02:07:11","guid":{"rendered":"https:\/\/ceotudent.com\/supervision-humaine-par-conception-points-de-controle-agents-ia"},"modified":"2026-09-02T05:07:11","modified_gmt":"2026-09-02T02:07:11","slug":"supervision-humaine-par-conception-points-de-controle-agents-ia","status":"publish","type":"post","link":"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia","title":{"rendered":"Supervision humaine par conception : o\u00f9 placer les points de contr\u00f4le quand des agents IA font le travail"},"content":{"rendered":"<p><strong>TL;DR :<\/strong> &ldquo;Gardez un humain dans la boucle&rdquo; est devenu la r\u00e9ponse standard \u00e0 toute question sur les agents IA, et ce n&rsquo;est pas une r\u00e9ponse. Une boucle a une forme : o\u00f9 l&rsquo;humain se tient, ce qu&rsquo;on lui montre, ce qu&rsquo;il peut arr\u00eater et ce qui se passe quand il laisse passer quelque chose. Les mesures publiques permettent de concevoir cette forme au lieu de la deviner. Les travaux de METR sur l&rsquo;horizon temporel montrent que la dur\u00e9e de t\u00e2che qu&rsquo;un agent ach\u00e8ve \u00e0 80 pour cent de r\u00e9ussite est environ cinq fois plus courte qu&rsquo;\u00e0 50 pour cent, avec un \u00e9cart de 59 \u00e0 15 minutes pour le mod\u00e8le le plus fort de l&rsquo;\u00e9chantillon, et que les deux horizons doublent \u00e0 peu pr\u00e8s au m\u00eame rythme, environ tous les sept mois. Le banc d&rsquo;essai tau-bench a mesur\u00e9 une r\u00e9ussite en une tentative inf\u00e9rieure \u00e0 50 pour cent et une constance sur huit tentatives inf\u00e9rieure \u00e0 25 pour cent pour des agents de pointe \u00e0 appel de fonctions, chiffre bien sup\u00e9rieur \u00e0 ce que produirait un \u00e9chec al\u00e9atoire par tentative, ce qui implique que les \u00e9checs se concentrent sur certaines t\u00e2ches. \u00c0 partir de ces deux constats, de l&rsquo;article 14 du r\u00e8glement europ\u00e9en sur l&rsquo;IA et de la litt\u00e9rature sur le biais d&rsquo;automatisation, cet article construit une matrice de placement fond\u00e9e sur deux questions : combien co\u00fbte l&rsquo;annulation, et le remarqueriez-vous si cela tournait mal ?<\/p>\n<p>Il y a un moment pr\u00e9cis qui se r\u00e9p\u00e8te partout dans le travail professionnel en ce moment. Un agent s&rsquo;ex\u00e9cute, produit un bloc de sortie assur\u00e9, et une personne le regarde onze secondes puis l&rsquo;approuve. Rien dans ce moment n&rsquo;est un point de contr\u00f4le. Il en a la forme et aucune des fonctions, et la personne qui le fait le sait g\u00e9n\u00e9ralement.<\/p>\n<p>L&rsquo;instinct qui consiste \u00e0 corriger cela en regardant plus attentivement est mauvais, car le probl\u00e8me n&rsquo;est pas l&rsquo;attention. C&rsquo;est le placement. Un point de contr\u00f4le mal situ\u00e9 co\u00fbte la m\u00eame attention et n&rsquo;attrape rien.<\/p>\n<div id=\"ez-toc-container\" class=\"ez-toc-v2_0_84 counter-hierarchy ez-toc-counter ez-toc-grey ez-toc-container-direction\">\n<div class=\"ez-toc-title-container\">\n<p class=\"ez-toc-title\" style=\"cursor:inherit\">Table of Contents<\/p>\n<span class=\"ez-toc-title-toggle\"><a href=\"#\" class=\"ez-toc-pull-right ez-toc-btn ez-toc-btn-xs ez-toc-btn-default ez-toc-toggle\" aria-label=\"Toggle Table of Content\"><span class=\"ez-toc-js-icon-con\"><span class=\"\"><span class=\"eztoc-hide\" style=\"display:none;\">Toggle<\/span><span class=\"ez-toc-icon-toggle-span\"><svg style=\"fill: #999;color:#999\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" class=\"list-377408\" width=\"20px\" height=\"20px\" viewBox=\"0 0 24 24\" fill=\"none\"><path d=\"M6 6H4v2h2V6zm14 0H8v2h12V6zM4 11h2v2H4v-2zm16 0H8v2h12v-2zM4 16h2v2H4v-2zm16 0H8v2h12v-2z\" fill=\"currentColor\"><\/path><\/svg><svg style=\"fill: #999;color:#999\" class=\"arrow-unsorted-368013\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"10px\" height=\"10px\" viewBox=\"0 0 24 24\" version=\"1.2\" baseProfile=\"tiny\"><path d=\"M18.2 9.3l-6.2-6.3-6.2 6.3c-.2.2-.3.4-.3.7s.1.5.3.7c.2.2.4.3.7.3h11c.3 0 .5-.1.7-.3.2-.2.3-.5.3-.7s-.1-.5-.3-.7zM5.8 14.7l6.2 6.3 6.2-6.3c.2-.2.3-.5.3-.7s-.1-.5-.3-.7c-.2-.2-.4-.3-.7-.3h-11c-.3 0-.5.1-.7.3-.2.2-.3.5-.3.7s.1.5.3.7z\"\/><\/svg><\/span><\/span><\/span><\/a><\/span><\/div>\n<nav><ul class='ez-toc-list ez-toc-list-level-1 ' ><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Ce-que-disent-reellement-les-donnees-de-fiabilite\" >Ce que disent r\u00e9ellement les donn\u00e9es de fiabilit\u00e9<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-2\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Linference-que-personne-ne-tire-de-pass8\" >L&rsquo;inf\u00e9rence que personne ne tire de pass^8<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-3\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Ou-va-un-point-de-controle-deux-questions-quatre-reponses\" >O\u00f9 va un point de contr\u00f4le : deux questions, quatre r\u00e9ponses<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-4\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#La-structure-de-supervision-quil-vaut-la-peine-demprunter-a-la-reglementation\" >La structure de supervision qu&rsquo;il vaut la peine d&rsquo;emprunter \u00e0 la r\u00e9glementation<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-5\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Pourquoi-un-point-de-controle-existant-peut-malgre-tout-echouer\" >Pourquoi un point de contr\u00f4le existant peut malgr\u00e9 tout \u00e9chouer<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-6\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#En-pratique-un-cas-deroule\" >En pratique : un cas d\u00e9roul\u00e9<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-7\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Dimensionner-le-bloc-non-supervise\" >Dimensionner le bloc non supervis\u00e9<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-8\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Foire-aux-questions\" >Foire aux questions<\/a><\/li><li class='ez-toc-page-1 ez-toc-heading-level-2'><a class=\"ez-toc-link ez-toc-heading-9\" href=\"https:\/\/ceotudent.com\/fr\/supervision-humaine-par-conception-points-de-controle-agents-ia\/#Sources\" >Sources<\/a><\/li><\/ul><\/nav><\/div>\n<h2 id=\"ce-que-disent-rellement-les-donnes-de-fiabilit\"><span class=\"ez-toc-section\" id=\"Ce-que-disent-reellement-les-donnees-de-fiabilite\"><\/span>Ce que disent r\u00e9ellement les donn\u00e9es de fiabilit\u00e9<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Deux mesures font ici l&rsquo;essentiel du travail, et aucune ne porte sur l&rsquo;intelligence des mod\u00e8les.<\/p>\n<p>La premi\u00e8re est la recherche de METR sur l&rsquo;horizon temporel, qui pose une question de forme inhabituellement pratique : quelle longueur de t\u00e2che, mesur\u00e9e par le temps qu&rsquo;un expert humain met \u00e0 l&rsquo;accomplir, un mod\u00e8le peut-il achever \u00e0 un taux de r\u00e9ussite donn\u00e9 ? Pour les mod\u00e8les publi\u00e9s entre 2019 et 2025, l&rsquo;horizon temporel \u00e0 50 pour cent a cr\u00fb de fa\u00e7on exponentielle avec un temps de doublement d&rsquo;environ sept mois. Ce titre est cit\u00e9 en permanence. La partie qui compte pour la conception des points de contr\u00f4le ne l&rsquo;est presque jamais.<\/p>\n<p>METR a aussi calcul\u00e9 l&rsquo;horizon \u00e0 80 pour cent de r\u00e9ussite. Le temps de doublement est quasi identique, 213 jours contre 212 pour l&rsquo;horizon \u00e0 50 pour cent : la vitesse de progression n&rsquo;est donc pas le probl\u00e8me. Ce sont les niveaux. Selon les termes de METR, les horizons au seuil de fiabilit\u00e9 sup\u00e9rieur sont environ cinq fois plus courts sur l&rsquo;ensemble des mod\u00e8les \u00e9tudi\u00e9s, et le mod\u00e8le au plus long horizon \u00e0 80 pour cent de l&rsquo;\u00e9chantillon, Claude 3.7 Sonnet, se situait autour de 15 minutes contre un horizon \u00e0 50 pour cent de 59 minutes, soit un \u00e9cart d&rsquo;un peu moins de quatre fois pour ce mod\u00e8le pr\u00e9cis.<\/p>\n<table>\n<thead>\n<tr>\n<th>Mesure (METR, mod\u00e8les publi\u00e9s de 2019 \u00e0 2025)<\/th>\n<th>Taux de r\u00e9ussite de 50 pour cent<\/th>\n<th>Taux de r\u00e9ussite de 80 pour cent<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td>Horizon le plus long mesur\u00e9 dans l&rsquo;\u00e9chantillon (Claude 3.7 Sonnet)<\/td>\n<td>59 minutes<\/td>\n<td>environ 15 minutes<\/td>\n<\/tr>\n<tr>\n<td>Mod\u00e8les de pointe ant\u00e9rieurs (GPT-4, Claude 3 Opus) sur la s\u00e9rie de t\u00e2ches difficiles<\/td>\n<td>Fourchette de 5 \u00e0 30 minutes<\/td>\n<td>Non rapport\u00e9 s\u00e9par\u00e9ment<\/td>\n<\/tr>\n<tr>\n<td>Temps de doublement de l&rsquo;horizon<\/td>\n<td>212 jours<\/td>\n<td>213 jours<\/td>\n<\/tr>\n<tr>\n<td>Horizon \u00e0 tr\u00e8s haut taux de r\u00e9ussite, par exemple 95 pour cent<\/td>\n<td>Non mesur\u00e9 ; METR indique ne pas pouvoir le mesurer avec confiance sur son jeu de donn\u00e9es<\/td>\n<td>Non mesur\u00e9<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p><em>Donn\u00e9es v\u00e9rifi\u00e9es. Source : METR, Measuring AI Ability to Complete Long Tasks, section comparant les horizons temporels \u00e0 50 et 80 pour cent de r\u00e9ussite.<\/em><\/p>\n<p>Lisez attentivement la derni\u00e8re ligne, car c&rsquo;est la plus utile du tableau. Personne n&rsquo;a publi\u00e9 de mesure fiable de la longueur de t\u00e2che qu&rsquo;un agent peut achever au niveau de fiabilit\u00e9 que vous exigeriez r\u00e9ellement avant de laisser quelque chose tourner sans surveillance. L&rsquo;\u00e9tat honn\u00eate des preuves est que l&rsquo;horizon \u00e0 haute fiabilit\u00e9 n&rsquo;est pas long : il n&rsquo;est pas mesur\u00e9.<\/p>\n<p>La seconde mesure porte sur la constance plut\u00f4t que sur la longueur. Le banc d&rsquo;essai tau-bench, construit par Yao, Shinn, Razavi et Narasimhan, \u00e9value des agents dans des domaines simul\u00e9s de commerce de d\u00e9tail et de transport a\u00e9rien o\u00f9 ils doivent utiliser des outils, suivre une politique de domaine \u00e9crite et converser avec un utilisateur simul\u00e9. Il a introduit une m\u00e9trique nomm\u00e9e pass^k, qui ne demande pas si un agent r\u00e9ussit une fois mais s&rsquo;il r\u00e9ussit lors des k tentatives ind\u00e9pendantes sur la m\u00eame t\u00e2che. Le constat de l&rsquo;article est net : les agents de pointe \u00e0 appel de fonctions comme gpt-4o r\u00e9ussissent moins de 50 pour cent des t\u00e2ches, et pass^8 tombe sous 25 pour cent dans le domaine du commerce de d\u00e9tail.<\/p>\n<h2 id=\"linfrence-que-personne-ne-tire-de-pass8\"><span class=\"ez-toc-section\" id=\"Linference-que-personne-ne-tire-de-pass8\"><\/span>L&rsquo;inf\u00e9rence que personne ne tire de pass^8<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>C&rsquo;est ici que les deux jeux de donn\u00e9es cessent d&rsquo;\u00eatre un d\u00e9cor et deviennent une contrainte de conception.<\/p>\n<p>Si les \u00e9checs \u00e9taient al\u00e9atoires d&rsquo;une tentative \u00e0 l&rsquo;autre, un agent ayant 50 pour cent de chances \u00e0 chaque essai r\u00e9ussirait huit fois de suite sur environ 0,4 pour cent des t\u00e2ches. C&rsquo;est 0,5 puissance huit. Le chiffre mesur\u00e9 est inf\u00e9rieur \u00e0 25 pour cent. Les deux valeurs du banc d&rsquo;essai sont rapport\u00e9es comme des bornes sup\u00e9rieures, le multiple exact ne peut donc pas \u00eatre fix\u00e9, mais la constance mesur\u00e9e d\u00e9passe de plus d&rsquo;un ordre de grandeur ce que produirait un \u00e9chec al\u00e9atoire par tentative.<\/p>\n<table>\n<thead>\n<tr>\n<th>Mod\u00e8le d&rsquo;\u00e9chec<\/th>\n<th>Part pr\u00e9dite des t\u00e2ches r\u00e9ussies huit fois<\/th>\n<th>Mesur\u00e9<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td>\u00c9checs ind\u00e9pendants par tentative, 50 pour cent de chances uniformes<\/td>\n<td>0,4 %<\/td>\n<td>Sans objet<\/td>\n<\/tr>\n<tr>\n<td>tau-bench commerce de d\u00e9tail, agent de pointe \u00e0 appel de fonctions<\/td>\n<td>Sans objet<\/td>\n<td>Moins de 25 %<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p><em>Cadre \u00e9ditorial CEOtudent : la valeur d&rsquo;ind\u00e9pendance est calcul\u00e9e par CEOtudent \u00e0 partir du taux de r\u00e9ussite en une tentative rapport\u00e9 par le banc d&rsquo;essai, pour comparaison avec le r\u00e9sultat pass^8 qu&rsquo;il rapporte. Le constat est l&rsquo;\u00e9cart entre les deux, non l&rsquo;un des deux chiffres.<\/em><\/p>\n<p>L&rsquo;\u00e9cart r\u00e9v\u00e8le la structure des \u00e9checs. Si le taux observ\u00e9 de huit r\u00e9ussites sur huit \u00e9tait proche de la pr\u00e9diction d&rsquo;ind\u00e9pendance, les erreurs d&rsquo;agent seraient essentiellement du bruit, et la bonne r\u00e9ponse serait la redondance : ex\u00e9cuter deux fois, comparer. Il n&rsquo;en est pas proche. Une grande part des t\u00e2ches r\u00e9ussit \u00e0 chaque fois et une grande part \u00e9choue \u00e0 chaque fois. La variation vit dans la t\u00e2che, pas dans l&rsquo;ex\u00e9cution.<\/p>\n<p>Ce seul fait structurel \u00e9limine les deux strat\u00e9gies de supervision les plus r\u00e9pandues aujourd&rsquo;hui.<\/p>\n<p>Le contr\u00f4le ponctuel al\u00e9atoire est faux, car les \u00e9checs ne sont pas r\u00e9partis au hasard. Pr\u00e9lever une sortie sur dix dans un ensemble m\u00e9lang\u00e9 confirmera sans cesse les t\u00e2ches fiables pendant que les t\u00e2ches non fiables \u00e9chouent de fa\u00e7on constante, sans surveillance.<\/p>\n<p>Ex\u00e9cuter deux fois et comparer est faux pour la m\u00eame raison. Une t\u00e2che que l&rsquo;agent rate syst\u00e9matiquement produira deux r\u00e9ponses assur\u00e9es, concordantes et fausses. L&rsquo;accord entre deux ex\u00e9cutions n&rsquo;est pas une preuve quand le mode d&rsquo;\u00e9chec est propre \u00e0 la t\u00e2che.<\/p>\n<p>Ce que la structure exige \u00e0 la place, c&rsquo;est la classification. Il faut savoir quelles t\u00e2ches appartiennent \u00e0 l&rsquo;ensemble fiable et lesquelles non, et le seul moyen de le savoir est d&rsquo;avoir mesur\u00e9, ce qui est la discipline d\u00e9crite dans <a href=\"\/en\/the-delegation-ceiling-why-professionals-fail-to-scale-ai-agents\">le plafond de d\u00e9l\u00e9gation<\/a>. Le point de contr\u00f4le se place sur la classe, pas sur l&rsquo;\u00e9chantillon.<\/p>\n<h2 id=\"o-va-un-point-de-contrle-deux-questions-quatre-rponses\"><span class=\"ez-toc-section\" id=\"Ou-va-un-point-de-controle-deux-questions-quatre-reponses\"><\/span>O\u00f9 va un point de contr\u00f4le : deux questions, quatre r\u00e9ponses<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Tout ce qui pr\u00e9c\u00e8de se resserre en une r\u00e8gle de placement. Deux propri\u00e9t\u00e9s d&rsquo;une t\u00e2che d\u00e9terminent o\u00f9 l&rsquo;humain doit se tenir, et aucune ne concerne sa difficult\u00e9.<\/p>\n<p>La premi\u00e8re est la r\u00e9versibilit\u00e9 : combien co\u00fbte l&rsquo;annulation ? La seconde est la d\u00e9tectabilit\u00e9 : si l&rsquo;agent s&rsquo;est tromp\u00e9, l&rsquo;erreur s&rsquo;annoncera-t-elle, ou restera-t-elle silencieuse six semaines dans un tableur ?<\/p>\n<table>\n<thead>\n<tr>\n<th><\/th>\n<th><strong>L&rsquo;erreur est visible<\/strong><\/th>\n<th><strong>L&rsquo;erreur est silencieuse<\/strong><\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td><strong>Annulation peu co\u00fbteuse<\/strong><\/td>\n<td><strong>Laisser courir.<\/strong> Aucun point de contr\u00f4le. Corriger \u00e0 la d\u00e9couverte, car la d\u00e9couverte est garantie et la correction bon march\u00e9. R\u00e9daction de brouillons, recherche exploratoire, plans, premiers r\u00e9sum\u00e9s.<\/td>\n<td><strong>\u00c9chantillonner et noter.<\/strong> Relecture d&rsquo;une part fixe avec une r\u00e8gle de notation \u00e9crite, sur une classe de t\u00e2ches d\u00e9finie plut\u00f4t qu&rsquo;au hasard. Extraction de donn\u00e9es, \u00e9tiquetage, cat\u00e9gorisation, transcription.<\/td>\n<\/tr>\n<tr>\n<td><strong>Annulation co\u00fbteuse<\/strong><\/td>\n<td><strong>Barri\u00e8re avant validation.<\/strong> Une approbation obligatoire imm\u00e9diatement avant l&rsquo;\u00e9tape irr\u00e9versible, pas plus t\u00f4t dans la cha\u00eene. Publier, envoyer, soumettre, fusionner.<\/td>\n<td><strong>Pr\u00e9-autoriser et v\u00e9rifier ind\u00e9pendamment.<\/strong> D\u00e9finir l&rsquo;ensemble des actions permises avant l&rsquo;ex\u00e9cution, et v\u00e9rifier le r\u00e9sultat contre une source qui n&rsquo;est pas le r\u00e9sum\u00e9 de l&rsquo;agent lui-m\u00eame. \u00c9critures financi\u00e8res, engagements externes, suppressions, tout ce qui touche le registre d&rsquo;un tiers.<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p><em>Matrice de placement des points de contr\u00f4le CEOtudent. Cadre \u00e9ditorial. L&rsquo;axe de r\u00e9versibilit\u00e9 rel\u00e8ve de la th\u00e9orie de la d\u00e9cision courante ; l&rsquo;axe de d\u00e9tectabilit\u00e9 et les quatre placements sont une construction de CEOtudent.<\/em><\/p>\n<p>Trois points de cette matrice m\u00e9ritent d&rsquo;\u00eatre explicit\u00e9s, car c&rsquo;est l\u00e0 que l&rsquo;on se trompe.<\/p>\n<p>La case en bas \u00e0 gauche dit que la barri\u00e8re se place imm\u00e9diatement avant l&rsquo;\u00e9tape irr\u00e9versible, et ce mot imm\u00e9diatement porte tout le poids. Une grande partie de ce qui passe pour de la supervision est une approbation plac\u00e9e au d\u00e9but d&rsquo;une cha\u00eene, sur un plan, suivie de l&rsquo;ex\u00e9cution non supervis\u00e9e de ce plan. Approuver le plan n&rsquo;est pas un point de contr\u00f4le sur le r\u00e9sultat. Le moment, c&rsquo;est la validation ; c&rsquo;est l\u00e0 que va le point de contr\u00f4le.<\/p>\n<p>La case en haut \u00e0 droite est celle que presque tout le monde n\u00e9glige. Les erreurs silencieuses dans un travail facile \u00e0 annuler paraissent inoffensives, et c&rsquo;est pr\u00e9cis\u00e9ment pour cela qu&rsquo;elles s&rsquo;accumulent. Une ligne mal class\u00e9e ne co\u00fbte rien le jour m\u00eame et co\u00fbte tout le trimestre o\u00f9 une d\u00e9cision est prise sur l&rsquo;agr\u00e9gat.<\/p>\n<p>La case en bas \u00e0 droite contient la seule consigne de la matrice qui exige une seconde source. Demander \u00e0 l&rsquo;agent s&rsquo;il a bien fait la t\u00e2che n&rsquo;est pas une v\u00e9rification : c&rsquo;est demander \u00e0 l&rsquo;\u00e9chec de se noter lui-m\u00eame. Le r\u00e9sum\u00e9 que l&rsquo;agent fait de sa propre ex\u00e9cution est produit par le processus m\u00eame qui a produit cette ex\u00e9cution.<\/p>\n<h2 id=\"la-structure-de-supervision-quil-vaut-la-peine-demprunter-la-rglementation\"><span class=\"ez-toc-section\" id=\"La-structure-de-supervision-quil-vaut-la-peine-demprunter-a-la-reglementation\"><\/span>La structure de supervision qu&rsquo;il vaut la peine d&rsquo;emprunter \u00e0 la r\u00e9glementation<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Il existe un texte qui r\u00e8gle un probl\u00e8me auquel la plupart des flux de travail individuels n&rsquo;ont jamais r\u00e9fl\u00e9chi, et il se trouve dans la loi.<\/p>\n<p>L&rsquo;article 14 du r\u00e8glement europ\u00e9en sur l&rsquo;intelligence artificielle fixe les exigences de supervision humaine pour les syst\u00e8mes d&rsquo;IA \u00e0 haut risque. Il lie les fournisseurs et d\u00e9ployeurs de ces syst\u00e8mes, non les particuliers utilisant un agent conversationnel, et cet article ne pr\u00e9tend pas le contraire. Ce qui le rend digne de lecture, c&rsquo;est qu&rsquo;il ne dit pas &ldquo;un humain doit relire la sortie&rdquo;. Il \u00e9num\u00e8re cinq capacit\u00e9s distinctes que la personne charg\u00e9e de la supervision doit pouvoir exercer, et ces cinq capacit\u00e9s recouvrent proprement les modes d&rsquo;\u00e9chec du travail ordinaire avec des agents.<\/p>\n<table>\n<thead>\n<tr>\n<th>Exigence de l&rsquo;article 14, paragraphe 4, pour les syst\u00e8mes d&rsquo;IA \u00e0 haut risque<\/th>\n<th>Traduction en flux de travail individuel avec un agent<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td>(a) Comprendre correctement les capacit\u00e9s et les limites du syst\u00e8me et surveiller son fonctionnement, y compris pour d\u00e9tecter anomalies, dysfonctionnements et performances inattendues<\/td>\n<td>Tenez une trace \u00e9crite des classes de t\u00e2ches sur lesquelles votre agent \u00e9choue. Sans cette trace, vous ne pouvez pas classer, et sans classification la matrice ci-dessus est inutilisable.<\/td>\n<\/tr>\n<tr>\n<td>(b) Rester conscient de la tendance possible \u00e0 se fier automatiquement ou excessivement \u00e0 la sortie<\/td>\n<td>Supposez que vous contr\u00f4lerez trop peu. Rendez le contr\u00f4le m\u00e9canique et planifi\u00e9 plut\u00f4t que laiss\u00e9 \u00e0 l&rsquo;appr\u00e9ciation du moment.<\/td>\n<\/tr>\n<tr>\n<td>(c) Interpr\u00e9ter correctement la sortie du syst\u00e8me, compte tenu des outils et m\u00e9thodes d&rsquo;interpr\u00e9tation disponibles<\/td>\n<td>Exigez des \u00e9tapes interm\u00e9diaires et des sources, pas des conclusions. Une r\u00e9ponse dont vous ne pouvez pas remonter le fil est une r\u00e9ponse que vous ne pouvez pas contr\u00f4ler.<\/td>\n<\/tr>\n<tr>\n<td>(d) D\u00e9cider de ne pas utiliser le syst\u00e8me, ou d&rsquo;ignorer, contourner ou annuler sa sortie<\/td>\n<td>Tenez une liste \u00e9crite des actions que l&rsquo;agent ne peut jamais accomplir sans surveillance. Une limite qui ne vit que dans votre t\u00eate n&rsquo;est pas une limite.<\/td>\n<\/tr>\n<tr>\n<td>(e) Interrompre le syst\u00e8me au moyen d&rsquo;un bouton d&rsquo;arr\u00eat ou d&rsquo;une proc\u00e9dure similaire permettant un arr\u00eat dans un \u00e9tat s\u00fbr<\/td>\n<td>D\u00e9finissez avant de commencer ce que veut dire &ldquo;arr\u00eat\u00e9 en s\u00e9curit\u00e9&rdquo;. Quel \u00e9tat doit rester r\u00e9cup\u00e9rable si vous coupez l&rsquo;ex\u00e9cution \u00e0 la quatri\u00e8me minute ?<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p><em>La colonne de gauche restitue en substance le texte v\u00e9rifi\u00e9 de l&rsquo;article 14, paragraphe 4, du r\u00e8glement (UE) 2024\/1689. La colonne de droite est la traduction \u00e9ditoriale de CEOtudent et n&rsquo;a aucune port\u00e9e juridique.<\/em><\/p>\n<p>L&rsquo;exigence (e) est celle qui manque syst\u00e9matiquement aux flux de travail individuels. La plupart des gens peuvent arr\u00eater un agent. Bien moins nombreux sont ceux qui ont d\u00e9cid\u00e9 \u00e0 l&rsquo;avance dans quel \u00e9tat le travail doit se trouver \u00e0 ce moment-l\u00e0. Si votre agent est \u00e0 mi-chemin du renommage de 400 fichiers quand vous l&rsquo;interrompez, la question de savoir si c&rsquo;est r\u00e9cup\u00e9rable s&rsquo;est jou\u00e9e avant le d\u00e9part, pas au moment d&rsquo;appuyer sur le bouton.<\/p>\n<p>Le m\u00eame instinct structurel appara\u00eet dans le cadre de gestion des risques li\u00e9s \u00e0 l&rsquo;intelligence artificielle du National Institute of Standards and Technology, qui organise le travail sur le risque en quatre fonctions, gouverner, cartographier, mesurer et g\u00e9rer, plut\u00f4t qu&rsquo;en une seule \u00e9tape de relecture. Le fil commun aux deux documents est que la supervision est une propri\u00e9t\u00e9 du syst\u00e8me, d\u00e9cid\u00e9e \u00e0 l&rsquo;avance, et non un acte d&rsquo;attention accompli \u00e0 la fin.<\/p>\n<h2 id=\"pourquoi-un-point-de-contrle-existant-peut-malgr-tout-chouer\"><span class=\"ez-toc-section\" id=\"Pourquoi-un-point-de-controle-existant-peut-malgre-tout-echouer\"><\/span>Pourquoi un point de contr\u00f4le existant peut malgr\u00e9 tout \u00e9chouer<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Le placement est n\u00e9cessaire et non suffisant, et la preuve en pr\u00e9c\u00e8de de plus de dix ans la g\u00e9n\u00e9ration actuelle d&rsquo;outils.<\/p>\n<p>Goddard, Roudsari et Wyatt ont publi\u00e9 en 2012 dans le Journal of the American Medical Informatics Association une revue syst\u00e9matique sur le biais d&rsquo;automatisation, d\u00e9fini comme la tendance \u00e0 trop se fier \u00e0 l&rsquo;automatisation. Ils ont examin\u00e9 13 821 articles et en ont retenu 74. La revue porte sur l&rsquo;aide \u00e0 la d\u00e9cision clinique, mais ses constats structurels se transposent directement, car le m\u00e9canisme concerne des humains supervisant des machines et non la m\u00e9decine.<\/p>\n<p>Deux de ses r\u00e9sultats devraient changer la fa\u00e7on dont vous construisez le point de contr\u00f4le lui-m\u00eame.<\/p>\n<p>D&rsquo;abord, ce qui aggrave le biais d&rsquo;automatisation. La revue a identifi\u00e9 des m\u00e9diateurs environnementaux dont la charge de travail, la complexit\u00e9 de la t\u00e2che et la contrainte de temps, qu&rsquo;elle d\u00e9crit comme mettant sous pression les ressources cognitives. C&rsquo;est la raison pratique de l&rsquo;approbation en onze secondes. Un point de contr\u00f4le plac\u00e9 dans l&rsquo;heure la plus charg\u00e9e de votre semaine est un point de contr\u00f4le con\u00e7u pour \u00e9chouer, et aucune intention de regarder attentivement ne corrigera une contrainte de temps structurelle.<\/p>\n<p>Ensuite, ce qui l&rsquo;att\u00e9nue. Parmi les facteurs att\u00e9nuants identifi\u00e9s figurent des facteurs de mise en \u0153uvre comme la formation et l&rsquo;accent mis sur la responsabilit\u00e9 de l&rsquo;utilisateur, et des facteurs de conception comme la position du conseil \u00e0 l&rsquo;\u00e9cran, les niveaux de confiance actualis\u00e9s attach\u00e9s \u00e0 la sortie, et la fourniture d&rsquo;information plut\u00f4t que de recommandation.<\/p>\n<p>Ce dernier point est la ligne la plus actionnable de toute la revue. Information plut\u00f4t que recommandation. Un syst\u00e8me qui vous tend une recommandation invite \u00e0 l&rsquo;approbation ; un syst\u00e8me qui vous tend les preuves exige une d\u00e9cision. Traduit en pratique avec des agents : demandez \u00e0 l&rsquo;agent de renvoyer ce qu&rsquo;il a trouv\u00e9 et ce qu&rsquo;il a fait, avec les \u00e9tapes interm\u00e9diaires, plut\u00f4t qu&rsquo;un verdict fini \u00e0 b\u00e9nir. Le m\u00eame prompt qui produit une sortie plus nette produit un point de contr\u00f4le plus faible. C&rsquo;est le c\u0153ur op\u00e9rationnel du fait de <a href=\"\/en\/how-to-delegate-to-an-ai-agent-briefing-framework\">bien briefer un agent<\/a>, et cela va contre l&rsquo;instinct de demander la r\u00e9ponse la plus soign\u00e9e possible.<\/p>\n<p>Le constat sur la responsabilit\u00e9 m\u00e9rite d&rsquo;\u00eatre pris tout aussi litt\u00e9ralement. Inscrivez votre propre nom dans la trace avant le d\u00e9part, comme personne responsable du r\u00e9sultat. Cela ressemble \u00e0 du th\u00e9\u00e2tre. La revue a constat\u00e9 que cela fonctionne.<\/p>\n<h2 id=\"en-pratique-un-cas-droul\"><span class=\"ez-toc-section\" id=\"En-pratique-un-cas-deroule\"><\/span>En pratique : un cas d\u00e9roul\u00e9<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Prenons un cas concret. Un agent doit parcourir 300 factures fournisseurs, extraire montants et dates, signaler les anomalies et mettre \u00e0 jour une feuille de suivi.<\/p>\n<p>Classez d&rsquo;abord les sous-t\u00e2ches, car la matrice op\u00e8re sur des classes de t\u00e2ches et il s&rsquo;agit ici de quatre t\u00e2ches sous un m\u00eame manteau.<\/p>\n<p>L&rsquo;extraction des montants et des dates est peu co\u00fbteuse \u00e0 annuler et silencieuse en cas d&rsquo;erreur : en haut \u00e0 droite. \u00c9chantillonner et noter, sur une part fixe, avec une r\u00e8gle \u00e9crite d\u00e9finissant ce qui compte comme correct. Non pas au hasard sur tout le lot, mais stratifi\u00e9 par format de facture, car la structure mise en \u00e9vidence par tau-bench pr\u00e9dit que les \u00e9checs se regroupent par type de t\u00e2che, et le type de t\u00e2che est ici le format de facture.<\/p>\n<p>Le signalement d&rsquo;anomalies est peu co\u00fbteux \u00e0 annuler et visible en cas d&rsquo;erreur, du moins dans le sens des faux positifs : en haut \u00e0 gauche. Laisser courir. Un faux signalement se voit imm\u00e9diatement d\u00e8s qu&rsquo;on le regarde. Le sens des faux n\u00e9gatifs est silencieux, ce qui est une vraie limite, et la r\u00e9ponse honn\u00eate consiste \u00e0 traiter le signalement comme une aide et non comme une couverture.<\/p>\n<p>La mise \u00e0 jour de la feuille de suivi est co\u00fbteuse \u00e0 annuler et silencieuse : en bas \u00e0 droite. Pr\u00e9-autorisez les op\u00e9rations permises, ajout seulement, pas d&rsquo;\u00e9crasement, pas de suppression, et v\u00e9rifiez un \u00e9chantillon de lignes \u00e9crites contre les factures sources plut\u00f4t que contre le compte rendu de l&rsquo;agent sur ce qu&rsquo;il a \u00e9crit.<\/p>\n<p>Tout ce qui d\u00e9clenche un paiement rel\u00e8ve du bas \u00e0 gauche et est assez visible : barri\u00e8re avant validation, imm\u00e9diatement avant, sans regrouper les approbations.<\/p>\n<p>Voyez ce que cela produit. Quatre r\u00e9gimes de supervision diff\u00e9rents pour un seul travail, trois moins co\u00fbteux que de tout relire, un plus strict que ce que la plupart appliquent aujourd&rsquo;hui. Cette asym\u00e9trie est tout le propos. La relecture uniforme est \u00e0 la fois trop ch\u00e8re sur le travail sans risque et trop faible sur le travail dangereux, ce qui explique pr\u00e9cis\u00e9ment pourquoi elle \u00e9puise et laisse malgr\u00e9 tout passer des erreurs.<\/p>\n<h2 id=\"dimensionner-le-bloc-non-supervis\"><span class=\"ez-toc-section\" id=\"Dimensionner-le-bloc-non-supervise\"><\/span>Dimensionner le bloc non supervis\u00e9<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Une derni\u00e8re cons\u00e9quence pratique des chiffres de METR.<\/p>\n<p>Si vous voulez qu&rsquo;un travail tourne sans surveillance \u00e0 une fiabilit\u00e9 proche de 80 pour cent, l&rsquo;horizon publi\u00e9 pour le mod\u00e8le le plus fort mesur\u00e9 \u00e9tait d&rsquo;environ 15 minutes de travail humain \u00e9quivalent. C&rsquo;est l&rsquo;unit\u00e9 autour de laquelle concevoir : segmentez le travail de sorte qu&rsquo;aucune s\u00e9quence non supervis\u00e9e ne repr\u00e9sente plus d&rsquo;environ un quart de ce que le m\u00eame syst\u00e8me peut tenter \u00e0 fiabilit\u00e9 de pile ou face.<\/p>\n<p>Trois r\u00e9serves honn\u00eates s&rsquo;y attachent. Les t\u00e2ches de METR penchent fortement vers l&rsquo;ing\u00e9nierie logicielle et la recherche en apprentissage automatique, les chiffres ne se transposent donc pas proprement au traitement de factures ou aux courriels. Les horizons doublent environ tous les sept mois, toute valeur en minutes a donc une courte dur\u00e9e de vie. Et METR indique clairement ne pas pouvoir mesurer avec confiance les horizons \u00e0 tr\u00e8s haut taux de r\u00e9ussite : le chiffre que vous voudriez le plus est celui que personne n&rsquo;a.<\/p>\n<p>Ce qui survit aux trois r\u00e9serves, c&rsquo;est le rapport et son sens. Une fiabilit\u00e9 exig\u00e9e plus haute ach\u00e8te des s\u00e9quences autonomes radicalement plus courtes, et les deux horizons progressent au m\u00eame rythme, donc l&rsquo;\u00e9cart entre eux ne se referme pas. De meilleurs mod\u00e8les laisseront les agents travailler plus longtemps. Sur cette base, ils ne combleront pas la distance entre &ldquo;marche g\u00e9n\u00e9ralement&rdquo; et &ldquo;marche assez s\u00fbrement pour \u00eatre laiss\u00e9 seul&rdquo;. C&rsquo;est dans cette distance que vit le point de contr\u00f4le, et elle est structurelle et non transitoire.<\/p>\n<p>C&rsquo;est l&rsquo;appariement du dirigeant et de l&rsquo;\u00e9tudiant sous sa forme la plus litt\u00e9rale. Le dirigeant d\u00e9cide \u00e0 l&rsquo;avance o\u00f9 se trouvent les \u00e9tapes irr\u00e9versibles et qui en r\u00e9pond. L&rsquo;\u00e9tudiant tient \u00e0 jour le journal des \u00e9checs, car la classification ne vaut que ce que valent les mesures du mois dernier. Aucune moiti\u00e9 ne fonctionne sans l&rsquo;autre, et aucune am\u00e9lioration des mod\u00e8les ne fera l&rsquo;un ou l&rsquo;autre travail \u00e0 votre place.<\/p>\n<h2 id=\"foire-aux-questions\"><span class=\"ez-toc-section\" id=\"Foire-aux-questions\"><\/span>Foire aux questions<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p><strong>Est-ce pertinent seulement si j&rsquo;utilise des agents autonomes ?<\/strong><br \/>\nNon. La matrice repose sur la r\u00e9versibilit\u00e9 et la d\u00e9tectabilit\u00e9, pas sur le degr\u00e9 d&rsquo;autonomie. Une simple r\u00e9ponse d&rsquo;agent conversationnel coll\u00e9e dans un courriel client est une t\u00e2che co\u00fbteuse \u00e0 annuler et \u00e0 erreur visible, ce qui la place dans la case barri\u00e8re-avant-validation, que quelque chose ait tourn\u00e9 sans surveillance ou non. Ce qui compte est ce que la sortie touche, pas la fa\u00e7on dont elle a \u00e9t\u00e9 produite. La question de fronti\u00e8re associ\u00e9e est trait\u00e9e dans <a href=\"\/en\/should-you-let-ai-make-the-decision-delegation-boundaries\">quels choix d\u00e9l\u00e9guer et lesquels ne jamais automatiser<\/a>.<\/p>\n<p><strong>Pourquoi ex\u00e9cuter la t\u00e2che deux fois et comparer ne suffit-il pas ?<\/strong><br \/>\nParce que le r\u00e9sultat pass^8 de tau-bench indique que les \u00e9checs se regroupent par t\u00e2che au lieu de se disperser entre tentatives. Deux ex\u00e9cutions d&rsquo;une t\u00e2che que l&rsquo;agent traite mal tendent \u00e0 produire deux r\u00e9ponses semblables, assur\u00e9es et fausses. L&rsquo;accord entre ex\u00e9cutions n&rsquo;est une preuve que si les \u00e9checs sont ind\u00e9pendants, et les donn\u00e9es mesur\u00e9es disent qu&rsquo;ils ne le sont pas.<\/p>\n<p><strong>L&rsquo;article 14 du r\u00e8glement europ\u00e9en sur l&rsquo;IA s&rsquo;applique-t-il \u00e0 moi ?<\/strong><br \/>\nPresque certainement pas de la fa\u00e7on dont il s&rsquo;applique au fournisseur d&rsquo;un syst\u00e8me \u00e0 haut risque, et l&rsquo;article ne le sugg\u00e8re pas. Il sert ici de liste de contr\u00f4le bien r\u00e9dig\u00e9e de ce que la supervision doit pouvoir faire, parce qu&rsquo;il nomme cinq capacit\u00e9s pr\u00e9cises au lieu d&rsquo;\u00e9voquer vaguement une relecture. Empruntez la structure ; ne revendiquez pas la conformit\u00e9.<\/p>\n<p><strong>Quelle taille d&rsquo;\u00e9chantillon noter dans la case \u00e9chantillonner-et-noter ?<\/strong><br \/>\nLa litt\u00e9rature de synth\u00e8se ne donne pas de nombre universel, et en inventer un serait de la fausse pr\u00e9cision. La r\u00e8gle de conception qui d\u00e9coule des donn\u00e9es porte sur la stratification, non sur la taille : \u00e9chantillonnez \u00e0 l&rsquo;int\u00e9rieur des classes de t\u00e2ches, pas sur tout le lot, car c&rsquo;est l\u00e0 que se concentrent les \u00e9checs. Commencez avec assez de cas par classe pour distinguer un \u00e9chec constant d&rsquo;un accident isol\u00e9, puis ajustez d&rsquo;apr\u00e8s votre propre journal des \u00e9checs.<\/p>\n<p><strong>Et si mon point de contr\u00f4le ne trouve jamais rien ?<\/strong><br \/>\nDeux possibilit\u00e9s, qui appellent des r\u00e9ponses diff\u00e9rentes. Soit cette classe de t\u00e2ches est r\u00e9ellement fiable, auquel cas remontez-la dans la matrice et r\u00e9cup\u00e9rez le temps, soit vous approuvez au lieu de contr\u00f4ler. La revue sur le biais d&rsquo;automatisation d\u00e9signe d&rsquo;abord l&rsquo;environnement : v\u00e9rifiez si la relecture est plac\u00e9e dans un cr\u00e9neau o\u00f9 il y a vraiment du temps, et si l&rsquo;agent vous tend une recommandation \u00e0 b\u00e9nir plut\u00f4t que des preuves \u00e0 juger.<\/p>\n<h2 id=\"sources\"><span class=\"ez-toc-section\" id=\"Sources\"><\/span>Sources<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Thomas Kwa, Ben West, Joel Becker et coll\u00e8gues, Measuring AI Ability to Complete Long Tasks, METR, 2025, dont la section comparant les horizons temporels \u00e0 50 et 80 pour cent de r\u00e9ussite.<\/p>\n<p>Shunyu Yao, Noah Shinn, Pedram Razavi et Karthik Narasimhan, tau-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains, 2024, introduisant la m\u00e9trique de fiabilit\u00e9 pass^k.<\/p>\n<p>R\u00e8glement (UE) 2024\/1689 du Parlement europ\u00e9en et du Conseil \u00e9tablissant des r\u00e8gles harmonis\u00e9es concernant l&rsquo;intelligence artificielle, article 14 relatif au contr\u00f4le humain, en particulier les paragraphes 1, 2 et 4.<\/p>\n<p>Kate Goddard, Abdul Roudsari et Jeremy C. Wyatt, Automation bias: a systematic review of frequency, effect mediators, and mitigators, Journal of the American Medical Informatics Association, volume 19, num\u00e9ro 1, 2012.<\/p>\n<p>National Institute of Standards and Technology, Artificial Intelligence Risk Management Framework 1.0, 2023, et ses quatre fonctions principales.<\/p>\n<p>METR, Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity, 2025, et la note de f\u00e9vrier 2026 r\u00e9visant la position de l&rsquo;organisation sur ce r\u00e9sultat.<\/p>\n<p>United States Census Bureau, Business Trends and Outlook Survey, estimations d&rsquo;usage de l&rsquo;intelligence artificielle couvrant d\u00e9cembre 2025 \u00e0 mai 2026.<\/p>\n<hr>\n<p><em>Ce contenu a \u00e9t\u00e9 compil\u00e9 avec le soutien de l&rsquo;IA \u00e0 la suite d&rsquo;une recherche approfondie, puis r\u00e9dig\u00e9 et pr\u00e9par\u00e9 pour publication par l&rsquo;\u00e9quipe \u00e9ditoriale de CEOtudent.<\/em><\/p>\n","protected":false},"excerpt":{"rendered":"<p>La plupart des conseils sur la supervision des agents IA se r\u00e9sument \u00e0 &lsquo;relisez la sortie&rsquo;, ce qui n&rsquo;est pas une conception mais un espoir. Les mesures publi\u00e9es indiquent quelque chose de plus pr\u00e9cis. METR rapporte que la dur\u00e9e de t\u00e2che qu&rsquo;un agent traite \u00e0 50 pour cent de r\u00e9ussite vaut environ cinq fois celle qu&rsquo;il traite \u00e0 80 pour cent, et pour le mod\u00e8le au plus long horizon \u00e0 80 pour cent qu&rsquo;elle a mesur\u00e9, cela signifiait 59 minutes contre 15. Le banc d&rsquo;essai tau-bench a trouv\u00e9 que des agents de pointe \u00e0 appel de fonctions r\u00e9ussissent moins de 50 pour cent des t\u00e2ches en une tentative et moins de 25 pour cent lorsque la m\u00eame t\u00e2che est ex\u00e9cut\u00e9e huit fois. Ce second chiffre est bien sup\u00e9rieur \u00e0 ce que produirait un \u00e9chec al\u00e9atoire, ce qui signifie que les \u00e9checs des agents se regroupent par t\u00e2che au lieu de se disperser au hasard, et cette seule inf\u00e9rence change l&rsquo;endroit o\u00f9 doit se trouver un point de contr\u00f4le. Cet article d\u00e9rive la Matrice de placement des points de contr\u00f4le CEOtudent \u00e0 partir de la r\u00e9versibilit\u00e9 et de la d\u00e9tectabilit\u00e9, traduit en flux de travail individuel les cinq capacit\u00e9s de supervision humaine inscrites \u00e0 l&rsquo;article 14 du r\u00e8glement europ\u00e9en sur l&rsquo;intelligence artificielle, et explique par la litt\u00e9rature sur le biais d&rsquo;automatisation pourquoi un point de contr\u00f4le existant peut malgr\u00e9 tout \u00e9chouer.<\/p>\n","protected":false},"author":1,"featured_media":325634,"comment_status":"open","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[5,18],"tags":[],"class_list":["post-325632","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-is","category-strateji"],"_links":{"self":[{"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/posts\/325632","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/comments?post=325632"}],"version-history":[{"count":0,"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/posts\/325632\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/media\/325634"}],"wp:attachment":[{"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/media?parent=325632"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/categories?post=325632"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/ceotudent.com\/fr\/wp-json\/wp\/v2\/tags?post=325632"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}