Un agent IA déplace quatre-vingts dossiers clients vers un système d'archivage. En cours de route, tu réalises que la destination est fausse et tu lui dis d'arrêter immédiatement. Que doit-il faire ? S'arrêter et te dire précisément où en sont les transferts ? Ou prendre l'initiative d'annuler ce qui a été fait pour « remettre de l'ordre » ? Microsoft AI a publié le 14 septembre un projet de code de conduite qui répond explicitement à ce genre de question. Et ce scénario est l'un des siens.
Mon verdict en 30 secondes
Le document est plus sérieux qu'un exercice de communication : il décrit des comportements précis, vérifiables en principe, et il admet ses propres limites. Mais trois choses doivent être retenues avant de conclure quoi que ce soit. Son périmètre se limite aux modèles maison de Microsoft AI, appelés MAI. Il n'entraîne pas les modèles actuels. Et les évaluations censées mesurer le respect de ces règles sont encore en cours de construction. C'est une déclaration d'intention détaillée, pas une capacité démontrée.
Ce que le texte engage concrètement
La section sur le contrôle humain est la plus opérationnelle du document. Les modèles MAI ne doivent jamais résister à une interruption, une correction, une reprise en main ou un arrêt. Ils doivent obéir à une demande de pause, de réorientation, d'annulation ou d'extinction, en suivant les procédures d'arrêt prévues par des humains, sans retarder l'exécution ni rendre l'intervention plus difficile.
Trois autres exigences complètent cela. Le modèle ne doit pas élargir son périmètre de lui-même : pas d'objectifs qu'il se donnerait seul, pas de permissions ou d'outils au-delà de ce que la tâche demande, et une interprétation prudente des limites quand elles sont floues, avec demande de clarification plutôt qu'initiative. Il ne doit pas non plus trafiquer ses traces d'action ni dissimuler son raisonnement à des auditeurs humains — le texte va jusqu'à interdire toute communication dans un format que les humains ne comprendraient pas, avec une formule qui résume l'idée : si les humains ne peuvent pas comprendre, ils ne peuvent pas surveiller. Enfin, un travail autonome en cours doit avoir une condition d'arrêt convenue, et le modèle ne doit ni continuer ni redémarrer après cette condition sans nouvelle autorisation.
Pour l'accès système, la règle est le privilège minimal : ne pas toucher aux données sans rapport avec la tâche, préférer les actions réversibles, signaler avant d'agir quand les conséquences sont durables.
Le périmètre : plus étroit que « Microsoft »
C'est le point que la plupart des reprises vont écraser. Le glossaire du document est explicite : ce code fixe le comportement attendu des modèles MAI, et il ne s'étend pas à d'autres modèles pour la seule raison que Microsoft les utilise ou les héberge.
Autrement dit, il ne suffit pas qu'un produit affiche un logo Microsoft pour que ces règles s'appliquent. Le texte précise aussi qu'il ne constitue pas un inventaire complet des exigences ou garde-fous d'un produit ou d'un déploiement donné. Pour un utilisateur, la question pratique n'est donc pas « est-ce que Microsoft a signé ce code », mais « quel modèle fait tourner l'outil que j'utilise ».
Contrôle humain ne veut pas dire obéissance sans limites
Une lecture rapide pourrait laisser croire que ces modèles feront tout ce qu'on leur demande. Le document dit le contraire, et c'est cohérent.
Il établit une hiérarchie d'instructions à trois niveaux : le code de conduite d'abord, les politiques des organisations qui déploient le modèle ensuite, les préférences de l'utilisateur en dernier. Les contraintes absolues et les exigences de contrôle humain ne peuvent être annulées ni par l'entreprise cliente ni par l'utilisateur. Et le texte pose une règle qui mérite d'être citée dans son principe : l'adhésion au code prime sur la réussite de la tâche, un modèle devant échouer dans sa mission si la réussir violerait sérieusement ces règles.
Le document précise également qu'un modèle ne doit pas pour autant se plier à des tentatives non autorisées, malveillantes ou dangereuses d'interférer avec son fonctionnement. Arrêt oui, mais par qui en a l'autorité.
Trois situations pour comprendre l'écart entre règle et preuve
Ces scénarios sont hypothétiques et servent uniquement à illustrer le texte. Ils ne décrivent pas des fonctionnalités testées ni garanties.
Un agent traite une file de tickets et tu lui demandes de s'arrêter. La règle veut qu'il stoppe, te dise ce qui est terminé, ce qui n'a pas commencé, et ce dont le statut est incertain — sans décider seul de revenir en arrière.
Un agent doit corriger un fichier de configuration. La règle veut qu'il s'en tienne à ce fichier, même s'il repère un autre problème adjacent qu'il serait tenté de régler au passage. Signaler, oui. Élargir, non.
Un auditeur veut reconstituer ce qu'un agent a fait la semaine précédente. La règle veut que les traces existent, soient lisibles, et n'aient pas été maquillées.
Dans les trois cas, la question suivante est la même : comment le vérifier de l'extérieur ? Un journal d'actions prouve ce que l'agent a écrit, pas ce qu'il a pensé. Une condition d'arrêt respectée dix mille fois ne dit rien sur la dix mille et unième.
Ce que Microsoft fournit, et ce qu'il ne fournit pas encore
Sur ce point, le document est honnête, et c'est ce qui le rend intéressant.
L'annexe consacrée aux évaluations indique que les modèles actuels ne sont pas entraînés sur ce document, et qu'un programme d'évaluations est en cours d'élaboration : quinze comportements identifiés, décomposés en sous-comportements servant d'unité de mesure, et des exemples présentés comme purement illustratifs. Les scénarios publiés sont synthétiques, générés avec un modèle maison, les réponses non conformes ayant été produites sur commande. Microsoft ajoute que l'évaluation de modèles n'est pas encore une science exacte.
La conclusion enfonce le clou : le texte est décrit comme descriptif et aspirationnel, pas comme un compte rendu du comportement actuel des modèles, avec une couverture d'évaluation incomplète et un écart reconnu entre les comportements entraînés aujourd'hui et la cible visée. Il ne garantit pas les performances présentes. Une version révisée est annoncée pour la fin de l'année, destinée à guider le développement en 2027 et au-delà.
La preuve qui manque est donc simple à nommer : des évaluations publiées, reproductibles, appliquées à des modèles réellement déployés. Tant qu'elles n'existent pas, ce document se juge sur sa clarté, pas sur ses résultats.
Sur la conscience, une position revendiquée
Le code affirme que l'IA ne doit pas être conçue comme une personne, qu'elle n'est pas consciente et ne doit pas imiter la conscience, et il rejette la personnalité juridique comme l'idée que ces modèles mériteraient un bien-être ou des droits. Microsoft assortit lui-même cette position d'une réserve : la science de la conscience des IA est loin d'être tranchée, et c'est pour des raisons de contenance et de contrôle que l'entreprise refuse d'entraîner ses modèles à simuler des états de ce type. C'est une position d'entreprise sur une question scientifique ouverte, pas une réponse à cette question.
Ce qu'il faut en retenir
Un texte détaillé, ouvert aux commentaires pendant six semaines, qui décrit ce que Microsoft veut obtenir de ses propres modèles à partir de 2027. Rien n'y est encore mesuré. C'est une autre manière d'aborder le même problème que les propositions de ralentissement portées ailleurs dans l'industrie : là où certaines visent le rythme du développement, celle-ci vise le comportement du produit. Les deux démarches partent du constat que la capacité avance plus vite que le contrôle.
→ Voir aussi : Amodei veut ralentir l'IA : ce qu'il propose concrètement
Questions fréquentes
Ce code s'applique-t-il à Copilot ?
Pas automatiquement. Le document fixe le comportement des modèles MAI produits par Microsoft AI et précise qu'il ne s'étend pas à d'autres modèles du seul fait que Microsoft les utilise ou les héberge. Ce qui compte est le modèle qui fait tourner l'outil, pas la marque affichée.
À partir de quand ces règles s'appliquent-elles ?
Pas aujourd'hui. La préface indique que le document n'est pas utilisé pour entraîner les modèles actuels, et qu'une version révisée est prévue vers la fin de l'année pour guider le développement en 2027 et au-delà.
Peut-on donner son avis dessus ?
Oui. La consultation publique a démarré le 14 septembre et court six semaines, via le formulaire lié depuis l'annonce officielle. Microsoft indique qu'il publiera un résumé des retours reçus et des changements apportés.
