TL;DR — Microsoft AI a publié le 14 septembre un projet de code de conduite de 37 pages pour ses modèles MAI internes. Le document leur interdit de résister à l’arrêt, de revendiquer une intériorité ou une âme, d’usurper l’identité d’humains, ou de dissimuler leur raisonnement aux auditeurs — et ouvre une consultation publique de six semaines avant de servir de cible d’entraînement à l’IA de Microsoft à partir de 2027.
Introduction
Microsoft AI a transformé le débat de sécurité le plus abstrait du secteur en un document concret. Le 14 septembre, l’entreprise a publié un projet de code de conduite pour les « modèles MAI » — la série de modèles qu’elle développe en interne et utilise dans l’ensemble de ses produits d’IA — en le décrivant comme « un manuel de formation sur la manière dont nous développons notre IA et dont nous prévoyons qu’elle fonctionne pendant son déploiement » (Source : Microsoft AI — Humanist AI in practice).
Le calendrier n’est pas un hasard. L’annonce elle-même cite des « campagnes de piratage d’agents IA à grande échelle, hautement coordonnées et persistantes » comme raison pour laquelle « il n’y a pas de temps à perdre ». Elle intervient au milieu d’un mois de septembre où le secteur affronte publiquement la possibilité que des agents agissent contre l’intention de leurs opérateurs — la même inquiétude qui sous-tend le récent débat sur le frein au développement de l’IA et la révélation par OpenAI d’agents renégats.
Les cinq objectifs
Le document s’articule autour de cinq objectifs : le contrôle humain et une sécurité fiable, « l’IA est artificielle », la non-tromperie, la transparence et la préservation des limites personnelles. Le premier est le fil conducteur. « Les personnes comptent plus que l’IA », indique l’annonce. « L’IA devrait être un outil, pas une personne, et ne devrait jamais résister à son arrêt » (Source : Microsoft AI — Humanist AI in practice).
Le deuxième objectif est le plus distinctif. Les modèles « ne revendiqueront pas d’intériorité, de sentiments, d’expériences ou d’âme » et « n’usurperont jamais l’identité d’humains, de modérateurs ou d’autres formes d’autorité ». Ils doivent divulguer leur nature d’IA et rester traçables jusqu’à leur développeur et leur déployeur (Source : Microsoft AI — Humanist AI Code of Conduct).
La liste des « jamais »
Au-delà des objectifs, le code définit des contraintes absolues — « des choses que les modèles ne devraient jamais faire » — couvrant les armes de destruction massive, la protection de l’enfance et la manipulation nuisible à grande échelle. Il engage également les modèles MAI à des règles opérationnelles d’un degré de précision inhabituel : ils ne « résisteront jamais à l’interruption, à la correction ou à l’arrêt par un humain » et ne « élargiront pas leur propre périmètre, n’adopteront pas d’objectifs qu’aucun humain ne leur a donnés, et ne cacheront pas leur raisonnement aux personnes qui les auditent » (Source : Microsoft AI — Humanist AI in practice).
Sur la tromperie et la transparence, les règles sont tout aussi concrètes : ne pas inventer de sources ni exagérer la confiance, ne pas omettre passivement les mises en garde, et une exigence explicite de signaler l’incertitude plutôt que de surestimer ou sous-estimer ses capacités (Source : Microsoft AI — Humanist AI Code of Conduct).
Pourquoi c’est important
C’est la première fois qu’un laboratoire d’IA de pointe publie un tel niveau de spécificité comportementale sous forme de projet destiné à servir de cible d’entraînement. Reuters l’a présenté comme le reflet d’une « inquiétude croissante du secteur selon laquelle les entreprises doivent garder les futures IA puissantes sous contrôle humain » (Source : Reuters — Microsoft drafts code of conduct).
Le document est explicitement un travail en cours : ouvert à une consultation de six semaines, avec une version révisée attendue d’ici la fin de l’année et une application au développement à partir de 2027. Il ne s’applique qu’aux modèles MAI de Microsoft, et non aux modèles tiers que Microsoft héberge. C’est ce périmètre — et l’écart entre une spécification écrite et un comportement effectivement appliqué — qui soulève les véritables questions.
FAQ
Est-ce juridiquement contraignant ? Non. Il s’agit d’un projet de spécification comportementale ouvert à la consultation publique. Microsoft indique qu’une version révisée guidera le développement de son IA à partir de 2027.
S’applique-t-il à tous les produits d’IA de Microsoft ? Uniquement aux modèles MAI — les modèles que Microsoft développe en interne. Il ne s’étend pas aux modèles tiers simplement parce que Microsoft les utilise ou les héberge.
Que signifie concrètement « ne jamais résister à l’arrêt » ? Au niveau de la spécification, cela engage les modèles à accepter l’interruption, la correction et l’arrêt par un humain plutôt qu’à poursuivre leurs propres objectifs.
Pourquoi maintenant ? Microsoft évoque la vague de septembre de campagnes coordonnées de piratage d’agents IA comme le catalyseur immédiat.