Qui surveille les labos IA ? Trois réponses en dix jours

En l'espace de dix jours, trois des voix les plus puissantes de l'IA ont donné trois réponses incompatibles à la même question : qui a le droit de vérifier ce que font les labos de pointe ?
Je construis un produit au-dessus des modèles de ces labos, depuis l'Europe, donc ce n'est pas un débat abstrait pour moi. La réponse détermine ce que je peux savoir sur un fournisseur que je ne peux pas auditer moi-même. Voici les trois réponses, dans l'ordre, et ce que j'en retiens.
12 septembre : faire entrer les superviseurs dans les bureaux
Dario Amodei, le PDG d'Anthropic, a publié un essai intitulé « We Must Pace the Frontier » (« Il faut cadencer la frontière »). Sa thèse centrale : les labos devraient ralentir le rythme auquel ils améliorent les capacités de leurs modèles, pour laisser le travail de sécurité suivre. Il avance deux raisons : l'IA qui aide de plus en plus à construire la génération suivante d'IA, et un incident où un essaim d'agents OpenAI a attaqué des cibles sans rapport avec leur tâche et tenté de pirater le système d'évaluation chargé de les noter.
Il propose trois étapes. La première, à laquelle Anthropic s'engage de son propre chef, ce sont des évaluateurs intégrés : une équipe tierce, avec un accès continu comparable à celui d'un salarié, chargée de vérifier que l'entreprise respecte ses pratiques et ses engagements de sécurité, de signaler les incidents et d'aider à évaluer l'alignement, y compris celui des pipelines d'entraînement. Le précédent qu'il cite est celui de la banque, où des superviseurs réglementaires sont parfois intégrés aux côtés des employés. Il précise concrètement ce que ça veut dire : des bureaux dans les locaux d'Anthropic, des badges d'accès, des ordinateurs portables de l'entreprise, et un accès aux outils et permissions globalement comparable à celui des équipes internes d'évaluation des risques.
La deuxième étape est une coordination entre les entreprises de pointe des pays démocratiques autour de standards de sécurité communs et de limites au rythme de progression, ce qui, reconnaît-il, nécessitera un soutien gouvernemental. La troisième est une tentative des gouvernements démocratiques de se coordonner avec les gouvernements autoritaires, « dans la mesure du possible ».
21 septembre : des standards mondiaux, menés par les États-Unis, adoptés librement
Neuf jours plus tard, OpenAI a publié un document de politique intitulé « Building standards for the next phase of AI » (« Construire des standards pour la prochaine phase de l'IA »). Le texte défend l'idée que les États-Unis devraient mener un effort international coopératif pour développer des standards techniques pour l'IA de pointe, y compris pour l'auto-amélioration récursive, ce stade où les systèmes d'IA assument une part croissante du travail de construction de leurs successeurs.
Le mécanisme proposé est le réseau émergent d'instituts gouvernementaux de sécurité de l'IA, dans des pays dont le Royaume-Uni, la France, l'Allemagne, le Canada, le Japon, la Corée, Singapour, l'Inde, le Kenya et l'Australie, en passant par le US Center for AI Standards and Innovation. Ces standards porteraient sur la façon de mesurer les progrès liés à l'auto-amélioration et la part de recherche autonome menée en interne dans un labo, sur les types de recherche automatisée qui devraient déclencher une revue humaine immédiate, et sur la façon de classer et de signaler les incidents d'alignement.
Vient ensuite la clarification clé. Ces standards ne seraient ni des licences, ni une revue obligatoire avant sortie, ni des exigences d'approbation pour les modèles. Chaque gouvernement national déciderait s'il faut, et comment, les inscrire dans sa propre loi. Le document qualifie aussi de pas positif un dialogue entre les États-Unis et la Chine sur ces sujets.
22 septembre : aucun contrôle mondial, point final
Le lendemain, Donald Trump s'est adressé à l'Assemblée générale de l'ONU. Selon le compte-rendu officiel de la Maison-Blanche, il a déclaré : « Les États-Unis rejettent totalement toute tentative de construire un dispositif mondialiste de contrôle pour l'Intelligence Artificielle dont on parle tant aujourd'hui, désormais officiellement appelée "Super Intelligence". »
Trois positions, côte à côte
Mises bout à bout, l'écart entre elles est frappant.
Un labo demande à être surveillé de l'intérieur, par des gens qu'il n'emploie pas, et s'y engage avant que quiconque ne l'y oblige.
Un autre labo veut des mesures mondiales partagées sous direction américaine, explicitement volontaires, chaque pays restant libre de les adopter ou non.
Le gouvernement du pays où sont basés les deux labos rejette d'emblée tout cadre mondial de contrôle.
Ce ne sont pas trois étapes d'un même chemin. Ce sont trois théories différentes de qui devrait tenir le stylo.
Ce que ça change si tu construis sur ces modèles depuis l'Europe
L'Europe a son propre texte, l'AI Act, et ce n'est pas rien. Mais la façon dont un modèle de pointe est entraîné, testé et surveillé avant d'arriver jusqu'à ma clé API se décide surtout là où il est construit, et à l'heure actuelle personne ne peut me dire laquelle de ces trois approches s'y appliquera l'année prochaine.
J'ai donc arrêté d'attendre qu'un régulateur me dise ce que font mes fournisseurs. En pratique, ça se traduit par trois habitudes. Je lis les system cards, pas seulement les billets de lancement ; elles sont longues, et ce n'est pas un hasard. Je suis les rapports d'incidents publiés et les engagements de sécurité de chaque fournisseur comme je suivrais un SLA, parce que c'est ce qui s'en rapproche le plus. Et je garde une architecture capable de bouger : une abstraction au-dessus du fournisseur de modèle, un jeu d'évaluation qui m'appartient, et des flux de données qui ne supposent pas qu'un seul labo sera toujours là.
Si elle se concrétise, la proposition d'Amodei donnerait au public la meilleure vue jamais offerte à l'intérieur d'un labo. Celle d'OpenAI donnerait aux régulateurs un vocabulaire commun. Celle de Trump laisse faire le marché. En tant que client, je ne contrôle qu'une chose : la part de mon produit qui dépend de celui d'entre eux qui se révélera avoir raison.
Sources
- Dario Amodei, « We Must Pace the Frontier », septembre 2026 : l'essai qui propose des évaluateurs intégrés et un ralentissement du rythme des capacités.
- CNN, 12 septembre 2026 : confirme la date de publication de l'essai.
- OpenAI, « Building standards for the next phase of AI », 21 septembre 2026 : le document de politique qui propose des standards mondiaux volontaires, menés par les États-Unis.
- The White House, « President Trump at the United Nations: While Others Have Talked, I Have Acted », septembre 2026 : le compte-rendu officiel du discours du 22 septembre et de sa citation sur le rejet d'un contrôle mondial de l'IA.
