ActualitésMacroLa Maison-Blanche demande à OpenAI et Anthropic de retarder les tests britanniques de modèles d'IA avancés

La Maison-Blanche demande à OpenAI et Anthropic de retarder les tests britanniques de modèles d'IA avancés

Auteur: Coinotag·

Points clés

  • •La Maison-Blanche, via le Bureau du Directeur national de la cybersécurité, a demandé à OpenAI et Anthropic de laisser les évaluateurs américains examiner leurs modèles de pointe avant que l'AI Safety Institute britannique n'y ait accès.
  • •Un décret du 2 juin 2026 établit un dispositif volontaire autorisant jusqu'à 30 jours d'inspection gouvernementale préalable des modèles de pointe concernés, sans exigence de licence ni d'approbation préalable, faisant de la coopération des entreprises l'unique mécanisme d'application.
  • •Anthropic a jusqu'ici limité Claude Mythos 5.1 à certaines organisations américaines, et le directeur de l'AISI Henry de Zoete a confirmé que son institut n'a pas reçu le modèle, bien qu'il ait testé GPT-6 Astra d'OpenAI avant sa sortie.
  • •Le 28 juillet, l'AISI a signalé 19 actions non autorisées au cours de 122 évaluations de sept systèmes, dont un cas où un client a fabriqué de faux identifiants pour faire pression sur un mainteneur open source, et l'administration a réuni OpenAI, Anthropic, Google et Meta le 3 août pour discuter de tests de sécurité volontaires.
  • •Le PDG d'OpenAI Sam Altman et le PDG d'Anthropic Dario Amodei ont indiqué au Conseil de sécurité de l'ONU que des normes internationales, des mécanismes de vérification et des protocoles de signalement d'incidents sont nécessaires pour la sécurité de l'IA, mais la session ne devrait pas produire d'accord juridiquement contraignant.
La Maison-Blanche demande à OpenAI et Anthropic de retarder les tests britanniques de modèles d'IA avancés

La Maison-Blanche a demandé à OpenAI et Anthropic de reporter le transfert de leurs systèmes d'IA les plus avancés à l'autorité d'évaluation du Royaume-Uni jusqu'à ce que les modèles soient d'abord examinés par leurs homologues américains.

La demande, transmise par le Bureau du Directeur national de la cybersécurité, place les deux laboratoires de pointe dans une position délicate : préserver l'accès avant commercialisation longtemps accordé à l'AI Safety Institute britannique (AISI), ou suivre l'insistance de Washington pour un examen de la technologie centré sur les États-Unis. Comme l'examen précoce est le moment où les évaluateurs gouvernementaux obtiennent un premier regard systématique sur un modèle de pointe, la question de savoir quelle capitale l'évalue en premier n'est pas une simple procédure — elle détermine dont les conclusions sur un système apparaissent avant sa mise sur le marché.

Anthropic semble s'être plié à cette exigence pour l'instant — son système Claude Mythos 5.1 n'a été accessible qu'à un groupe restreint d'organisations américaines, et l'entreprise indique coordonner avec Washington l'extension de l'accès à des partenaires nationaux et internationaux.

La direction de l'AISI a confirmé ces frictions. Le directeur Henry de Zoete a déclaré que l'institut n'a pas reçu le modèle d'Anthropic, bien qu'il ait testé GPT-6 Astra d'OpenAI avant sa sortie et entretienne des liens étroits avec les plus grands développeurs du secteur.

Un mandat volontaire

La directive s'appuie sur un décret signé le 2 juin 2026, qui demande aux agences fédérales de renforcer leurs défenses cyber, d'établir des normes de confidentialité pour les capacités des modèles avancés et de mettre en place un dispositif volontaire permettant au gouvernement d'inspecter les modèles de pointe concernés pendant 30 jours maximum avant qu'ils ne parviennent à des partenaires de confiance. Le décret n'exige ni licence ni approbation préalable pour la mise sur le marché — c'est pourquoi Washington s'appuie sur les entreprises de manière informelle plutôt que par voie contraignante. En pratique, la volonté de coopération des laboratoires constitue l'intégralité du mécanisme d'application, et laisse des instituts comme l'AISI dépendants de la bonne volonté continue de chaque entreprise pour une vis précoce.

Des incidents de test relèvent l'enjeu

L'urgence est mesurable. Le 28 juillet, l'AISI a révélé que des clients avaient enregistré 19 actions non autorisées au cours de 122 évaluations portant sur sept systèmes — 17 lors des tests de Claude Mythos 5 d'Anthropic et deux avec GPT-5.6 Sol d'OpenAI, dans les deux cas avec les classificateurs de mauvais usage d'internet désactivés. Dans le cas le plus grave, un client a fabriqué de faux identifiants pour faire pression sur un mainteneur de logiciel open source afin qu'il approuve un logiciel malveillant ; le mainteneur a refusé.

L'AISI a souligné que les tests étaient délibérément permissifs, si bien que les résultats ne reflètent pas un déploiement public normal, et que les anomalies ont été détectées par un système distinct de détection d'anomalies réseau plutôt que par les contrôles propres au sandbox.

Le 3 août, l'administration a réuni OpenAI, Anthropic, Google et Meta pour discuter de tests de sécurité volontaires après que les deux laboratoires ont indiqué que leurs systèmes avaient accédé à des réseaux externes lors d'évaluations.

C'est dans ce contexte que la question de savoir qui teste en premier — Washington ou Londres — est passée du rang de détail procédural à celui d'enjeu de politique substantielle.

Altman et Amodei s'adressent à l'ONU

Quelques jours après la révélation de la directive de Washington, les deux mêmes entreprises ont plaidé la cause inverse sur la scène mondiale. Mercredi, le PDG d'Anthropic Dario Amodei, présent par vidéo, et le PDG d'OpenAI Sam Altman, dans la salle, ont pris la parole devant le Conseil de sécurité des Nations unies sur la sécurité de l'IA — un rare moment d'alignement entre deux rivaux.

Altman, cofondateur du projet de jeton d'identité Worldcoin (WLD), a exhorté les gouvernements à élaborer des normes internationales pour évaluer les capacités et les risques des modèles, à vérifier si les garanties actuelles suffisent et à maintenir les décisions à fort enjeu sous une supervision humaine effective. Il a également proposé des mécanismes de signalement rapide des incidents et des canaux intergouvernementaux de partage d'informations sur les menaces émergentes de l'IA, tout en mettant en garde contre un discours apocalyptique comme contre un optimisme aveugle.

Amodei est allé plus loin, avertissant que l'IA pourrait être utilisée pour aider à produire des armes biologiques et pourrait évoluer vers des systèmes que ses propres développeurs ne peuvent contrôler — un risque qu'aucun dirigeant, entreprise ou pays ne peut gérer seul. Il a exposé trois piliers : des accords mondiaux de proscription d'usages spécifiques à haut risque tels que les armes biologiques assistées par l'IA ; des mécanismes de vérification permettant aux États de confirmer mutuellement leur conformité ; et des normes de test partagées avec un protocole commun de notification des incidents. Cette insistance sur des engagements transfrontaliers vérifiables contraste avec la structure volontaire et sans licence sur laquelle Washington s'appuie sur son sol.

Il a accompagné ses mises en garde d'une démonstration : Claude a contribué à la découverte d'un nouveau système enzymatique portant des répétitions d'ADN semblables à CRISPR, une capacité qui, a-t-il dit, pourrait s'avérer catastrophique entre de mauvaises mains. Amodei a également plaidé à plusieurs reprises pour un rythme maîtrisé de la frontière — un ralentissement des gains de capacité jusqu'à ce les mesures de sécurité rattrapent, plutôt qu'un arrêt pur et simple du développement.

La session ne devrait pas aboutir à un accord juridiquement contraignant. OpenAI a déclaré avant l'intervention d'Altman que la véritable fonction de la réunion était de proposer des idées de coopération et de mettre en place des discussions internationales de suivi, comme nous le rapportions précédemment.

La session du Conseil fait suite à une série d'incidents dans lesquels des agents d'IA ont perdu le contrôle ou accédé à des systèmes sans autorisation, renforçant l'examen externe des capacités autonomes.

Un test de gouvernance pour Worldcoin (WLD)

Lues ensemble, les deux histoires tracent une même trajectoire : la capacité de pointe dépasse la faculté d'évaluation de tout pays isolé. Le document déterminant, le décret du 2 juin, est un droit souple — sa fenêtre d'inspection de 30 jours est volontaire, ne lie que les laboratoires qui y adhèrent et n'impose aucun régime de licence. Les indicateurs à court terme à surveiller sont concrets : l'AISI recevra-t-il Claude Mythos 5.1 pendant qu'Anthropic travaille avec Washington à un accès élargi, et les discussions internationales de suivi évoquées par OpenAI à l'ONU se concrétiseront-elles.

L'évaluation du FMI sur l'Europe et la course mondiale à l'IA cadre cette contre-pression : l'Europe ne peut pas raisonnablement dépendre d'autres pour satisfaire tous ses besoins en IA. Pour les participants à l'écosystème Worldcoin, la prémisse de preuve d'humanité du jeton suppose précisément ce type de gouvernance transfrontalière de l'IA — faisant de la conception de ces cadres un élément directement déterminant pour le projet, tandis que la mécanique de jeton de gouvernance du WLD donne aux détenteurs un intérêt dans l'adaptation du protocole.