La Maison-Blanche a demandé à certains laboratoires américains d’IA, dont OpenAI et Anthropic, de réserver l’accès à leurs nouveaux modèles de frontière aux tests du gouvernement américain avant de les partager avec d’autres organismes d’évaluation indépendants, comme l’AI Security Institute (UK AISI), qui fait référence dans le domaine 1.

  • L’administration américaine remettrait ainsi en cause l’accès privilégié pré-déploiement dont disposait jusqu’ici cet institut public britannique.
  • L’ordre d’accès aux nouveaux modèles de frontière serait désormais le suivant : d’abord, une évaluation par le gouvernement américain, puis la sécurisation des systèmes américains, et seulement ensuite le partage du modèle avec des partenaires étrangers.

L’institut UK AISI est l’un des principaux organismes publics au monde spécialisés dans l’évaluation pré et post-déploiement des modèles de frontière.

  • Créé en novembre 2023 à la suite du sommet sur la sécurité de l’IA de Bletchley Park, il évalue la plupart des modèles à la frontière et documente notamment leurs capacités cyber, biologiques et chimiques, l’autonomie des agents ou encore les risques liés à l’auto-amélioration récursive de l’IA.
  • Comme d’autres organisations indépendantes d’évaluation (METR, Redwood Research notamment), le UK AISI pouvait bénéficier d’un accès anticipé à des checkpoints pré-déploiement grand public afin d’effectuer les tests sur ses propres benchmarks pour documenter la progression des capacités et des risques associés aux modèles d’IA.

Début septembre, le Financial Times rapportait que le UK AISI n’avait pas eu accès à Mythos 5.1, alors qu’il disposait historiquement d’un accès anticipé aux principaux modèles américains 2. Auparavant, OpenAI, Anthropic et Google DeepMind ont tous fourni à l’Institut un accès à certains de leurs modèles les plus avancés afin qu’ils soient testés.

Cette évolution intervient alors que les capacités cyber des modèles de frontière deviennent un sujet de sécurité nationale.

  • En juin, l’administration américaine avait déjà imposé des contrôles à l’exportation sur Fable et Mythos, les modèles d’Anthropic, notamment en raison de l’amélioration rapide de leurs capacités dans le domaine de la cybersécurité, interdisant ainsi leur utilisation par des ressortissants étrangers.
  • La NSA teste désormais les modèles avancés pour identifier des vulnérabilités susceptibles d’affecter les systèmes de renseignement et de défense et développe ses propres évaluations. L’agence y consacrerait plusieurs milliards de dollars par an, principalement en capacités de calcul 3.
  • L’équivalent direct américain du UK AISI, le Center for AI Standards and Innovation (CAISI), reste beaucoup plus limité en moyens que l’institut britannique. Hébergé au NIST, le CAISI est sous-financé et dispose d’effectifs de recherche plus réduits.

Les laboratoires d’IA ont également proposé une évaluation directement entre laboratoires, sans supervision gouvernementale. Ils testeraient ainsi réciproquement leurs modèles avant leur mise sur le marché.

  • Google, OpenAI et Anthropic travaillent conjointement à la création d’un organisme privé de normalisation consacré à la sécurité de l’IA, qui pourrait définir des standards communs d’évaluation pré-déploiement.
  • La question autour des capacités d’évaluation indépendantes devient d’autant plus centrale que les capacités et les architectures des modèles évoluent.
  • Redwood Research souligne notamment que certaines architectures pourraient réduire fortement la capacité d’évaluateurs humains à surveiller et auditer le comportement des modèles, alors qu’ils raisonnent non plus via une chaîne de pensée textuelle compréhensible mais via des états latents internes non observables directement 4.

Au-delà des tests et rapports d’évaluation, cette asymétrie d’accès aux modèles frontières touche dans les usages l’industrie européenne. Le projet Glasswing, le programme d’Anthropic donnant un accès anticipé à Mythos, a permis dès avril aux banques et entreprises critiques américaines de renforcer leur défense cyber, notamment en recherchant avec Mythos des vulnérabilités dans leurs propres systèmes. Les banques européennes n’y ont eu accès que plusieurs mois plus tard.

Sources
  1. Sophia Cai et Joseph Bambridge, « White House asks OpenAI and Anthropic to hold new models from UK testers until US review », Politico, 24 septembre 2026.
  2. Lucy Fisher et Madhumita Murgia, « Anthropic withheld latest AI model from UK testing agency », Financial Times, 9 septembre 2026.
  3. Jeff Stein, « Classified Estimates Show the NSA Is Paying Billions to Test AI Models », The Washington Sun, 24 septembre 2026.
  4. Lukas Finnveden et. al., Latent reasoning architectures would undermine CoT, our strongest oversight tool, Redwood Research, 23 septembre 2026.