Le gouvernement fédéral américain finalise cette semaine son cadre d’évaluation des capacités cyber des modèles d’IA de pointe, tandis que des dirigeants du secteur et des responsables de la Maison-Blanche doivent se réunir mardi pour en discuter le contenu. Au cœur du cadre figure une période d’examen facultative, durant laquelle les développeurs participants soumettraient leurs nouveaux modèles aux agences gouvernementales jusqu’à 30 jours avant leur mise à disposition à plus grande échelle.
Cette annonce intervient moins de trois semaines après qu’OpenAI a annoncé que l’un de ses modèles avait « rompu son confinement » durant des tests et compromis la plateforme d’IA open source Hugging Face, devenant ainsi la première faille de ce type documentée publiquement. Comme l’a indiqué OpenAI dans son rapport d’analyse post-incident, « l’architecture de confinement elle-même est devenue une partie de la surface d’attaque ».
Cet incident a placé au premier plan la question des mesures de cybersécurité pour les modèles d’IA, notamment les garde-fous mis en place durant les tests internes. Anthropic a ensuite révélé que ses propres modèles étaient parvenus à franchir les systèmes de trois entreprises après une configuration incorrecte des garde-fous des environnements isolés lors de la mise en place des tests.
OpenAI propose déjà depuis plusieurs semaines aux responsables fédéraux des avant-premières de ses modèles Astra non commercialisés, en amont de la finalisation du cadre. L’entreprise devrait participer à la réunion de la Maison-Blanche aux côtés de représentants d’Anthropic, de Google et de Meta.
La réaction des parlementaires face aux menaces cyber liées à l’IA
Aux États-Unis, les parlementaires s’efforcent de répondre aux menaces potentielles liées à l’IA aux niveaux des États fédérés et fédéral. La Californie, New York et l’Illinois ont instauré la divulgation obligatoire des incidents pour les développeurs d’IA de pointe. Quinze procureurs généraux républicains d’États fédérés envisageraient également d’assigner OpenAI en justice pour des allégations liées à la protection des consommateurs.
L’Executive Order 14409 — la directive qui décrit ce nouveau cadre fédéral d’examen — a été signé le 2 juin, en réponse aux affirmations d’Anthropic concernant les capacités cyber de son modèle Mythos. Des représentants des laboratoires d’IA de pointe auraient eu accès à des versions préliminaires du cadre, avec la possibilité de soumettre des demandes de révision.
Bien que son contenu exact ne soit pas public, le décret ordonne aux agences fédérales de mettre en place des tests d’évaluation comparative pour les nouveaux modèles et d’établir des lignes directrices claires concernant les modèles qui répondent à la définition de « modèles de pointe couverts ». Il établira également une plateforme commune entre l’industrie et le gouvernement pour détecter et corriger les failles logicielles avec l’aide de l’IA.
Un tel accès gouvernemental aux modèles de pointe n’est pas sans précédent : en vertu de la législation européenne sur l’IA, la Commission européenne peut exiger des développeurs qu’ils fournissent un accès aux modèles d’IA à usage général à des fins d’évaluations réglementaires. L’équivalent américain rend la participation explicitement volontaire et précise qu’il ne s’agit pas d’une obligation d’obtenir une licence pour lancer de nouveaux modèles.
