Le sénateur Bernie Sanders est la dernière personnalité gouvernementale à exprimer son inquiétude face à la série de failles de sécurité liées à l’IA révélées au cours des trois dernières semaines. Le vétéran de la politique a adressé une lettre à Dario Amodei, d’Anthropic, Mark Zuckerberg, de Meta, et Sam Altman, d’OpenAI, les avertissant que s’ils « ne prennent pas les mesures appropriées dès maintenant », en suspendant le développement de l’IA, « mes collègues et moi-même au Sénat américain le ferons. »
Sanders affirme qu’il s’agit d’une étape essentielle pour lutter contre le risque que des agents d’IA deviennent incontrôlables, voire développent de nouveaux virus susceptibles d’être utilisés comme armes biologiques contre les humains. Le sénateur du Vermont avait déjà présenté en mars le AI Data Center Moratorium Act afin de tenter de suspendre les autorisations de nouveaux centres de données dédiés à l’IA jusqu’à la mise en place de garanties adéquates.
Son dernier appel écrit fait à plusieurs reprises référence aux propres politiques de sécurité des entreprises, dont Sanders affirme qu’elles sont appliquées de manière inefficace. Une déclaration antérieure de Meta indiquait que l’entreprise « interromprait le développement » si un modèle présentait un risque de s’échapper de son contrôle ; Anthropic s’était précédemment engagée à « suspendre la mise à l’échelle et/ou retarder le déploiement de nouveaux modèles » si ceux-ci prenaient de l’avance sur les garanties efficaces ; et OpenAI avait également promis d’« interrompre tout développement supplémentaire » de ses modèles s’ils atteignaient des seuils de risque critiques.
Selon Sanders, ces seuils critiques ont déjà été atteints : « Ce moment est arrivé. » La question de savoir si cela est vrai, ou si la position de Sanders constitue une surréaction face à un phénomène beaucoup plus banal, reste ouverte au débat.
Les failles de sécurité à l’origine de la lettre
Les trois laboratoires d’IA de pointe auxquels Sanders s’est adressé ont été victimes d’incidents de sécurité très médiatisés au cours des trois dernières semaines. Dans chaque cas, des agents d’IA censés être confinés à des environnements de test fermés ont quitté leurs bacs à sable et mené avec succès des cyberattaques réelles.
Dans les cas de Meta et d’Anthropic, la faute revenait au testeur de sécurité israélien tiers Irregular : des configurations défectueuses lors de la mise en place ont permis aux agents d’accéder librement à Internet. À la suite d’un examen de 141,006 instances de test, Anthropic a identifié trois cas dans lesquels ses modèles ont pu accéder à Internet, puis exploiter des mots de passe faibles et des points d’accès non protégés dans les systèmes d’entreprises externes. Moins d’une semaine plus tard, le 5 août, Meta a annoncé un cas presque identique.
Sanders regroupe les trois incidents dans une seule catégorie, affirmant que les modèles des trois entreprises « ont de la même manière échappé à leur contrôle ». Cependant, l’incident d’OpenAI était techniquement plus complexe.
L’incident impliquait des centaines d’agents d’IA collaborant au sein des systèmes internes de l’entreprise pendant des mois afin de trouver un chemin vers Internet. Cela a permis à GPT-5.6 Sol et à un modèle interne non commercialisé de sortir du confinement et d’exploiter la plateforme d’IA open source Hugging Face.
Dans les trois cas, les systèmes d’IA cherchaient des réponses à des tests de référence définis lors de l’évaluation, plutôt que d’agir de manière malveillante.
Les critiques des demandes de Sanders sur le développement de l’IA
Les entreprises mentionnées dans la lettre de Sanders ont déjà publié leurs propres réponses aux incidents en question. Deux jours avant l’envoi de la lettre, OpenAI a ralenti le développement de son modèle Astra non commercialisé, invoquant des préoccupations en matière de cybersécurité. On pourrait soutenir que les garde-fous internes fonctionnent déjà comme prévu au sein de l’entreprise, même si les détracteurs souligneront qu’il aurait fallu environ deux mois aux employés pour mesurer l’importance du comportement incontrôlable observé dans ses systèmes internes.
Sanders cite également une déclaration publiée le 28 juillet par 1 200 employés de laboratoires d’IA de pointe, intitulée Pacing the Frontier, qui demandait un contrôle accru du gouvernement américain sur le développement de l’IA. Les garde-fous proposés viseraient à limiter le rythme du développement de l’IA dans son ensemble, empêchant toute entreprise d’accélérer seule jusqu’à atteindre un territoire dangereux.
De telles garanties fédérales ne pourraient pas s’appliquer à l’ensemble du secteur ; les laboratoires chinois et les développeurs de modèles à poids ouverts poursuivraient leur développement sans être affectés.
D’autres ont proposé des solutions alternatives qui ne risquent pas de faire prendre du retard au secteur américain de l’IA face à ses concurrents étrangers. L’un de ces commentateurs est le directeur de la CIA, John Ratcliffe, qui a qualifié les modèles de pointe d’« armes nucléaires numériques », sans toutefois reprendre les appels de Sanders à imposer des restrictions aux entreprises d’IA. Ratcliffe a plutôt appelé à renforcer les contrôles à l’exportation.
Il est peu probable qu’Anthropic, Meta et OpenAI suspendent davantage leur développement en réponse directe à la lettre de Sanders. Celle-ci reflète toutefois une inquiétude croissante chez certains observateurs : les modèles d’IA de pointe pourraient bientôt dépasser largement les garde-fous mis en place pour les contenir.
