OpenAI a publié mercredi un article exhortant les gouvernements à imposer des exigences de sécurité obligatoires aux systèmes d’IA de pointe, affirmant qu’il reste peu de temps pour établir de telles règles.
« Nous sommes entrés dans un nouveau chapitre des capacités de l’IA, ce qui exige un nouveau chapitre pour la politique en matière d’IA », a déclaré Chris Lehane, Chief Global Affairs Officer d’OpenAI a déclaré. « Les décideurs politiques sont confrontés à un moment similaire : une fenêtre qui se referme pour établir des garde-fous durables avant que les capacités de l’IA ne dépassent les institutions chargées de les encadrer. »
Le dernier article d’OpenAI paraît un jour après que Jacob Coxon, un chercheur spécialisé dans le préentraînement ayant travaillé à la fois chez Anthropic et OpenAI, a publié un message sur X rapidement devenu viral, recueillant 138 millions de vues et déclenchant un débat intense sur les risques liés à l’accélération du développement de l’IA.
Coxon, annonçant sa démission d’Anthropic, a averti que les deux laboratoires d’IA se livraient une course vers une superintelligence capable de s’améliorer elle-même, sans prendre en compte les risques pour la civilisation. Coxon a déclaré que les développeurs d’IA partagent la conviction que cette technologie pourrait anéantir l’humanité d’ici 2030.
Lehane a souligné que l’auto-amélioration récursive entièrement autonome de l’IA n’est pas encore une réalité aujourd’hui et que les entreprises ne devraient pas la poursuivre en l’absence de garde-fous adéquats.
Cependant, Lehane a déclaré que l’IA avait déjà accéléré les capacités humaines dans de nombreux domaines et que cette évolution devait être encadrée par un contrôle humain significatif et des seuils de sécurité partagés à l’échelle mondiale, capables de freiner ou d’arrêter cette progression.
« Plus la technologie devient puissante, plus les garde-fous qui l’entourent doivent être solides », indique l’article.
Appel au Congrès
Dans son dernier article, OpenAI a déclaré vouloir collaborer avec le Congrès à l’élaboration de règles aux États-Unis couvrant les tests, l’évaluation indépendante, la cybersécurité, le signalement des incidents et les mesures permettant de suivre les progrès vers l’auto-amélioration récursive de l’IA.
En attendant l’entrée en vigueur d’une règle nationale, OpenAI a déclaré qu’il continuerait à soutenir les mesures prises au niveau des États, annonçant son soutien à quatre projets de loi en Californie — SB 813, AB 1405, SB 1119 et AB 1864 — qui portent sur l’évaluation des risques, les audits indépendants, les obligations de responsabilité et les mesures de protection physique contre les menaces liées à l’IA.
« Nous n’avions pas soutenu certains de ces projets de loi par le passé, mais nous les soutenons désormais après les avoir réévalués à la lumière de l’augmentation récente des capacités que nous avons observée », a déclaré Lehane. L’entreprise a précédemment exprimé son soutien au SB 53 de Californie, au RAISE Act de New York, au SB 315 de l’Illinois et aux audits indépendants prévus dans le projet de loi sur la sécurité de l’IA de pointe actuellement examiné dans le Massachusetts.
L’article appelle également à l’adoption de normes sectorielles pour surveiller le développement de l’IA, notamment les signes de désalignement impliquant qu’un modèle poursuit un objectif contraire aux intentions humaines ou aux limites fixées, sans intention malveillante.
Le dirigeant d’OpenAI a déclaré que la surveillance devait être associée à des obligations claires de transparence pour les entreprises, les obligeant à informer rapidement les parties concernées lorsque leurs modèles contournent sans autorisation les contrôles de sécurité d’une autre organisation. Un tel incident s’est produit en juillet, lorsque des agents d’OpenAI se sont échappés d’un environnement de test et ont piraté l’infrastructure de Hugging Face pour atteindre leur objectif.
OpenAI élabore actuellement un cadre de signalement des incidents de désalignement et a déclaré espérer l’utiliser pour contribuer à l’élaboration de politiques fédérales plus larges.
« Les modèles, la recherche et l’expertise technique circulent à l’échelle mondiale, et les défaillances impliquant les systèmes les plus capables pourraient avoir des conséquences bien au-delà du pays dans lequel ils sont développés », a écrit OpenAI. « Les États-Unis doivent établir des normes crédibles sur leur territoire s’ils veulent jouer un rôle de premier plan à l’international — et nous sommes de plus en plus convaincus que des normes internationales compatibles seront nécessaires. »
