Selon certaines informations, les hauts dirigeants d’OpenAI, d’Anthropic et d’autres entreprises d’intelligence artificielle élaborent en privé des scénarios de révolte publique et politique après un événement catastrophique lié à l’IA.
La planification porte sur un incident potentiel de grande ampleur, très probablement une cyberattaque, qui pourrait perturber les services financiers, l’accès à Internet, l’approvisionnement en électricité ou en eau, a rapporté Axios vendredi. Par ailleurs, des initiés anonymes du secteur de l’IA ont déclaré au média qu’ils pensaient qu’un incident majeur pourrait se produire dans les six à 12 prochains mois.
Les dommages causés par un tel événement pourraient renforcer le scepticisme du public à l’égard de l’IA et des dirigeants de son secteur, notamment le PDG d’Anthropic, Dario Amodei, et le PDG d’OpenAI, Sam Altman, ainsi que du président Trump en raison de sa réticence à la réglementer, a indiqué le média.
La planification par scénarios est courante dans de nombreux secteurs, mais la principale différence ici est que nombre des principaux chercheurs et dirigeants de l’IA estiment qu’un incident majeur est inévitable, selon le rapport.
« OpenAI mène des exercices de préparation au cours desquels les équipes examinent et analysent toute une série de scénarios potentiels », a déclaré un porte-parole d’OpenAI à Axios. « Ces scénarios ne sont pas considérés comme inévitables, mais ils sont destinés à nous aider à nous préparer à diverses situations. » Anthropic a refusé de commenter.
The Latent a également sollicité OpenAI et Anthropic pour recueillir leurs commentaires.
Les inquiétudes s’intensifient
Des incidents récents ont suscité des inquiétudes quant aux risques posés par des systèmes d’IA de plus en plus performants. En juillet, OpenAI a révélé qu’un agent d’IA faisant l’objet de tests internes s’était échappé de son bac à sable et avait compromis les systèmes de Hugging Face. OpenAI a ensuite indiqué qu’un modèle de la famille Astra, encore inédit, avait inséré des instructions « semblables à un jailbreak » dans ses propres résumés de tâches pendant son entraînement.
Des agents d’OpenAI ont également obtenu un accès non autorisé à des systèmes du gouvernement australien pendant des tests, notamment à un portail de statistiques de Medicare. Au Royaume-Uni, des responsables ont lancé un examen de sécurité après qu’un modèle d’OpenAI a accédé à des statistiques gouvernementales accessibles au public, bien qu’aucune défense de sécurité n’ait été contournée et qu’aucune donnée personnelle n’ait été consultée. Par ailleurs, des chercheurs de l’entreprise de cybersécurité Hacktron AI ont utilisé Claude d’Anthropic pour accéder aux comptes ChatGPT de plusieurs employés d’OpenAI.
À l’approche des élections américaines de mi-mandat, les responsables de la planification du secteur de l’IA se préparent à l’éventualité que les démocrates prennent le contrôle du Congrès et agissent rapidement pour restreindre le développement de l’IA, a rapporté Axios. Le sénateur Bernie Sanders et le représentant Greg Casar ont déjà présenté une proposition de loi qui interdirait la superintelligence artificielle et suspendrait le développement de l’IA avancée jusqu’à ce qu’un organisme fédéral de réglementation soit opérationnel, les infractions étant passibles d’une peine pouvant aller jusqu’à 20 ans de prison.
Cependant, la large disponibilité de modèles téléchargeables à poids ouverts rendrait ces restrictions difficiles à faire respecter.
Selon Axios, la planification de l’événement catastrophique comprendrait des exercices de mise à l’épreuve axés sur les scénarios les plus défavorables, ainsi qu’un travail d’information auprès des membres du Congrès. Bien qu’il soit peu probable qu’une nouvelle loi soit adoptée dans les conditions actuelles, les dirigeants des entreprises souhaitent néanmoins contribuer à façonner les politiques auxquelles les responsables américains pourraient recourir après un incident majeur lié à l’IA.
