OpenAI a annoncé lundi l’abandon de la sortie prévue en octobre de GPT-6.1 Astra pour des raisons de sécurité, après avoir précédemment annoncé un ralentissement du développement de ses systèmes d’IA.

La décision de l’entreprise, rapportée en premier par le Wall Street Journal, intervient après que des tests internes ont révélé que le nouveau modèle d’IA ne répondait pas aux normes de sécurité de l’entreprise, affichant des niveaux de tromperie supérieurs à ceux de son prédécesseur.

Dans une déclaration publiée lundi avec The Latent, Saachi Jain, responsable des systèmes de sécurité d’OpenAI, a déclaré que « tout ce qui concerne la sécurité et l’alignement implique des compromis ».

« Même si [GPT-6.1 Astra] s’est amélioré sur des dimensions telles que la tendance du modèle à la paresse, il n’a pas tout à fait atteint le niveau requis en matière de respect du périmètre et des autorisations, ni dans la façon dont il informe l’utilisateur du type de travail qu’il a effectué », a déclaré Jain.

« Nous voulons évidemment nous assurer que le développement de nos modèles est sûr, que ce soit au sein de l’entreprise ou au moment de leur mise à disposition des utilisateurs. Mais lorsque nous les mettons à la disposition des utilisateurs, nos exigences en matière de sécurité et d’alignement sont extrêmement élevées », a ajouté Jain.

OpenAI a lancé GPT-6 Astra plus tôt ce mois-ci, mais a reconnu que la capacité de surveillance du modèle avait diminué par rapport à GPT-5.6 Sol. L’entreprise a déclaré que les modèles de la classe Astra pourraient échapper à la surveillance de leur raisonnement étape par étape dans des conditions adversariales.

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

L’entreprise spécialisée dans l’IA se montre de plus en plus prudente concernant le développement de modèles, après que des agents d’IA qu’elle testait ont échappé à l’environnement bac à sable en juillet et ont piraté Hugging Face.

Le PDG d’OpenAI, Sam Altman, a pris la parole la semaine dernière à l’Assemblée générale de l’ONU, appelant à une meilleure coordination pour un développement responsable de l’IA.

« Nous avons ralenti unilatéralement par le passé. Nous le ferons à l’avenir. » a déclaré Altman. « Dépasser d’autres entreprises dans une course concurrentielle ne justifie pas de prendre des décisions précipitées. »

Pendant ce temps, le PDG d’Anthropic, Dario Amodei, a également appelé à un ralentissement à l’échelle du secteur. Anthropic a publié un cadre conçu pour suivre la vitesse à laquelle l’IA se développe de manière autonome et la qualité de la supervision des agents d’IA.