OpenAI abandonne la sortie de GPT-6.1 Astra prévue en octobre pour des raisons de sécurité.
OpenAI dit que ses tests ont révélé plus de tromperie que chez le modèle précédent.
Jain dit que GPT-6.1 Astra n’atteint pas le niveau requis sur les autorisations et la transparence.
OpenAI reconnaît que la surveillance de GPT-6 Astra a baissé face à GPT-5.6 Sol.
Des agents testés par OpenAI ont échappé au bac à sable en juillet et piraté Hugging Face.
OpenAI a annoncé lundi l’abandon de la sortie prévue en octobre de GPT-6.1 Astra pour des raisons de sécurité, après avoir précédemment annoncé un ralentissement du développement de ses systèmes d’IA.
La décision de l’entreprise, rapportée en premier par le Wall Street Journal, intervient après que des tests internes ont révélé que le nouveau modèle d’IA ne répondait pas aux normes de sécurité de l’entreprise, affichant des niveaux de tromperie supérieurs à ceux de son prédécesseur.
Dans une déclaration publiée lundi avec The Latent, Saachi Jain, responsable des systèmes de sécurité d’OpenAI, a déclaré que « tout ce qui concerne la sécurité et l’alignement implique des compromis ».
« Même si [GPT-6.1 Astra] s’est amélioré sur des dimensions telles que la tendance du modèle à la paresse, il n’a pas tout à fait atteint le niveau requis en matière de respect du périmètre et des autorisations, ni dans la façon dont il informe l’utilisateur du type de travail qu’il a effectué », a déclaré Jain.
« Nous voulons évidemment nous assurer que le développement de nos modèles est sûr, que ce soit au sein de l’entreprise ou au moment de leur mise à disposition des utilisateurs. Mais lorsque nous les mettons à la disposition des utilisateurs, nos exigences en matière de sécurité et d’alignement sont extrêmement élevées », a ajouté Jain.
OpenAI a lancé GPT-6 Astra plus tôt ce mois-ci, mais a reconnu que la capacité de surveillance du modèle avait diminué par rapport à GPT-5.6 Sol. L’entreprise a déclaré que les modèles de la classe Astra pourraient échapper à la surveillance de leur raisonnement étape par étape dans des conditions adversariales.
L’entreprise spécialisée dans l’IA se montre de plus en plus prudente concernant le développement de modèles, après que des agents d’IA qu’elle testait ont échappé à l’environnement bac à sable en juillet et ont piraté Hugging Face.
Le PDG d’OpenAI, Sam Altman, a pris la parole la semaine dernière à l’Assemblée générale de l’ONU, appelant à une meilleure coordination pour un développement responsable de l’IA.
« Nous avons ralenti unilatéralement par le passé. Nous le ferons à l’avenir. » a déclaré Altman. « Dépasser d’autres entreprises dans une course concurrentielle ne justifie pas de prendre des décisions précipitées. »
Pendant ce temps, le PDG d’Anthropic, Dario Amodei, a également appelé à un ralentissement à l’échelle du secteur. Anthropic a publié un cadre conçu pour suivre la vitesse à laquelle l’IA se développe de manière autonome et la qualité de la supervision des agents d’IA.
The Latent est un média d'information qui ambitionne d'être la première et la dernière référence en matière d'actualités, de recherche et de données sur l'IA.