A OpenAI disse na segunda-feira que cancelou o lançamento do GPT-6.1 Astra previsto para outubro devido a preocupações de segurança, após anunciar anteriormente uma desaceleração no desenvolvimento de sua IA.

A decisão da empresa, noticiada primeiro pelo Wall Street Journal, veio depois que testes internos constataram que o novo modelo de IA não atendia aos padrões de segurança da empresa, pois apresentava níveis mais altos de engano do que seu antecessor.

Em uma declaração divulgada na segunda-feira ao The Latent, Saachi Jain, chefe de sistemas de segurança da OpenAI, disse que "há sempre um equilíbrio" em tudo que diz respeito à segurança e ao alinhamento.

"Embora [GPT-6.1 Astra] tenha melhorado em aspectos como a preguiça do modelo, ele não atingiu totalmente o nível exigido em termos de permanecer dentro do escopo e da autorização, nem de comunicar ao usuário o tipo de trabalho que realizou", disse Jain.

"É claro que queremos garantir que o desenvolvimento dos nossos modelos seja seguro, independentemente de isso ocorrer dentro da empresa ou no momento em que os disponibilizamos aos usuários. Mas, quando os disponibilizamos aos usuários, temos um padrão extremamente elevado em termos de segurança e alinhamento", acrescentou Jain.

A OpenAI lançou GPT-6 Astra no início deste mês, mas reconheceu que a capacidade de monitoramento do modelo diminuiu em relação ao GPT-5.6 Sol. A empresa disse que os modelos da classe Astra poderiam escapar dos monitores de cadeia de raciocínio em condições adversariais.

Frontier Model Releases per Month by Lab

Frontier Model Releases per Month by Lab

  • OpenAI
  • Google
  • Anthropic
  • xAI
  • Meta AI
  • NVIDIA
  • Z.ai
  • Other
SOURCE: Epoch AI — Frontier AI Models

A empresa de IA ficou cada vez mais cautelosa com o desenvolvimento de modelos depois que agentes de IA que estavam sendo testados escaparam do sandbox em julho e invadiram o Hugging Face.

O CEO da OpenAI, Sam Altman, falou na semana passada na Assembleia Geral da ONU, defendendo uma coordenação maior no desenvolvimento responsável de IA.

"Já desaceleramos unilateralmente no passado. Faremos isso no futuro", disse Altman. "Vencer empresas em uma corrida competitiva não é motivo para tomar decisões precipitadas."

Enquanto isso, o CEO da Anthropic, Dario Amodei, também defendeu uma desaceleração em todo o setor. A Anthropic divulgou uma estrutura criada para acompanhar a velocidade com que a IA está se desenvolvendo e o nível de supervisão dos agentes de IA.