A OpenAI afirmou no domingo que alcançou sua meta de um “estagiário de pesquisa” automatizado, publicando um relatório sobre o papel crescente dos agentes de programação na pesquisa de IA.

A empresa define a meta como “um sistema capaz de realizar tarefas de pesquisa bem definidas sob orientação humana, incluindo tarefas que levariam alguns dias para um pesquisador experiente”. A empresa pretende desenvolver um pesquisador de IA automatizado até março de 2028, segundo o relatório.

Em meados de agosto, os agentes de IA da empresa registraram, em média, 3,1 dias úteis de tempo de execução por dia útil humano em toda a organização de pesquisa, usando como padrão um dia de oito horas. O uso diário mediano de computação por um pesquisador humano ultrapassou US$ 600 a preços de API; a conta do pesquisador no percentil 90 ultrapassou US$ 7.000.

Esses valores em dólares medem o uso de computação, e não o valor do resultado de pesquisa equivalente. A OpenAI alertou que mais código e experimentos não necessariamente se traduzem em um progresso proporcional. Mais da metade das tarefas bem-sucedidas que, segundo estimativas, levariam de quatro a oito horas para humanos exigiram intervenção, de acordo com o relatório, e os pesquisadores humanos ainda foram necessários para definir as prioridades de pesquisa e decidir quais resultados deveriam ser investigados mais a fundo.

Kevin Liu, membro da equipe Frontier Evals da OpenAI, afirmou no X que o autoaperfeiçoamento recursivo, no qual a IA ajuda a criar uma IA melhor, pode se tornar um dos principais motores do progresso da IA nos próximos anos. Ele incentivou outras empresas a publicar dados semelhantes.

“Ser transparente é mais urgente do que nunca, para que possamos contribuir para o debate público sobre se e como devemos definir o ritmo do desenvolvimento de modelos”, escreveu Liu.

A divulgação ocorre após a pausa de duas semanas da OpenAI em treinamentos de aprendizado por reforço em seus modelos mais recentes destinados à implantação, desencadeada pelo ataque de seus agentes de IA ao repositório de modelos de IA Hugging Face. A empresa afirmou que reforçou a segurança e o monitoramento após a violação do Hugging Face e depois de encontrar evidências das possíveis capacidades de cibersegurança da Astra.

A OpenAI afirmou no relatório de domingo que ainda não sabe como alcançar com segurança o autoaperfeiçoamento recursivo completo e apoia a exigência de que os laboratórios divulguem seu progresso.