OpenAI afirmó el domingo que ha alcanzado su objetivo de crear un «pasante de investigación» automatizado y publicó un informe sobre el papel cada vez más importante de los agentes de programación en la investigación de IA.
La empresa define el objetivo como «un sistema capaz de llevar a cabo tareas de investigación bien definidas bajo dirección humana, incluidas tareas que le llevarían unos días a un investigador cualificado». Su objetivo es crear un investigador de IA automatizado para marzo de 2028, según el informe.
A mediados de agosto, los agentes de IA de la empresa registraban un promedio de 3,1 días laborables de tiempo de ejecución por cada jornada laboral humana en toda su organización de investigación, utilizando como referencia una jornada de ocho horas. El uso diario de computación del investigador humano mediano superó los 600 dólares a precios de API; la factura del investigador situado en el percentil 90 superó los 7.000 dólares.
Sin embargo, esas cifras en dólares miden el uso de computación, no el valor de los resultados de investigación equivalentes. OpenAI advirtió que una mayor cantidad de código y experimentos no se traduce necesariamente en un progreso proporcional. Más de la mitad de las tareas exitosas que se estimaba que llevarían a los humanos entre cuatro y ocho horas requirieron intervención, según el informe, y los investigadores humanos seguían siendo necesarios para establecer las prioridades de investigación y decidir qué resultados estudiar más a fondo.
Kevin Liu, miembro del equipo Frontier Evals de OpenAI, afirmó en X que la automejora recursiva, en la que la IA ayuda a crear una IA mejor, podría convertirse en uno de los principales motores del progreso de la IA durante los próximos años. Instó a otras empresas a publicar datos similares.
«Ser transparentes es más urgente que nunca, para que podamos informar el debate público sobre si debemos ralentizar el desarrollo de modelos y cómo hacerlo», escribió Liu.
La divulgación se produce después de la pausa de dos semanas en el entrenamiento de aprendizaje por refuerzo de OpenAI en sus modelos más recientes destinados a su implementación, una pausa provocada por el hackeo del repositorio de modelos de IA Hugging Face por parte de sus agentes de IA. La empresa afirmó que reforzó la seguridad y la supervisión después de la intrusión en Hugging Face y tras observar indicios de las posibles capacidades de ciberseguridad de Astra.
OpenAI afirmó en el informe del domingo que todavía no sabe cómo lograr de forma segura una automejora recursiva completa y apoya exigir a los laboratorios que divulguen sus avances.
