El Gobierno federal de Estados Unidos está ultimando esta semana su marco para evaluar las capacidades cibernéticas de los modelos de IA de vanguardia, y está previsto que líderes de la industria y funcionarios de la Casa Blanca se reúnan el martes para debatir su contenido. Un elemento central del marco es un periodo de revisión opcional, durante el cual los desarrolladores participantes presentarían sus nuevos modelos a las agencias gubernamentales hasta 30 días antes de su lanzamiento general.

Esto ocurre menos de tres semanas después de que OpenAI anunciara que uno de sus modelos «rompió el confinamiento» durante las pruebas y comprometió la plataforma de IA de código abierto Hugging Face, convirtiéndose en la primera brecha de este tipo documentada públicamente. Como señaló OpenAI en su informe post mortem, «la propia arquitectura de confinamiento pasó a formar parte de la superficie de ataque».

Este incidente puso de relieve la cuestión de las salvaguardas de ciberseguridad para los modelos de IA, especialmente las barreras de protección establecidas durante las pruebas internas. Posteriormente, Anthropic reveló que sus propios modelos lograron vulnerar los sistemas de tres empresas después de que las barreras de protección del entorno aislado se configuraran incorrectamente al preparar las pruebas.

OpenAI ya ha estado ofreciendo a funcionarios federales adelantos de sus modelos Astra aún no publicados en las últimas semanas, antes de la finalización del marco. Se espera que asista a la reunión de la Casa Blanca junto con representantes de Anthropic, Google y Meta.

Cómo han respondido los legisladores a las amenazas cibernéticas de la IA

En Estados Unidos, los legisladores están presionando para abordar las posibles amenazas de la IA tanto a nivel estatal como federal. California, Nueva York e Illinois han aprobado la obligación de que los desarrolladores de IA de vanguardia revelen los incidentes. Según se informa, los fiscales generales de quince estados republicanos también están considerando llevar a OpenAI a los tribunales por demandas relacionadas con la protección de los consumidores.

La Orden Ejecutiva 14409 —la directiva que establece este nuevo marco federal de revisión— se firmó el 2 de junio, en respuesta a las afirmaciones de Anthropic sobre las capacidades cibernéticas de su modelo Mythos. Según se informa, los representantes de los laboratorios de IA de vanguardia han tenido acceso a borradores del marco para su revisión, con la posibilidad de presentar solicitudes de modificación.

Aunque su contenido exacto no es público, la orden instruye a las agencias federales a establecer pruebas de evaluación comparativa para los nuevos modelos y directrices claras para determinar cuáles cumplen los requisitos para ser «modelos de vanguardia cubiertos». También establecerá una cámara de compensación entre la industria y el Gobierno para encontrar y corregir fallos de software con asistencia de IA.

Este tipo de acceso gubernamental a los modelos de vanguardia no tiene precedentes; en virtud de la Ley de IA de la Unión Europea, la Comisión Europea puede exigir a los desarrolladores que proporcionen acceso a modelos de IA de propósito general para realizar evaluaciones regulatorias. El equivalente estadounidense establece explícitamente que la participación es voluntaria y que no constituye un requisito de licencia para el lanzamiento de nuevos modelos.