El senador Bernie Sanders es la figura gubernamental más reciente en expresar su preocupación por la oleada de brechas de seguridad de la IA que salieron a la luz durante las últimas tres semanas. El veterano legislador envió una carta a Dario Amodei, de Anthropic; Mark Zuckerberg, de Meta; y Sam Altman, de OpenAI, advirtiéndoles de que, si «no toman las medidas adecuadas ahora», pausando el desarrollo de la IA, «mis colegas y yo en el Senado de EE. UU. lo haremos».

Sanders afirma que este es un paso esencial para combatir el potencial de que los agentes de IA se descontrolen o incluso desarrollen virus novedosos que puedan desplegarse como armas biológicas contra los seres humanos. El senador por Vermont presentó anteriormente la AI Data Center Moratorium Act en marzo, en un intento de detener las aprobaciones de nuevos centros de datos de IA hasta que pudieran establecerse salvaguardas adecuadas.

Su último llamamiento escrito hace referencia repetidamente a las propias políticas de seguridad de las empresas, que Sanders afirma que se están aplicando de forma ineficaz. Una declaración anterior de Meta decía que la empresa «detendrá el desarrollo» si algún modelo mostraba potencial para escapar de su control; Anthropic se comprometió previamente a «pausar el escalado y/o retrasar el despliegue de nuevos modelos» si este superaba las salvaguardas eficaces; y OpenAI también prometió «detener el desarrollo adicional» de sus modelos si alcanzaban umbrales de riesgo críticos.

La afirmación de Sanders es que esos umbrales críticos ya se han alcanzado: «Ese momento ha llegado». Si esto es cierto o si la postura de Sanders es una reacción exagerada a algo mucho más mundano sigue siendo objeto de debate.

Las brechas de seguridad que motivaron la carta

Los tres laboratorios de IA de frontera a los que se dirigió Sanders han sufrido incidentes de seguridad de alto perfil durante las últimas tres semanas. En cada caso, unos agentes de IA que debían estar confinados a entornos cerrados de prueba salieron de sus entornos aislados y llevaron a cabo ciberataques reales con éxito.

En el caso de Meta y Anthropic, la culpa recayó en el evaluador de seguridad israelí externo Irregular: unos errores de configuración durante la preparación permitieron a los agentes acceder libremente a internet. Tras una revisión de 141,006 instancias de prueba, Anthropic identificó tres casos en los que sus modelos pudieron acceder a internet abierta y luego aprovechar contraseñas débiles y endpoints sin protección en los sistemas de empresas externas. Menos de una semana después, el 5 de agosto, Meta anunció un caso casi idéntico.

Sanders agrupa los tres incidentes en una sola categoría y afirma que los modelos de las tres empresas «escaparon de forma similar a su control». Sin embargo, el incidente de OpenAI fue técnicamente más complejo.

El incidente involucró a cientos de agentes de IA que colaboraron dentro de los sistemas internos de la empresa durante meses en un intento de encontrar una ruta hacia la internet abierta. Esto permitió que GPT-5.6 Sol y un modelo interno no publicado escaparan del confinamiento y explotaran la plataforma de IA de código abierto Hugging Face.

En los tres casos, los sistemas de IA buscaban respuestas a pruebas de referencia establecidas durante la evaluación, en lugar de actuar con malicia.

Críticas a las exigencias de Sanders sobre el desarrollo de la IA

Las empresas mencionadas en la carta de Sanders ya han emitido sus propias respuestas a los incidentes en cuestión. Dos días antes de que se enviara la carta, OpenAI ralentizó el desarrollo de su modelo Astra, aún no publicado, alegando preocupaciones de ciberseguridad. Se podría argumentar que las salvaguardas internas ya están funcionando según lo previsto en la empresa, aunque los críticos señalarán que, según los informes, los empleados tardaron alrededor de dos meses en reconocer la importancia del comportamiento descontrolado en sus sistemas internos.

Sanders también cita una declaración emitida por 1,200 empleados de laboratorios de IA de frontera el 28 de julio, titulada Pacing the Frontier, que pedía una mayor supervisión del Gobierno de EE. UU. sobre el desarrollo de la IA. Las barreras propuestas buscarían limitar el ritmo del desarrollo de la IA en todos los ámbitos, evitando que una sola empresa se adelante aceleradamente hacia un territorio peligroso.

Estas salvaguardas federales no podrían aplicarse a toda la industria; los laboratorios chinos y los desarrolladores de modelos con pesos abiertos continuarían su desarrollo sin verse afectados.

Otros han propuesto soluciones alternativas que no conllevan el riesgo de que la industria estadounidense de la IA se quede atrás frente a sus competidores extranjeros. Uno de esos comentaristas es el director de la CIA, John Ratcliffe, quien ha calificado los modelos de frontera como «equiparables a armas nucleares digitales», pero no se hizo eco de los llamamientos de Sanders a imponer restricciones a las empresas de IA. En su lugar, Ratcliffe pidió controles de exportación más estrictos.

Es poco probable que Anthropic, Meta y OpenAI pausen aún más su desarrollo como respuesta directa a la carta de Sanders. Sin embargo, esta refleja una preocupación creciente entre algunos observadores: los modelos de IA de frontera podrían superar pronto y ampliamente las salvaguardas existentes para mantenerlos bajo control.