O governo federal dos EUA está finalizando nesta semana sua estrutura para avaliar as capacidades cibernéticas de modelos de IA de fronteira, com líderes do setor e autoridades da Casa Branca prontos para se reunir na terça-feira para discutir seu conteúdo. Um elemento central da estrutura é uma janela de revisão opcional, na qual os desenvolvedores participantes enviarão seus novos modelos às agências governamentais até 30 dias antes do lançamento mais amplo.
Isso acontece menos de três semanas depois de a OpenAI anunciar que um de seus modelos “rompeu a contenção” durante os testes e comprometeu a plataforma de IA de código aberto Hugging Face, tornando-se a primeira violação desse tipo documentada publicamente. Como a OpenAI observou em seu relatório pós-incidente, "a própria arquitetura de contenção passou a fazer parte da superfície de ataque."
Esse incidente colocou em foco a questão das salvaguardas de cibersegurança para modelos de IA, particularmente as barreiras de proteção configuradas durante os testes internos. A Anthropic posteriormente revelou que seus próprios modelos conseguiram violar os sistemas de três empresas depois que as barreiras de proteção das sandboxes foram configuradas incorretamente durante a preparação dos testes.
A OpenAI já vem oferecendo a autoridades federais prévias de seus modelos Astra ainda não lançados nas últimas semanas, antes da finalização da estrutura. A expectativa é que a empresa participe da reunião na Casa Branca ao lado de representantes da Anthropic, do Google e da Meta.
Como parlamentares responderam às ameaças cibernéticas da IA
Nos EUA, parlamentares estão pressionando para enfrentar possíveis ameaças da IA nos níveis estadual e federal. Califórnia, Nova York e Illinois promulgaram a divulgação obrigatória de incidentes para desenvolvedores de IA de fronteira. Também há relatos de que 15 procuradores-gerais estaduais republicanos estão considerando processar a OpenAI por alegações relacionadas à proteção do consumidor.
A Ordem Executiva 14409 — a diretriz que estabelece essa nova estrutura federal de revisão — foi assinada em 2 de junho, em resposta às alegações da Anthropic sobre as capacidades cibernéticas de seu modelo Mythos. Segundo relatos, representantes dos laboratórios de IA de fronteira tiveram acesso a cópias preliminares da estrutura para revisão, com a oportunidade de enviar pedidos de alteração.
Embora seu conteúdo exato não seja público, a ordem determina que as agências federais criem testes de referência para novos modelos e estabeleçam diretrizes claras sobre quais se qualificam como “modelos de fronteira abrangidos”. Ela também criará uma câmara de compensação entre o setor e o governo para encontrar e corrigir falhas de software com assistência de IA.
Esse tipo de acesso governamental a modelos de fronteira não é inédito; nos termos da Lei de IA da União Europeia, a Comissão Europeia pode exigir que os desenvolvedores forneçam acesso a modelos de IA de uso geral para avaliações regulatórias. O equivalente nos EUA torna a participação explicitamente voluntária e afirma que ela não é um requisito de licenciamento para o lançamento de novos modelos.
