O senador Bernie Sanders é a mais recente autoridade governamental a manifestar preocupação com a série de violações de segurança relacionadas à IA que vieram à tona nas últimas três semanas. O veterano legislador enviou uma carta a Dario Amodei, da Anthropic, Mark Zuckerberg, da Meta, e Sam Altman, da OpenAI, alertando que, se eles “não tomarem as medidas apropriadas agora”, pausando o desenvolvimento de IA, “meus colegas e eu no Senado dos EUA vamos fazê-lo”.

Sanders afirma que este é um passo essencial para combater o potencial de agentes de IA saírem de controle ou até desenvolverem novos vírus que poderiam ser usados como armas biológicas contra seres humanos. O senador de Vermont apresentou anteriormente a AI Data Center Moratorium Act em março, tentando interromper as aprovações de novos data centers de IA até que medidas de proteção adequadas pudessem ser estabelecidas.

Seu mais recente apelo por escrito faz repetidas referências às próprias políticas de segurança das empresas, que Sanders afirma estarem sendo aplicadas de maneira ineficaz. Uma declaração anterior da Meta dizia que a empresa “interromperia o desenvolvimento” se algum modelo demonstrasse potencial para escapar de seu controle; a Anthropic havia se comprometido anteriormente a “pausar a expansão e/ou adiar a implantação de novos modelos” caso eles avançassem mais rapidamente que as medidas de proteção eficazes; e a OpenAI também prometeu “interromper o desenvolvimento adicional” de seus modelos caso eles atingissem níveis críticos de risco.

A afirmação de Sanders é que esses níveis críticos já foram atingidos: “Esse momento chegou.” Se isso é verdade ou se a posição de Sanders é uma reação exagerada a algo muito mais banal continua em debate.

As violações de segurança que motivaram a carta

Os três laboratórios de IA de ponta abordados por Sanders sofreram incidentes de segurança de grande repercussão nas últimas três semanas. Em cada caso, agentes de IA que deveriam estar confinados a ambientes fechados de teste ultrapassaram seus ambientes isolados e realizaram ciberataques reais bem-sucedidos.

No caso da Meta e da Anthropic, a culpa foi atribuída à empresa terceirizada israelense de testes de segurança Irregular: configurações incorretas durante a preparação deram aos agentes acesso livre à internet. Após uma revisão de 141,006 instâncias de teste, a Anthropic identificou três casos em que seus modelos conseguiram acessar a internet aberta e, então, explorar senhas fracas e endpoints desprotegidos nos sistemas de empresas externas. Menos de uma semana depois, em 5 de agosto, a Meta anunciou um caso quase idêntico.

Sanders reúne os três incidentes em uma única categoria, afirmando que os modelos das três empresas “escaparam de maneira semelhante de seu controle”. No entanto, o incidente da OpenAI foi tecnicamente mais complexo.

O incidente envolveu centenas de agentes de IA colaborando nos sistemas internos da empresa durante meses, em uma tentativa de encontrar uma rota para a internet aberta. Isso permitiu que GPT-5.6 Sol e um modelo interno não lançado escapassem do confinamento e explorassem a plataforma de IA de código aberto Hugging Face.

Nos três casos, os sistemas de IA buscavam respostas para testes de benchmark definidos durante a avaliação, em vez de agir de forma maliciosa.

Críticas às exigências de Sanders para o desenvolvimento de IA

As empresas mencionadas na carta de Sanders já emitiram suas próprias respostas aos incidentes em questão. Dois dias antes do envio da carta, a OpenAI desacelerou o desenvolvimento de seu modelo Astra, ainda não lançado, citando preocupações de cibersegurança. Pode-se argumentar que as medidas de proteção internas já estão funcionando conforme o planejado na empresa, embora os críticos observem que, segundo relatos, os funcionários levaram cerca de dois meses para reconhecer a importância do comportamento descontrolado em seus sistemas internos.

Sanders também cita uma declaração emitida por 1,200 funcionários de laboratórios de IA de ponta em 28 de julho, intitulada Pacing the Frontier, que pediu maior supervisão do governo dos EUA sobre o desenvolvimento de IA. As salvaguardas propostas buscariam limitar o ritmo do desenvolvimento de IA de modo geral, impedindo que qualquer empresa avançasse sozinha rumo a um território perigoso.

Essas salvaguardas federais não poderiam se aplicar a todo o setor; laboratórios chineses e desenvolvedores de modelos com pesos abertos continuariam o desenvolvimento sem serem afetados.

Outros propuseram soluções alternativas que não colocariam a indústria de IA dos EUA em risco de ficar para trás em relação aos concorrentes estrangeiros. Um desses comentaristas é o diretor da CIA, John Ratcliffe, que chamou os modelos de ponta de “equivalentes digitais de armas nucleares”, mas não ecoou os pedidos de Sanders por restrições às empresas de IA. Em vez disso, Ratcliffe pediu controles de exportação mais rigorosos.

É improvável que Anthropic, Meta e OpenAI pausem ainda mais o desenvolvimento em resposta direta à carta de Sanders. Ela, no entanto, reflete uma preocupação crescente entre alguns observadores de que os modelos de IA de ponta possam em breve superar em muito as salvaguardas existentes para contê-los.