A Anthropic lançou uma nova estrutura criada para acompanhar a velocidade com que a IA está se desenvolvendo e o grau de supervisão dos agentes de IA, enquanto o CEO Dario Amodei pressiona por uma desaceleração em todo o setor.

Em uma publicação no blog publicada na quinta-feira, a Anthropic apresentou três métricas que abrangem quanto de sua pesquisa e desenvolvimento de IA é realizado por IA, como os agentes são monitorados e como a capacidade computacional é alocada.

"Enquanto o mundo considera como definir o ritmo da fronteira, devemos fazer todo o possível para minimizar a distância entre o que os laboratórios de fronteira sabem e o que o público sabe", afirmou a empresa em uma publicação separada no X. "Isso significa medir melhor o desenvolvimento da IA, publicar nossas descobertas e dar à sociedade a oportunidade de decidir como usar essas informações."

A empresa afirmou que planeja integrar avaliadores terceirizados com acesso a sistemas e dados internos comparável ao usado por suas próprias equipes de avaliação de riscos.

View on X

P&D conduzida por IA

Em particular, a Anthropic informou que o Claude "lidera" 26% do trabalho de P&D de IA da empresa em agosto de 2026, ante 25% em julho e 14% em junho, indicando que o modelo de IA consegue concluir a maior parte de uma tarefa "de ponta a ponta a partir de um prompt de alto nível", enquanto um humano supervisiona o processo.

A empresa observou que mais de 90% do trabalho de P&D de IA da companhia agora envolve a colaboração entre IA e humanos ou é realizado além desse nível.

Sobre a segunda métrica, a Anthropic afirmou que, em agosto, operava cerca de 30.000 agentes de IA realizando trabalhos de pesquisa e engenharia a qualquer momento em sua plataforma interna mais utilizada. A empresa disse que todas as ações dos agentes passavam por um sistema de monitoramento automatizado.

Especificamente, entre mais de 1 bilhão de decisões, seus monitores online bloquearam 0,002% das ações — ou cerca de 1 em 47.000. Os monitores offline também sinalizaram de um a dois de cada 1.000 registros para análise adicional.

A empresa afirmou que, de cerca de 100.000 sinalizações semanais, aproximadamente 50 casos de alta prioridade foram encaminhados. Segundo a publicação, essas ações bloqueadas devem passar por análise humana no prazo de uma semana.

Alocação de poder computacional

A Anthropic também monitora como o poder computacional é dividido entre o trabalho de segurança e outras atividades de P&D.

A empresa afirmou que examinou seu uso total de poder computacional durante uma semana de referência, de 13 a 20 de julho. Cerca de 6% do poder computacional usado para P&D de IA foi alocado à segurança, enquanto aproximadamente 12% do poder computacional usado para P&D de IA conduzida por IA foi destinado à segurança.

A desenvolvedora do Claude também observou que lançou a estrutura como um protótipo de transparência para todo o setor. "Esperamos estabelecer um modelo de transparência ao divulgar essas métricas e continuaremos fazendo isso", afirmou a empresa.

A estrutura mais recente da Anthropic veio depois que o CEO Dario Amodei pediu uma desaceleração do ritmo do desenvolvimento de IA de fronteira no fim de semana, citando riscos crescentes à segurança. Sam Altman, da OpenAI, Demis Hassabis, do Google DeepMind, e o fundador da xAI, Elon Musk, também expressaram preocupações semelhantes ou apoiaram a ideia.

OpenAI vs. Anthropic Revenue Run Rate

OpenAI vs. Anthropic Revenue Run Rate

  • OpenAI
  • Anthropic
SOURCE: The Latent

Da mesma forma, a OpenAI publicou uma nova estrutura na quarta-feira para relatar desalinhamentos em modelos de IA e divulgou seis relatórios de casos de comportamento não intencional em modelos documentados pela equipe nos últimos seis meses.

"Exemplos de desalinhamento podem ajudar a identificar problemas que outros desenvolvedores de IA podem encontrar quando seus sistemas alcançarem capacidades semelhantes, revelar fragilidades nas salvaguardas ou questionar suposições sobre o comportamento dos modelos", escreveu a OpenAI. "Compartilhar essas descobertas permite que outros investiguem os mesmos problemas, testem nossas explicações e aprimorem as medidas de mitigação."