A Abliteration.ai lançou uma versão modificada do GLM-5.3 em 31 de ago., removendo algumas proteções relacionadas à cibersegurança, ao red teaming e aos testes de agentes de IA que outros modelos podem se recusar a realizar.
"Nós o abliteramos e hospedamos para que ele realize o trabalho de cibersegurança ofensiva, red teaming e testes de agentes que outros modelos se recusam a fazer", afirmou a empresa em uma publicação no X em 31 de ago.
Batizado de abliterated-model-large-v2, o modelo é baseado no GLM-5.3, que, segundo a Abliteration.ai, ocupa o terceiro lugar no Terminal-Bench 4.0, atrás do Opus 5 e do Fable. A empresa observou que o GLM-5.3 tem o dobro do desempenho em exploração cibernética do GLM-5.2.
Segundo a publicação, a “abliteration” permitiu que a empresa identificasse direções nas ativações do modelo associadas às recusas e as removesse de seus pesos. A empresa afirmou que as capacidades de programação, cibersegurança e operação autônoma do modelo permanecem intactas após a modificação.
O lançamento modificado se baseia nas métricas de benchmark do GLM-5.3, que incluem uma pontuação de 84.5% no CyberGym, superando modelos como Mythos 5 e GPT-5.6 Sol. No ExploitBench, o GLM-5.3 demonstrou uma taxa de sucesso de 54.4%, acima dos 24.4% do GLM-5.2. O modelo também concluiu 105 tarefas no ExploitGym em uma janela de duas horas, ante 29 anteriormente.
Segundo a empresa, o modelo hospedado está baseado nos EUA, usa precisão FP8 e tem uma janela de contexto de 1 milhão de tokens. A Abliteration.ai também afirmou que não retém prompts de entrada ou saída.
A empresa disponibilizou o modelo por meio de uma API compatível com o formato de requisições da OpenAI. Os usuários podem criar uma chave de API pelo console da Abliteration.ai e enviar requisições ao endpoint de conclusões de chat. A API também oferece suporte à transmissão de tokens e disponibiliza um gateway de políticas para controles de governança.
A empresa afirmou que o modelo foi desenvolvido para cibersegurança ofensiva, red teaming de IA, testes de agentes e aplicações de confiança e segurança.
