Abliteration.ai a publié le 31 août une version modifiée de GLM-5.3 qui supprime certaines protections liées à la cybersécurité, au red teaming et aux tests d’agents IA que d’autres modèles peuvent refuser.
« Nous l’avons abliteré et hébergé afin qu’il réalise les tâches de cyber offensive, de red teaming et de test d’agents que d’autres modèles refusent », a déclaré l’entreprise dans un post sur X le 31 août.
Baptisé abliterated-model-large-v2, le modèle est basé sur GLM-5.3, qui, selon Abliteration.ai, se classe troisième sur Terminal-Bench 4.0, derrière Opus 5 et Fable. L’entreprise a indiqué que GLM-5.3 offre des performances deux fois supérieures à celles de GLM-5.2 en matière d’exploitation de systèmes informatiques.
Selon le post, l’« ablitération » a permis à l’entreprise d’identifier dans les activations du modèle des directions associées aux refus et de les supprimer de ses poids. Elle a déclaré que les capacités de codage, de cyber et d’agent autonome du modèle restent intactes après la modification.
La version modifiée s’appuie sur les métriques de référence de GLM-5.3, qui comprennent un score de 84,5 % sur CyberGym, dépassant des modèles comme Mythos 5 et GPT-5.6 Sol. Sur ExploitBench, GLM-5.3 a affiché un taux de réussite de 54,4 %, contre 24,4 % pour GLM-5.2. Le modèle a également accompli 105 tâches sur ExploitGym en deux heures, contre 29 auparavant.
Selon l’entreprise, le modèle hébergé est basé aux États-Unis, utilise une précision FP8 et dispose d’une fenêtre de contexte d’un million de tokens. Abliteration.ai a également indiqué qu’elle ne conserve aucune invite d’entrée ou de sortie.
L’entreprise a rendu le modèle disponible via une API compatible avec le format de requête d’OpenAI. Les utilisateurs peuvent créer une clé API depuis la console d’Abliteration.ai et envoyer des requêtes à son endpoint de complétion de chat. L’API prend également en charge la diffusion des tokens et propose une passerelle de politiques pour les contrôles de gouvernance.
L’entreprise a déclaré que le modèle est conçu pour la cybersécurité offensive, le red teaming d’IA, les tests d’agents et les applications de confiance et de sécurité.
