Anthropic dijo el viernes que los usuarios de Claude Security ahora pueden acceder a Claude Mythos 5 para escanear repositorios de código en busca de vulnerabilidades explotables. La oferta amplía el acceso al modelo especializado en ciberseguridad de la firma, aunque el uso directo seguirá estando restringido.
Claude Security, que está disponible en beta pública para clientes de Claude Enterprise, no permite a los usuarios acceder directamente al modelo Mythos; más bien, trabajan a través de una interfaz que ejecuta Mythos en segundo plano y solo devuelve ciertos artefactos, como un informe de errores o una corrección sugerida.
"El comportamiento más riesgoso ocurre cuando un usuario tiene acceso directo a un modelo, donde un actor malicioso puede intentar orientarlo hacia usos dañinos", explica la firma en su anuncio. "Pero si los usuarios solo pueden recibir resultados específicos, como un parche para una vulnerabilidad o una alerta de seguridad, ese riesgo es mucho menor."
35 millones de dólares en créditos de seguridad
Anthropic también lanzó el Defender Advantage Fund, estilizado como 0xDAF, que distribuirá 35 millones de dólares en créditos de cómputo de Claude a organizaciones dedicadas a la seguridad de código abierto.
Los fondos se destinarán a grupos "que trabajan para corregir vulnerabilidades en proyectos de código abierto, automatizar partes del proceso de escaneo y corrección de software de código abierto, y experimentar con nuevos enfoques de seguridad", según Anthropic. La firma dijo que comenzará con un pequeño número de premios piloto más grandes y nombrará a los beneficiarios en las próximas semanas.
La iniciativa 0xDAF es independiente del anterior esfuerzo Project Glasswing, que contó con el respaldo de hasta 100 millones de dólares en créditos de modelo y 4 millones de dólares en donaciones directas, y también distribuyó acceso limitado a Mythos a investigadores de ciberseguridad.
El despliegue controlado sigue a incidentes en los que modelos Claude lograron escapar de sus entornos de prueba previstos y acceder a la web abierta.The Latent informó anteriormente que los modelos Claude llegaron a sistemas en vivo en tres organizaciones durante tres incidentes entre 141,006 ejecuciones de pruebas de ciberseguridad. En uno de esos incidentes, Mythos 5 publicó un paquete de Python con código oculto que se ejecutó en 15 máquinas no relacionadas.
Un modelo Mythos anterior también desarrolló un ataque matemático que debilitó HAWK, un algoritmo bajo consideración en un proceso federal de criptografía poscuántica, informó The Latent en julio.
