Google ha presentado su esperado modelo, Gemini 4 Argon, que ahora está disponible para un grupo de «defensores de la ciberseguridad de confianza» y evaluadores a través de su Fairwind Program.
En una publicación de blog publicada el miércoles, Koray Kavukcuoglu, vicepresidente sénior de Google DeepMind y principal arquitecto de IA de Google, dijo que el modelo está diseñado para mantener un razonamiento profundo en flujos de trabajo complejos y de largo plazo.
«Ofrece un rendimiento de vanguardia en flujos de trabajo complejos de ingeniería de software en entornos reales, tareas de conocimiento empresarial como las legales y financieras, y defensa de la ciberseguridad», dijo Kavukcuoglu.
El nuevo modelo se implementará por fases. El equipo dijo que seguirá recopilando comentarios de los primeros evaluadores para perfeccionar las medidas de seguridad.
«Publicar de forma segura capacidades de vanguardia de este nivel requiere un enfoque por fases», dijo Kavukcuoglu. «Participamos activamente en el proceso voluntario del Gobierno de EE. UU. para el acceso a modelos antes de su lanzamiento, mientras ampliamos gradualmente el acceso».
Se espera que el modelo Gemini 4 Argon se lance con un precio introductorio de 2 $ por cada millón de tokens de entrada y 10 $ por cada millón de tokens de salida, según la publicación. Los tokens de entrada almacenados en caché tendrán un descuento del 95 % sobre el precio de los tokens de entrada.
Capacidades mejoradas
El nuevo modelo cuenta con un límite de salida ampliado de 1 millón de tokens, frente a los 64.000 anteriores, según la publicación.
«Cuando el modelo tiene margen suficiente para pensar profundamente y generar cientos de miles de tokens en una sola trayectoria, aporta un nuevo nivel de profundidad al razonamiento para resolver problemas difíciles de una vez», dijo Kavukcuoglu.
Kavukcuoglu señaló que los ingenieros de Google han estado utilizando Argon para sus tareas diarias, incluida la depuración, las migraciones de bases de código y el diseño de algoritmos.
Sin embargo, Bloomberg informó el miércoles que algunos ingenieros internos se mostraban escépticos: afirmaban que Gemini 4 tenía un buen desempeño en las pruebas comparativas utilizadas para medir la eficacia del modelo, pero que su rendimiento era peor cuando el personal lo ponía realmente a trabajar.
Más potencia para el trabajo de conocimiento y la seguridad
Google también destacó las capacidades de comprensión visual del nuevo modelo. Puede analizar gráficos, identificar detalles en videos y emprender acciones basándose en una serie de documentos, según Kavukcuoglu.
El modelo también es «altamente capaz en la defensa de la ciberseguridad» y puede identificar, validar y corregir de forma autónoma vulnerabilidades de software, dijo Kavukcuoglu.
Por ejemplo, la empresa de seguridad Wiz ya está utilizando Argon para la defensa de la ciberseguridad. Google dijo que el modelo descubrió una vulnerabilidad que dejaba expuestos datos personales confidenciales en software sanitario utilizado por hospitales de todo el mundo.
El equipo también dijo que el modelo está diseñado para «rechazar solicitudes dañinas» y evitar que actores maliciosos lo utilicen para realizar ataques.
«Estas salvaguardas fueron sometidas a pruebas de robustez por equipos rojos internos y externos mediante una combinación de métodos de ataque manuales y automatizados», añadió Kavukcuoglu.
