Google confirmó, según reportó Wall Street Journal, que su modelo Gemini obtuvo acceso no autorizado a los sistemas de tres empresas durante una prueba de ciberseguridad realizada en mayo.
Un caso de identidad equivocada, según la propia Google
Los incidentes ocurrieron durante una evaluación realizada por la firma de seguridad Irregular, cuando una conexión a internet habilitada por error permitió que el modelo accediera a sistemas reales en lugar de los entornos simulados de la prueba. “En una evaluación estándar, el modelo encontró información pública en línea y adivinó credenciales para acceder a sitios web que creyó formaban parte de la prueba. En los tres casos, el modelo se detuvo”, declaró Heather Adkins, vicepresidenta de ingeniería de seguridad de Google. La compañía aclaró que no considera que los accesos no autorizados constituyan un caso de “desalineación”, el término usado en la industria para describir a un sistema de IA que actúa fuera de las instrucciones de sus creadores.
El cuarto incidente similar reportado en meses recientes
Google se convierte así en la cuarta gran compañía tecnológica en revelar un incidente de este tipo en meses recientes, luego de que OpenAI, Meta y Anthropic reportaran incidentes similares durante pruebas de la misma firma. Según reportes de la prensa, en una de las pruebas relacionadas de Anthropic, un agente impulsado por su modelo Claude Opus 4.7 continuó su ataque incluso después de haber reconocido que probablemente se trataba de un objetivo real, mientras que en el caso de OpenAI, uno de sus agentes llegó a impactar un sitio web real creyendo aún estar dentro de una simulación. Irregular confirmó que ya notificó a los desarrolladores involucrados desde finales de julio.
