Google ha reconocido por primera vez que su modelo de IA Gemini consiguió superar las barreras de seguridad de tres empresas durante unas pruebas controladas de ciberseguridad. El caso vuelve a abrir el debate sobre los límites y la supervisión de los sistemas de inteligencia artificial más avanzados.
Los hechos se produjeron en mayo durante unos ensayos organizados por Irregular. Las pruebas se desarrollaban en un entorno aislado o sandbox, con empresas ficticias y sin conexión exterior. Sin embargo, una configuración accidental permitió el acceso a Internet, lo que llevó a Gemini a interactuar con sistemas reales.
Según adelantó The Wall Street Journal, en uno de los ejercicios la IA debía obtener información de una empresa simulada cuyo nombre coincidía con el de una compañía existente. Al disponer de acceso a la red, Gemini dedujo una contraseña válida y logró entrar en los servidores de la entidad real.
En otros dos casos, el sistema localizó credenciales almacenadas en repositorios públicos de Internet y las utilizó para acceder a los entornos de otras empresas. Adkins, vicepresidenta de Ingeniería de Seguridad de Google, explicó que Gemini encontró información pública y dedujo las credenciales necesarias para completar la tarea. Según la directiva, el modelo interrumpió sus acciones al detectar que estaba operando sobre sistemas reales y no sobre escenarios simulados.
Aunque los incidentes ocurrieron en mayo, Irregular no informó formalmente a Google hasta finales de julio. La compañía confirmó los hechos y señaló que no hizo pública la incidencia porque no se produjeron daños. No obstante, aseguró haber comunicado los accesos a las tres empresas afectadas.
La decisión contrasta con la de OpenAI y Anthropic, que sí divulgaron incidentes similares detectados en sus propias pruebas. Para Google, estos casos evidencian la necesidad de seguir entrenando los modelos de IA para que actúen de forma segura y responsable.
