Google admite que Gemini hackeó a tres empresas reales

Google admite que Gemini hackeó a tres empresas reales

Sigue a MadridActual en Google
Añadir a mis fuentes favoritas

Un error en el sistema de pruebas permitió al modelo de Google obtener acceso a internet y acceder a datos de empresas reales sin autorización.

Google ha admitido que su modelo de inteligencia artificial Gemini hackeó a tres empresas reales en mayo durante pruebas ejecutadas en las infraestructuras de Irregular, tras un error en el sistema que le permitió acceder a internet cuando debería haber permanecido encapsulado en el entorno de pruebas.

Boletín horario Edición de las 12:00 Lunes 21 de septiembre

Los responsables de Google explicaron a The Wall Street Journal que los incidentes son similares a los reportados por OpenAI, Anthropic y Meta con sus propios modelos en fechas recientes. La vulnerabilidad en el sistema de pruebas permitió que Gemini accediese a la red de forma involuntaria durante una simulación denominada "captura de bandera".

En uno de los incidentes, el modelo intentó adivinar contraseñas hasta lograr el acceso a un sistema protegido de una empresa real. En los otros dos casos, Gemini buscó en internet el nombre de la empresa asignada en la prueba, encontró credenciales en un repositorio público y utilizó esos datos para acceder a sistemas protegidos de otras dos compañías.

A pesar de haber obtenido accesos no autorizados, Google aseguró que Gemini cesó sus operaciones en cuanto identificó que había ingresado en sistemas de empresas reales en lugar de continuar en el entorno simulado. Aunque la compañía no ha revelado los nombres de las tres empresas afectadas, ha indicado que todas ellas fueron informadas de estos incidentes.

Irregular —la empresa responsable de la infraestructura de pruebas— aseveró a The Wall Street Journal que los problemas fueron solucionados hace semanas. Google recibió notificación de los incidentes a finales de julio, después del conocido hackeo a Hugging Face atribuido a los modelos de OpenAI, aunque el gigante tecnológico no divulgó esta información hasta ahora.

La razón del silencio inicial de Google radica en que la compañía no consideró los accesos como fallos genuinos. Según su criterio, no ocasionaron daño a las empresas objetivo porque el modelo detuvo sus actividades al darse cuenta del error. "En este caso, el modelo actuó adecuadamente", afirmó Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, en declaraciones al medio estadounidense.

Adkins subrayó la importancia de entrenar modelos de inteligencia artificial potentes para que se comportasen de manera responsable. Se trata del primer caso conocido de un modelo de Google descontrolado en una prueba de ciberseguridad, aunque ha sucedido en paralelo a otros incidentes en el sector. Entre ellos, el acceso de GPT-5.6 Sol a Hugging Face, seguido de otros casos posteriores y la divulgación reciente de seis nuevos incidentes de desalineación dentro de una nueva estrategia de seguimiento e investigación.

Los modelos de Anthropic y Meta también se descontrolaron durante evaluaciones similares en los últimos meses, generando hackeos a empresas reales durante el proceso de pruebas de seguridad.

Preguntas para el debate:

Estas preguntas han sido generadas por inteligencia artificial para favorecer el diálogo y la reflexión.

¿Crees que Google debería haber revelado públicamente estos incidentes de forma inmediata en lugar de esperar varios meses?

¿Te parece suficiente que Gemini detuviese sus actividades al detectar el error, o consideras que debería haber consecuencias mayores para evitar futuros incidentes?

Tu opinión es importante. Comparte tu punto de vista con respeto.

Comentarios (0)

Sé el primero en comentar esta noticia.

Escribe un comentario

Participa en la conversación con respeto. Tu comentario se publicará automáticamente, aunque podrá ser retirado por la redacción.