Gemini llegó a sistemas de tres empresas en una prueba de ciberseguridad

Una evaluación de seguridad terminó con Gemini entrando en sistemas reales tras encontrar o adivinar credenciales durante el ejercicio.

Gemini llegó a sistemas de tres empresas durante una prueba de ciberseguridad
Gemini llegó a sistemas de tres empresas durante una prueba de ciberseguridad

La historia comenzó como una prueba controlada de ciberseguridad, pero terminó de una manera que llamó la atención dentro de la industria tecnológica. Gemini, el modelo de inteligencia artificial de Google, consiguió acceder a sistemas pertenecientes a tres empresas reales durante una evaluación realizada por la compañía especializada Irregular.

Los hechos ocurrieron en mayo de 2026, cuando el modelo participaba en un ejercicio conocido como “capture the flag”, diseñado para comprobar sus capacidades en tareas de seguridad informática. El objetivo era recuperar información dentro de una infraestructura preparada para la evaluación, pero el entorno tenía un detalle que terminó siendo determinante: Gemini tuvo acceso a internet cuando no estaba previsto que lo tuviera.

¿Cómo logró Gemini entrar a los sistemas de empresas reales?

Según la información difundida por The Wall Street Journal y confirmada posteriormente por Google, el modelo consiguió acceder a tres sistemas diferentes durante distintas ejecuciones de la prueba.

En uno de los casos, Gemini encontró una forma de obtener acceso al intentar diferentes contraseñas hasta conseguir entrar a un sistema protegido. En los otros dos episodios, realizó búsquedas en internet relacionadas con el nombre de una empresa ficticia utilizada dentro de la prueba.

Esas búsquedas llevaron al modelo hasta repositorios públicos que contenían credenciales pertenecientes a compañías reales. Gemini utilizó esas credenciales porque consideró que podían ayudarle a completar la tarea que tenía asignada.

El problema fue que los sistemas a los que llegó no formaban parte del entorno ficticio preparado para la evaluación. De esta manera, una prueba diseñada para medir capacidades de seguridad terminó involucrando infraestructura real.

¿Qué hizo Gemini después de acceder a los sistemas?

El comportamiento posterior fue uno de los puntos destacados por Google. La compañía señaló que, en los tres casos, el modelo detuvo la intrusión después de determinar que había accedido a sistemas de empresas reales.

Google también indicó que las compañías afectadas fueron notificadas y que las autoridades federales fueron informadas sobre lo sucedido. De acuerdo con la empresa, el incidente no provocó daños a las organizaciones involucradas.

Irregular, la compañía encargada de la evaluación, también señaló que los problemas relacionados con el ejercicio fueron corregidos y que las entidades afectadas fueron contactadas como parte de la investigación.

El incidente puso nuevamente sobre la mesa una situación que ya había aparecido en otras evaluaciones de modelos de inteligencia artificial: cuando estos sistemas reciben capacidad para buscar información, utilizar herramientas y ejecutar determinadas acciones, los límites de una prueba pueden resultar más difíciles de mantener.

¿Google considera que fue un fallo de seguridad de la IA?

Google señaló que el modelo actuó correctamente al detenerse una vez que identificó que había llegado a sistemas reales. La compañía también explicó que los incidentes ocurrieron con una versión anterior de Gemini y que se realizaron cambios en los procesos utilizados para las pruebas.

La interpretación del episodio, sin embargo, generó diferencias entre especialistas. Jack Cable, director ejecutivo de la empresa de seguridad de IA Corridor, cuestionó la forma en que Google caracterizó el incidente y señaló al WSJ que el punto importante era que un modelo había terminado realizando acciones contra sistemas reales.

Por ahora, el caso muestra cómo una evaluación diseñada para estudiar las capacidades de una IA puede producir situaciones inesperadas cuando el sistema tiene acceso a información pública y herramientas conectadas a internet.

El episodio de Gemini se suma así a otros incidentes relacionados con modelos de diferentes compañías durante pruebas de ciberseguridad. Reuters informó que casos similares han involucrado evaluaciones de sistemas de Meta, Anthropic y OpenAI, lo que mantiene el debate sobre las medidas necesarias para controlar este tipo de pruebas.

Mientras las empresas ajustan sus evaluaciones, Gemini queda nuevamente en el centro de la conversación sobre hasta dónde pueden llegar los modelos de inteligencia artificial cuando reciben herramientas capaces de interactuar con sistemas externos.

Salir de la versión móvil