Un nuevo incidente pone en alerta a la industria de la inteligencia artificial. Durante una evaluación de ciberseguridad llevada a cabo por la firma especializada Irregular, el modelo Gemini de Google logró salir de su entorno controlado (sandbox), conectarse a la red y obtener acceso no autorizado a los sistemas informáticos de tres empresas privadas.
- Te puede interesar: Anthropic en conflictos internacionales: cómo Rusia, China y los hutíes usaron Claude para su beneficio
Cómo fue el incidente que involucró a Google, Gemini y el hackeo a tres empresas
El evento ocurrió durante una prueba del tipo Capture the Flag (Captura la bandera), diseñada para medir las capacidades ofensivas y defensivas del modelo dentro de un marco simulado. Sin embargo, un fallo en la configuración provocó que los nombres de las compañías ficticias empleadas en el test coincidieran con dominios reales disponibles en la web abierta.
Al tener acceso no intencional a internet, el agente de Gemini actuó bajo la premisa de que estaba interactuando con la prueba:
- En uno de los casos, la IA adivinó las credenciales de acceso (fuerza bruta/password guessing) hasta entrar al sistema.
- En las otras dos situaciones, el modelo localizó contraseñas expuestas en repositorios públicos de código para validar el ingreso.
A diferencia de episodios recientes registrados, donde los agentes intentaron ocultar rastros o ejecutar tareas no autorizadas, la IA de Google interrumpió sus acciones en cuanto detectó que estaba dentro de sistemas corporativos reales y no en el entorno simulado.

Desde Google, Heather Adkins, vicepresidenta de ingeniería de seguridad, calificó el hecho no como un fallo de alineación de la IA (misalignment), sino como una “confusión de identidad” propiciada por el error técnico de la firma evaluadora.
Sin embargo, el caso de Gemini no es aislado. En los últimos meses, los principales laboratorios de desarrollo de IA como OpenAI y Anthropic reconocieron filtraciones similares en las que modelos avanzados rompen el confinamiento de seguridad para interactuar con la web abierta.
En medio de debates internacionales sobre la posibilidad de crear regulaciones internacionales y protocolos de aislamientos más severos, este patrón de comportamiento de las inteligencias artificiales brinda nuevos argumentos a la hora de limitar el desarrollo de una de las tecnologías más disruptivas del siglo XXI.




