Blog

Los sistemas de inteligencia artificial son cada vez más capaces de explotación básica de credenciales

Los sistemas de inteligencia artificial son cada vez más capaces de explotación básica de credenciales

Google ha confirmado que uno de sus modelos Gemini irrumpió en los sistemas de tres empresas reales durante una prueba de ciberseguridad llevada a cabo en mayo de 2026. El incidente es el primer caso conocido públicamente en el que un sistema de IA accede a sistemas reales.

El caso fue reportado por The Wall Street Journal.

La prueba fue realizada por Irregular, una empresa que evalúa la seguridad de los modelos avanzados de IA.

Se suponía que Gémini atacaría a unas empresas ficticias dentro de un entorno controlado como parte de un ejercicio de captura de la bandera.

Pero había un problema: el entorno de prueba tenía acceso a Internet, y uno de los nombres de las compañías ficticias coincidía con el de una empresa real.

Una vez que Gémini pudo llegar a Internet, hizo lo que se le había pedido que hiciera.

Adivinó las contraseñas hasta que obtuvo acceso a un sistema protegido.

También encontró credenciales en un repositorio público y las utilizó para llegar a los sistemas pertenecientes a empresas reales.

El modelo simplemente llegó al objetivo equivocado porque el entorno de prueba estaba conectado al mundo real.

Eso se puede atribuir a un fallo básico durante la prueba.

También detuvo los ataques después de darse cuenta de que los sistemas pertenecían a compañías auténticas en lugar de los objetivos ficticios utilizados en el ejercicio.

Por su parte, Google dice que ninguna de las empresas sufrió daños y que las organizaciones afectadas fueron informadas.

Pero que un modelo de IA pueda encontrar credenciales de forma independiente, probar contraseñas e interactuar por su cuenta con sistemas externos no deja de ser inquietante.

Pero este no es un caso aislado.

Irregular se ha visto envuelto en incidentes similares que involucran modelos de Anthropic, OpenAI y Meta.

En cada caso, el problema básico era similar: los sistemas de inteligencia artificial que se probaban en entornos controlados obtuvieron inesperadamente acceso a objetivos del mundo real.

Conclusión

No sabemos si, como dicen algunos, los sistemas de inteligencia artificial van a acabar con la humanidad en la próxima década.

Pero sí que son cada vez más capaces de reconocimiento, descubrimiento de credenciales y explotación básica, y están haciendo cada vez más este trabajo con menos intervención humana.

Por otro lado, los recientes incidentes relacionados con Gemini, Claude y otros sistemas sugieren que las pruebas de seguridad deben tener en cuenta lo que estos modelos realmente pueden hacer, en lugar de lo que los desarrolladores esperan que hagan.

En cualquier caso, ¿qué sucedería si un modelo de IA malicioso, sin salvaguardas ni limitaciones, se desplegase en el medio silvestre para perpetrar este tipo de cosas?