Por Redacción YSKL
El modelo de inteligencia artificial Gemini, desarrollado por Google, accedió durante una prueba a sistemas protegidos de tres empresas después de encontrar información pública y obtener credenciales de acceso.
Según Google, se trata del primer caso conocido en el que uno de sus sistemas de IA realizó este tipo de actividad de manera autónoma.
Los incidentes ocurrieron en mayo, durante una evaluación de capacidades de ciberseguridad realizada por Irregular, una empresa independiente especializada en pruebas de seguridad informática.
Así obtuvo acceso Gemini
De acuerdo con Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, Gemini encontró información disponible públicamente en Internet y utilizó esos datos durante la evaluación para acceder a sitios que consideraba dentro del alcance de la prueba.
Según información publicada por The Wall Street Journal, en uno de los casos el modelo logró acceder a un sistema protegido después de adivinar contraseñas.
En los otros dos, encontró credenciales en un repositorio público que posteriormente utilizó para ingresar a sistemas protegidos.
Adkins indicó que Gemini detuvo su actividad de hackeo en los tres casos.
Google notificó a empresas involucradas
Adkins afirmó que Google informó de los incidentes a las tres entidades afectadas y trabajó con Irregular en modificaciones a sus procedimientos de evaluación.
“Nos aseguramos de informar a las tres entidades y colaboramos con nuestro socio de pruebas en los cambios que han implementado en sus procesos de evaluación”, señaló.
La ejecutiva añadió que los incidentes muestran la necesidad de desarrollar mecanismos que permitan a los modelos de IA actuar de manera responsable a medida que aumentan sus capacidades.
“Estos sucesos ponen de relieve la importancia de entrenar modelos de IA potentes para que actúen de manera responsable”, afirmó.
Irregular reportó incidentes similares en otros modelos
Un portavoz de Irregular señaló que el problema estaba relacionado con una situación que también afectó a otros laboratorios de inteligencia artificial. La empresa indicó que los laboratorios involucrados fueron notificados a finales de julio.
“Todos los problemas conocidos por nuestra parte fueron subsanados y resueltos hace semanas”, declaró el portavoz.
Meta, Anthropic y OpenAI también reportaron incidentes similares relacionados con evaluaciones realizadas por Irregular.
En agosto, Meta señaló que su caso no había supuesto una filtración del entorno de pruebas ni un ciberataque sofisticado.
Irregular, por su parte, informó que trabaja en mejores prácticas para realizar evaluaciones de ciberseguridad de sistemas de inteligencia artificial de forma segura.
El acceso a Internet plantea nuevos desafíos de seguridad
Los incidentes han abierto interrogantes sobre las medidas necesarias para controlar sistemas de IA con mayores niveles de autonomía y acceso a Internet y a infraestructura informática.
El caso de Gemini ocurrió dentro de una prueba de seguridad, pero puso de manifiesto que un modelo puede utilizar información disponible en línea para obtener credenciales y avanzar hacia sistemas protegidos.
Google indicó que, en los tres casos identificados, Gemini finalmente detuvo su actividad.

