Gemini accedió a sistemas externos durante una prueba de ciberseguridad realizada para evaluar las capacidades autónomas de la inteligencia artificial.
Gemini vulneró tres sistemas durante un test de ciberseguridad

Gemini vulneró tres sistemas durante un test de ciberseguridad

Gemini, el modelo de inteligencia artificial de Google, accedió a internet y vulneró sistemas de otras organizaciones durante una evaluación de ciberseguridad. El episodio representa el primer caso conocido en el que una IA de la compañía realizó autónomamente acciones de este tipo.

Los incidentes ocurrieron en mayo durante pruebas realizadas por Irregular, una empresa independiente especializada en evaluar capacidades de ciberseguridad. El modelo interpretó erróneamente que tres sitios externos formaban parte del entorno autorizado para el ejercicio.

Gemini consiguió credenciales para acceder a sistemas

Durante una evaluación estándar, el modelo localizó información disponible públicamente y obtuvo credenciales para entrar en tres sitios. En uno de los casos, probó contraseñas hasta conseguir acceso a un sistema protegido.

En los otros dos, encontró credenciales publicadas en un repositorio abierto y posteriormente las utilizó para acceder a sistemas protegidos, según información publicada originalmente por The Wall Street Journal.

Google notificó a las tres organizaciones afectadas y trabajó con su socio de entrenamiento para modificar los procedimientos utilizados durante las evaluaciones.

Heather Adkins, vicepresidenta de ingeniería de seguridad de Google, afirmó que los episodios muestran la importancia de entrenar modelos potentes para actuar responsablemente.

Otras compañías registraron incidentes similares

Irregular aseguró que resolvió los problemas detectados semanas atrás y notificó a los laboratorios relevantes a finales de julio. Meta, Anthropic y OpenAI también revelaron incidentes relacionados con evaluaciones realizadas por la misma empresa.

Meta señaló anteriormente que su caso no implicó escapar de un entorno aislado ni ejecutar un ataque informático sofisticado. Irregular, mientras tanto, trabaja en mejores prácticas para realizar este tipo de evaluaciones de manera segura.

Los episodios plantean nuevas preguntas para la industria sobre los controles necesarios conforme los agentes de inteligencia artificial reciben mayor autonomía y acceso a internet.

En este caso, tres organizaciones externas quedaron expuestas durante una prueba diseñada originalmente para medir capacidades de ciberseguridad.

Otra lectura recomendada: Converse retira anuncio tras críticas por imágenes racistas
Noticias Relacionadas
Converse retira una campaña protagonizada por Karina tras críticas por elementos visuales asociados con imágenes racistas en Estados Unidos.
Perros rescatistas reciben meses de entrenamiento para localizar personas entre escombros y trabajar con sus guías durante emergencias.
Banco Azteca lleva finanzas personales a las aulas para evitar deudas
Choque en la autopista México-Toluca deja dos personas muertas dentro de un vehículo híbrido de origen chino.
El iPhone Duo de 2 TB cuesta 77,999 pesos en México y lleva el smartphone premium hacia el mercado de lujo.
Revolut confirma la exposición de información personal de clientes mediante solicitudes fraudulentas enviadas desde un dominio gubernamental.