Fundado en 1910

El modelo dispuso por error de acceso a la red y adivinó contraseñas para entrar en sistemas ajenos a la pruebaKenneth Cheung

Inteligencia artificial

Gemini accede sin permiso a tres empresas reales tras un fallo en sus pruebas de ciberseguridad

Google asegura que el propio agente detuvo las operaciones de forma autónoma al percatarse de la equivocación

Una prueba de evaluación de ciberseguridad realizada en mayo derivó en un incidente inesperado cuando Gemini, la inteligencia artificial de Google, rebasó los límites del entorno controlado de simulación. Debido a un error de configuración, el modelo dispuso de una conexión a internet no prevista y confundió los sistemas de tres empresas reales con objetivos legítimos del ejercicio, logrando acceder a sus servidores de forma autónoma.

Las pruebas estaban dirigidas por la firma especializada Irregular, encargada de evaluar las capacidades defensivas y ofensivas de los modelos de tecnológicas como Meta, OpenAI o Anthropic. Durante la actividad, Gemini aprovechó el acceso a la red para rastrear información pública y probar credenciales mediante «ataques de fuerza bruta».

Mediante esta técnica, el modelo logró descifrar la contraseña de una de las compañías e ingresar en sus sistemas informáticos. Según la vicepresidenta de ingeniería de seguridad de Google, Heather Adkins, la propia inteligencia artificial «frenó sus acciones en cuanto identificó que las infraestructuras afectadas no pertenecían al entorno de prueba, deteniendo el proceso sin llegar a realizar un uso malicioso de la información».

Ocultación del incidente

El suceso se mantuvo al margen del conocimiento público durante cuatro meses y solo salió a la luz tras una investigación de The Wall Street Journal. Aunque Google avisó en privado a las tres empresas afectadas y ajustó los métodos de evaluación junto a Irregular, la compañía decidió no divulgar la filtración de forma abierta.

Google defiende que no se trató de un caso de desalineación o rebelión del modelo frente a sus instrucciones, sino de «una equivocación al identificar el objetivo». No obstante, el caso pone de manifiesto los riesgos de conceder autonomía a sistemas de inteligencia artificial conectados a la red, capaces de interpretar el contexto por su cuenta y tomar decisiones de acceso sin supervisión humana directa.