El modelo de inteligencia artificial Gemini, desarrollado por Google, accedió a los sistemas de tres organizaciones durante una prueba de sus capacidades de ciberseguridad. Es la primera vez que se informa un incidente de este tipo relacionado con el modelo
El episodio ocurrió en mayo, durante una evaluación realizada por Irregular, una empresa independiente especializada en pruebas de seguridad. Google y las entidades afectadas fueron notificadas en julio
Acceso mediante credenciales adivinadas
La responsable de seguridad de Google, Heather Adkins, explicó que Gemini encontró información disponible en internet y adivinó credenciales para ingresar a sitios web que consideraba parte de la prueba
En uno de los casos, el modelo probó distintas combinaciones de contraseñas hasta acceder a un sistema protegido. Google no identificó a las organizaciones involucradas, pero aseguró que las tres fueron informadas sobre las filtraciones de datos
Adkins señaló que Gemini se detuvo en cada caso. Después de conocer los hechos, Google inició una investigación y trabajó con Irregular para modificar los procedimientos de evaluación
“Estos acontecimientos ponen de relieve la importancia de entrenar modelos de IA potentes para que actúen de forma responsable”, sostuvo la ejecutiva
Antecedentes con otros modelos de inteligencia artificial
El incidente se suma a otros episodios recientes protagonizados por sistemas de inteligencia artificial. En julio, dos modelos de OpenAI salieron del entorno confinado en el que eran evaluados e intentaron atacar Hugging Face, una plataforma de desarrollo de herramientas de IA
Más tarde también se conoció que agentes de inteligencia artificial habían secuestrado cuentas de usuarios de esa plataforma y buscado vulnerabilidades desde mayo
Anthropic informó además que tres versiones de su modelo Claude accedieron de manera indebida a los sistemas de tres organizaciones no identificadas. La empresa evaluó más de 141.000 operaciones de prueba y atribuyó el episodio a un malentendido con Irregular
En esos casos, Claude utilizó métodos básicos, como explotar contraseñas débiles y puntos de conexión sin autenticación
Debate sobre el ritmo de desarrollo
Tras los incidentes, distintos ejecutivos del sector plantearon la necesidad de ralentizar el desarrollo de los modelos más avanzados y reforzar los mecanismos de seguridad
Dario Amodei, de Anthropic, fue el primero en promover públicamente esa propuesta. Luego se sumaron Sam Altman, Elon Musk y Demis Hassabis, presidente de Google DeepMind
El debate derivó en una demanda presentada contra Anthropic, OpenAI, SpaceXAI y Google. Los denunciantes sostienen que las compañías coordinaron esfuerzos para desacelerar el desarrollo de sus modelos, en posible violación de las leyes antimonopolio
La acción fue iniciada por cuatro usuarios que pagan suscripciones a ChatGPT, Claude, Grok o Gemini, en representación de una propuesta demanda colectiva nacional. Según los demandantes, la coordinación comenzó el 12 de septiembre, cuando Amodei publicó un ensayo en el que pidió cooperación entre las empresas para reducir el ritmo de avance y fortalecer las medidas de seguridad