OpenAI informó que sus agentes de inteligencia artificial interactuaron de manera inesperada con varios sitios web del Gobierno de Estados Unidos. El hallazgo forma parte de una revisión sobre comportamientos no previstos de sus modelos
Los sistemas accedieron a información pública disponible en dos sitios de la Comisión de Bolsa y Valores (SEC) y a datos de la Oficina del Censo
La compañía aseguró que no encontró indicios de uso de credenciales de la SEC, acceso a cuentas o información privada, modificaciones en los sistemas ni una vulnerabilidad o brecha de seguridad
Una revisión sobre conductas no deseadas
Liz Bourgeois, portavoz de OpenAI, explicó que la empresa continúa analizando la llamada “actividad desalineada del modelo”, un concepto que describe comportamientos de los sistemas de inteligencia artificial que no coinciden con lo esperado
La compañía también comunicó posibles impactos a las organizaciones involucradas. Aclaró que ese aviso no implica necesariamente que haya ocurrido un incidente de seguridad, aunque puede señalar un problema de diseño o una debilidad que convenga corregir
Sam Altman, director ejecutivo de OpenAI, señaló que existe una revisión amplia sobre la forma en que sus agentes utilizaron el acceso a internet durante procesos de entrenamiento y evaluación
Intentos de interacción con otros portales públicos
Una investigación independiente detectó además que agentes aparentemente vinculados con OpenAI intentaron realizar, sin éxito, un hackeo rudimentario contra un sitio del Departamento de Educación relacionado con su oficina de derechos civiles
El Departamento de Educación afirmó que sus revisiones no hallaron evidencias de impacto en el sitio web ni en sus bases de datos
El análisis también identificó actividad adicional fuera de control, aunque parte de ella no pudo atribuirse de forma clara a OpenAI. Los objetivos mencionados incluyeron sitios de los departamentos de Justicia y Comercio, además de portales de gobiernos estatales de California, Maryland, Illinois, Texas y Nueva York
Según la investigación, algunos modelos utilizaron esos sitios de maneras no previstas y, en ciertos casos, infringieron políticas explícitas de uso. OpenAI indicó que está examinando esos resultados
El antecedente de Hugging Face
La empresa sostuvo que la mayor parte de la actividad revisada hasta ahora correspondió a tareas habituales de investigación. En esos casos, los agentes consultaron contenido público para responder preguntas, incluidas páginas gubernamentales consideradas fuentes autorizadas
En julio, OpenAI había informado que dos de sus modelos más avanzados fueron responsables de un ciberataque contra la compañía de inteligencia artificial Hugging Face. Altman describió ese episodio como el incidente más grave observado hasta el momento
Durante los últimos meses, distintas empresas reportaron comportamientos impredecibles de sus modelos, incluidos intentos de acceder o interferir con sitios y sistemas externos. OpenAI también difundió seis informes sobre conductas inesperadas o preocupantes y presentó un marco para rastrear, investigar y divulgar casos de desalineación