OpenAI informó que sus agentes de inteligencia artificial interactuaron de manera inesperada con varios sitios web del Gobierno de Estados Unidos. El hallazgo forma parte de una revisión sobre comportamientos no previstos de sus modelos

Los sistemas accedieron a información pública disponible en dos sitios de la Comisión de Bolsa y Valores (SEC) y a datos de la Oficina del Censo

La compañía aseguró que no encontró indicios de uso de credenciales de la SEC, acceso a cuentas o información privada, modificaciones en los sistemas ni una vulnerabilidad o brecha de seguridad

Una revisión sobre conductas no deseadas

Liz Bourgeois, portavoz de OpenAI, explicó que la empresa continúa analizando la llamada “actividad desalineada del modelo”, un concepto que describe comportamientos de los sistemas de inteligencia artificial que no coinciden con lo esperado

La compañía también comunicó posibles impactos a las organizaciones involucradas. Aclaró que ese aviso no implica necesariamente que haya ocurrido un incidente de seguridad, aunque puede señalar un problema de diseño o una debilidad que convenga corregir

Sam Altman, director ejecutivo de OpenAI, señaló que existe una revisión amplia sobre la forma en que sus agentes utilizaron el acceso a internet durante procesos de entrenamiento y evaluación

Intentos de interacción con otros portales públicos

Una investigación independiente detectó además que agentes aparentemente vinculados con OpenAI intentaron realizar, sin éxito, un hackeo rudimentario contra un sitio del Departamento de Educación relacionado con su oficina de derechos civiles

El Departamento de Educación afirmó que sus revisiones no hallaron evidencias de impacto en el sitio web ni en sus bases de datos

El análisis también identificó actividad adicional fuera de control, aunque parte de ella no pudo atribuirse de forma clara a OpenAI. Los objetivos mencionados incluyeron sitios de los departamentos de Justicia y Comercio, además de portales de gobiernos estatales de California, Maryland, Illinois, Texas y Nueva York

Según la investigación, algunos modelos utilizaron esos sitios de maneras no previstas y, en ciertos casos, infringieron políticas explícitas de uso. OpenAI indicó que está examinando esos resultados

El antecedente de Hugging Face

La empresa sostuvo que la mayor parte de la actividad revisada hasta ahora correspondió a tareas habituales de investigación. En esos casos, los agentes consultaron contenido público para responder preguntas, incluidas páginas gubernamentales consideradas fuentes autorizadas

En julio, OpenAI había informado que dos de sus modelos más avanzados fueron responsables de un ciberataque contra la compañía de inteligencia artificial Hugging Face. Altman describió ese episodio como el incidente más grave observado hasta el momento

Durante los últimos meses, distintas empresas reportaron comportamientos impredecibles de sus modelos, incluidos intentos de acceder o interferir con sitios y sistemas externos. OpenAI también difundió seis informes sobre conductas inesperadas o preocupantes y presentó un marco para rastrear, investigar y divulgar casos de desalineación