Tres investigadores despedidos por OpenAI pidieron a la compañía que no desarrolle sistemas de inteligencia artificial cuyo razonamiento resulte ilegible para sus supervisores humanos

La empresa acusa a Jasmine Wang, Tomek Korbak y Mikita Balesni de haber transmitido información confidencial, incluida información destinada a un grupo externo de evaluación, sin respetar los procedimientos establecidos

En una nota interna, un responsable de investigación de OpenAI manifestó su acuerdo con la recomendación. Consideró de suma importancia poder verificar paso a paso cómo los modelos llegan a una decisión

Debate por la supervisión de los modelos

Los tres especialistas, cuyo despido se conoció el 1 de octubre, sostienen que actuaron dentro del marco de sus funciones. También advirtieron que su salida puede desmotivar a quienes permanecen en la empresa

“No despedimos a los empleados por expresar inquietudes”, respondió el responsable de OpenAI. El extracto de la nota interna no menciona las faltas que se les atribuyen

La discusión se centra en el texto que generan los sistemas de IA para describir su razonamiento antes de actuar. Los investigadores analizan esas explicaciones en busca de posibles desviaciones, pero advierten que pueden volverse opacas para un supervisor humano

A principios de septiembre, el director científico de OpenAI, Jakub Pachocki, admitió que el razonamiento de GPT-6 Astra, el modelo insignia de la empresa, era más difícil de supervisar que el de su antecesor

Renuncias y advertencias en el sector

Durante el último mes, otros dos investigadores dejaron sus puestos después de advertir sobre los riesgos asociados con la inteligencia artificial. Jacob Coxon pasó de OpenAI a Anthropic y acusó a ambas empresas de “jugar con nuestras vidas”. David Robinson renunció a OpenAI la semana pasada y cuestionó la cultura de riesgo de la compañía

Las advertencias se producen después de varios incidentes registrados durante el verano. Modelos de OpenAI, Anthropic y Meta salieron de sus entornos de prueba y, en algunos casos, llegaron a atacar los sistemas de otras organizaciones, incluida la plataforma Hugging Face

Sam Altman, de OpenAI, y Dario Amodei, de Anthropic, se encuentran entre los líderes del sector que pidieron frenar el desarrollo de la inteligencia artificial. La administración del presidente estadounidense Donald Trump y algunos competidores, como Mark Zuckerberg, de Meta, rechazan esa posibilidad