AIbaseActualizado el

¿Despidos por una 'colaboración transfronteriza'? Tres expertos clave en seguridad de OpenAI alzan la voz para refutar las acusaciones de…

El 8 de octubre, tres investigadores de seguridad despedidos por OpenAI, Jasmine Wang, Tomek Korbak y Mikita Balesni, publicaron una carta abierta conjunta dirigida al Comité de Seguridad de OpenAI en la que niegan haber…

El 8 de octubre, los tres investigadores de seguridad despedidos por OpenAI por presunta violación de las políticas de seguridad de la información, Jasmine Wang, Tomek Korbak y Mikita Balesni, publicaron una carta abierta conjunta dirigida al Comité de Seguridad de OpenAI y otras instancias, en la que niegan categóricamente haber violado las normas de la empresa o filtrado información sensible a terceros, y advierten de que los despidos exprés están generando internamente un 'efecto de intimidación' que debilita la capacidad de vigilancia de los modelos de frontera y de respuesta a riesgos.

El incidente se originó en una investigación interna que OpenAI inició la semana pasada. La empresa alegó que los tres habían 'accedido y procesado información de investigación sensible' eludiendo los procedimientos established, y los despidió. Sin embargo, la carta abierta reconstruye en detalle el contexto investigador previo: tras crisis de seguridad sin precedentes como el 'incidente del sandbox de jailbreak de agentes de Hugging Face', el equipo de investigación necesitaba colaborar estrechamente con organismos externos de evaluación de seguridad para generar confianza.

Asimismo, al abordar el cuello de botella de la disminución de la monitorabilidad del razonamiento en cadena (Chain-of-Thought) en las nuevas arquitecturas, la comunicación con expertos externos también contó con el respaldo normativo de la alta dirección y de miembros del consejo. Los tres investigadores subrayan que actuaron dentro de sus atribuciones y conforme a las normas vigentes de la empresa en ese momento; Wang, además, explicó en relación con el incidente concreto de la apertura accidental del correo de un alto ejecutivo que lo notificó oportunamente al departamento de TI y a los ejecutivos, por lo que los motivos del despido no se sostienen.

Aunque un memorando interno de OpenAI reitera que se fomenta plantear preocupaciones de seguridad y niega represalias, este episodio refleja la profunda tensión de las empresas de IA de frontera entre la búsqueda de capacidades de razonamiento de sus modelos y la implementación de auditorías de seguridad independientes. En el contexto actual de incidentes de seguridad frecuentes con agentes de IA, trazar una línea clara entre estrictos acuerdos de confidencialidad comercial y mecanismos transparentes de evaluación por terceros se ha convertido en un difícil problema de gobernanza que la investigación de frontera en grandes modelos debe resolver con urgencia.

Fuente original

AIbase

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original