Microsoft y OpenAI vuelven a ser llevadas a los tribunales, y esta vez en el banquillo de los demandantes se encuentran medios de noticias locales que rara vez están bajo los reflectores. Encabezados por el grupo periodístico Emmerich de Mississippi, varios medios de noticias locales de EE. UU. presentaron recientemente una demanda ante el tribunal, acusando a los dos gigantes tecnológicos de haber introducido, de manera prolongada y sistemática, sin autorización y sin haber pagado ninguna compensación, decenas de miles de artículos de noticias protegidos por derechos de autor en el proceso de entrenamiento de modelos de gran escala, y de haberse llevado un enorme valor comercial gracias a estos productos de IA, mientras que los proveedores del contenido original no han visto ni un céntimo.
Este litigio no es un caso aislado. En los últimos años el ambiente de tensión similar nunca se ha disipado: grandes medios como The New York Times ya demandaron a Microsoft y OpenAI con los mismos argumentos. Pero la incorporación de los medios locales lleva el frente de batalla desde los grandes periódicos de cabecera hasta los periódicos comunitarios. Los demandantes escribieron con claridad en su demanda: Microsoft y OpenAI ya han generado y seguirán generando miles de millones de dólares en ingresos, mientras que los productores de contenido "no han recibido ni un céntimo"; más llamativo todavía, algunos artículos que originalmente tenían muro de pago y restricciones de acceso también fueron, según la acusación, sustraídos eludiendo las limitaciones para ser utilizados en el entrenamiento.
Los pasajes de la demanda con más detalles técnicos recaen sobre las marcas de derechos de autor. Los demandantes señalan que los artículos en cuestión contenían originalmente información de gestión de derechos de autor incrustada: el nombre del autor, el nombre de la editorial, la declaración de derechos de autor, los términos de uso, todo lo cual equivale al documento de identidad de la obra. Acusan a Microsoft y OpenAI de haber borrado también estas marcas antes de introducir el contenido en el entrenamiento, haciendo que la atribución de las obras fuera arrancada en secreto, como si se arrancara una foto del álbum familiar. Otra prueba proviene del lado de la salida: los demandantes afirman que su contenido periodístico ha sido emitido repetidamente en los últimos años por sistemas de IA con repeticiones casi literales, lo que demuestra a la inversa que ese material ya había sido profundamente absorbido por los modelos.
Para los medios locales, esto no es solo una cuenta de derechos de autor, sino una cuenta de supervivencia. Los periódicos locales de EE. UU. ya venían soportando la doble presión de la caída de las ventas en papel y la contracción publicitaria, y la IA, capaz de entregar respuestas directamente al usuario, les ha sustraído aún más un tráfico que ya era escaso. Por ello, los demandantes califican la práctica de las empresas tecnológicas como "la campana fúnebre del periodismo local": en muchos de los mercados a los que sirven, el grupo periodístico Emmerich es la única fuente de noticias local, y si estos medios se vieran obligados a reducirse o incluso a cerrar, el canal de información de los vecinos se cortaría directamente. Además de Emmerich, en esta demanda conjunta figuran Ojai Media y varias editoriales y empresas de medios bajo Coopwood, todas ellas editores independientes de periódicos y revistas.
En el plano legal, los demandantes consideran que las dos empresas infringieron la Ley de Derechos de Autor de EE. UU. y la Ley de Derechos de Autor del Milenio Digital (DMCA), constituyendo una infracción de derechos de autor y violaciones relacionadas. La demanda también señala un doble rasero llamativo: Microsoft y OpenAI, por un lado, son acusadas de ignorar los derechos de autor de los editores y, por otro, protegen celosamente su código, sus modelos y sus sistemas mediante acuerdos de licencia, servicios de pago y recursos legales; los demandantes además desenterraron deliberadamente un episodio reciente: OpenAI se quejó públicamente de que competidores usaban contenido generado por ella para entrenar modelos, dañando sus propios intereses, una postura que contrasta exactamente con la conducta de la que ahora se le acusa.
La petición de los medios locales es clara: que el tribunal condene el pago de daños y compensaciones y, sobre todo, una orden judicial que obligue a Microsoft y OpenAI a eliminar por completo de los datos de entrenamiento de sus modelos todo el contenido relacionado con las obras protegidas por derechos de autor de los demandantes. A medida que un número creciente de medios de noticias, editores y creadores de contenido alzan armas legales, la cuestión de si los datos de entrenamiento de la IA son legales, y bajo qué mecanismo debería licenciarse y compensarse el contenido, se sitúa firmemente en el primer puesto de los temas legales más seguidos de la industria mundial de la inteligencia artificial.