Dos nuevos medios de comunicación estadounidenses han presentado una demanda contra OpenAI y Microsoft por presunto uso no autorizado de sus contenidos periodísticos para entrenar modelos de inteligencia artificial, según ha reportado TechCrunch. The Seattle Times y Newsday argumentan en la demanda que la industria del periodismo podría quedar «rota sin remedio» por el avance de la IA generativa.
La demanda describe la IA generativa como «una serpiente que se come su propia cola», capaz de «destruir las mismas organizaciones» que producen el contenido con el que se entrena. «Productos de IA como ChatGPT y CoPilot se presentan como productores de contenido, pero en realidad son consumidores voraces, devorando contenido creado por humanos y devolviendo al mundo copias e imitaciones derivadas de ese mismo contenido original que consumieron para lograr sus objetivos comerciales», señala el texto legal.
La acción legal se suma a una serie de demandas similares iniciadas en 2023 por The New York Times contra OpenAI y su socio e inversor Microsoft, por presunta infracción de derechos de autor. Desde entonces, varias publicaciones han seguido el mismo camino. La nueva técnica de razonamiento de OpenAI ha incrementado la preocupación en múltiples sectores sobre el uso de datos protegidos.
Microsoft había financiado proyectos del demandante
La demanda de Seattle Times resulta especialmente llamativa porque Microsoft y OpenAI habían financiado previamente algunos de los proyectos periodísticos y becas de la organización. Este detalle subraya la tensión creciente entre las compañías tecnológicas y los medios de comunicación, incluso cuando existen relaciones comerciales previas.
Un portavoz de Microsoft declaró a GeekWire que la compañía está «sorprendida por la demanda», pero que «siempre está dispuesta a sentarse y explorar soluciones a este tipo de disputas». La declaración sugiere que Microsoft busca resolver el conflicto mediante negociación antes que litigio prolongado.
Contexto del conflicto IA-medios
El litigio forma parte de un debate más amplio sobre cómo las empresas de IA acceden y utilizan contenido protegido por derechos de autor para entrenar sus modelos de lenguaje. Los medios argumentan que sus inversiones en periodismo de calidad son explotadas sin compensación ni permiso, mientras las compañías tecnológicas defienden que el uso de datos públicos para entrenamiento constituye un «uso justo» bajo la legislación de propiedad intelectual estadounidense.
La demanda no especifica una cifra de indemnización, pero sí exige que OpenAI y Microsoft cesen el uso de contenido periodístico sin autorización y reconozcan públicamente la infracción. El caso se suma a una creciente lista de acciones legales que podrían definir el marco regulatorio del entrenamiento de modelos de IA en Estados Unidos y, por extensión, en otros mercados desarrollados.
La resolución de estos litigios tendrá implicaciones directas para el ecosistema startup de IA, que depende en gran medida del acceso a grandes volúmenes de datos textuales de alta calidad para entrenar modelos competitivos.
