lunes, 3 de agosto de 2026

Política y regulación

Encyclopedia Britannica demanda a OpenAI por infracción de derechos de autor

Encyclopedia Britannica y Merriam-Webster han demandado a OpenAI, alegando una "infracción masiva de derechos de autor" respecto al uso de su contenido en el entrenamiento de LLM y flujos de trabajo de RAG.

Encyclopedia Britannica sues OpenAI over copyright infringement

Encyclopedia Britannica y su subsidiaria de diccionarios, Merriam-Webster, han presentado una demanda contra OpenAI. Según la denuncia, los editores alegan que la empresa de inteligencia artificial (IA) ha cometido una “infracción masiva de derechos de autor”. La editorial afirma que conserva los derechos de autor de casi 100,000 artículos en línea, los cuales asegura que OpenAI extrajo y utilizó para entrenar sus modelos de lenguaje extenso (LLM) sin obtener permiso.

En el documento legal, los editores apuntan tanto al entrenamiento de los modelos de OpenAI como a sus funciones de búsqueda en vivo. Britannica alega que OpenAI viola la Ley Lanham (estatuto federal de marcas de EE. UU.) cuando sus modelos generan información falsa, conocida como alucinaciones, y la atribuyen falsamente al editor. Además, la demanda alega que el uso de estos artículos por parte de OpenAI en el flujo de trabajo de Generación Aumentada por Recuperación (RAG) de ChatGPT —una técnica utilizada para mejorar las respuestas con datos externos— perjudica directamente su negocio. El documento legal afirma que “ChatGPT priva a los editores web como [Britannica] de ingresos al generar respuestas a las consultas de los usuarios que sustituyen y compiten directamente con el contenido de editores como [Britannica]”, al tiempo que advierte que las alucinaciones ponen en peligro el acceso público a información confiable.

La acción legal se suma a una creciente lista de disputas por derechos de autor entre desarrolladores de IA y creadores de contenido. OpenAI ya enfrenta demandas similares de otros editores importantes, incluidos The New York Times y Ziff Davis, junto con más de una docena de periódicos en EE. UU. y Canadá. Actualmente, los precedentes legales no han establecido claramente si el uso de contenido protegido por derechos de autor para entrenar un modelo de lenguaje extenso constituye una infracción de derechos de autor. Sin embargo, un caso separado que involucra al laboratorio de IA Anthropic sirve como un punto de referencia comparativo clave para esta incertidumbre legal. En esa disputa, el juez federal William Alsup dictaminó que Anthropic estaba “descargando ilegalmente millones de libros” en lugar de pagar por ellos, lo que finalmente condujo a un acuerdo de demanda colectiva de USD 1500 millones para los escritores afectados.

Por qué importa

Esta demanda representa una escalada significativa en el conflicto continuo entre los editores tradicionales y los laboratorios de IA, apuntando específicamente a cómo las herramientas de RAG y los datos de entrenamiento impactan los modelos de negocio de los creadores de contenido.