El gobierno español ha publicado el nuevo proyecto de Real Decreto que propone regular las “licencias colectivas ampliadas” para la explotación masiva de obras protegidas por derechos de autor en el desarrollo de inteligencia artificial (IA) de propósito general. Estos modelos de IA (Large Language Models, en particular) se entrenan sobre grandes cantidades de datos, y en muchas ocasiones estos datos son textos, imágenes, canciones y otras obras protegidas por derechos de autor. Actualmente, en Estados Unidos y ahora en la UE, existen varios juicios de titulares de derechos contra los fabricantes de modelos LLM por el uso de sus obras en el entrenamiento de estos modelos.
¿Cuál es el objetivo del Proyecto de Ley?
El objetivo del Proyecto es abordar los retos que plantea la obtención de los derechos de autor necesarios (la reproducción) de numerosos titulares de todas estas obras para el entrenamiento de modelos de IA. Puesto que, obtener autorizaciones individuales de todos los titulares de derechos es a menudo poco práctico y prohibitivamente caro.
El Proyecto propone utilizar, como desarrollo del Artículo 163 de la Ley de Propiedad Intelectual, las “licencias colectivas ampliadas”, un mecanismo ya establecido en la Directiva (UE) 2019/790 de la UE sobre el mercado único digital (DEMUD), para permitir que las organizaciones de gestión colectiva (EE.GG.) otorguen licencias en nombre de todos los titulares de derechos, incluso sin su consentimiento individual, bajo condiciones específicas.
Esta regulación intenta garantizar un trato justo para todos los titulares de derechos de obras utilizadas en el entrenamiento, y proporcionar un mecanismo de exclusión voluntaria e implementar procesos transparentes. El Proyecto también especifica los requisitos para obtener un certificado de representatividad (de la EEGG) y las obligaciones tanto de las organizaciones de gestión colectiva como de los desarrolladores de AI.
Equilibrio entre derechos e innovación
La normativa propuesta reconoce el potencial de innovación de los modelos de IA, pero también los retos que plantean frente a los derechos de los creadores de obras. Actualmente, hay varios mecanismos que permiten a un fabricante de un modelo de IA utilizar obras de terceros, entre otros:
· Las excepciones de la propia DEMUD para “Text and Data Mining” (Artículo 3 para la investigación científica, y Artículo 4 para el uso general) y las correspondientes transposiciones nacionales;
· Así como los contenidos y datos publicados bajo licencias “abiertas” como Creative Commons u Open Database License,
· Y el acceso a datos del sector público.
Esta excepción del Artículo 4 (para TDM realizado por la industria) está sujeta a una reserva de derechos del titular de las obras minadas en publicaciones en internet, es decir que el titular de la obra puede prohibir el TDM sobre su página web o publicación (Sin embargo, podrá ser considerada legalmente válida si la reserva es “eficaz”…, como sugieren los tribunales de Alemania alegando que una prohibición en las condiciones legales sería suficiente, ya que los agentes de IA (i.e. ChatGPT) puede leer y entender textos).
Lo que propone el gobierno español (y las EEGG) es establecer un mecanismo de licenciamiento para que los fabricantes de IA puedan obtener los derechos necesarios sobre obras protegidas disponibles en Internet, cuando estos derechos están reservados, y para obras que no están puestas a disposición del público como los libros, revistas, música y películas en CD y DVD, y otras obras en colecciones privadas. Las “licencias colectivas ampliadas” permitirán a las EEGG conceder licencias no exclusivas para el uso “masivo” de estas obras protegidas por derechos de autor en el desarrollo de IA, incluso si no todos los titulares de derechos han autorizado explícitamente a la organización a hacerlo.
Derechos de los titulares de obras
El Proyecto reconoce que algunos titulares de derechos pueden oponerse a que sus obras se utilicen para el desarrollo de la IA y estos titulares pueden retirarse de este sistema (opt out) y no permitir que las EEGG licencien sus derechos de esta manera. Proporciona un mecanismo alegadamente “claro” de exclusión voluntaria para que los titulares de derechos excluyan sus obras del sistema ampliado de concesión de licencias colectivas. Esto les permite mantener el control sobre el uso de sus obras, con el fin de prohibir totalmente su uso para el entrenamiento de IA o por el contrario, para permitirlo bajo licencias abiertos de tipo Creative Commons sin tener que pagar regalías o tasas.
Aquellos titulares de derechos que no sean miembros de las EEGG también pueden dirigirse a las mismas para solicitar el pago de sus regalías recaudadas mediante estas licencias. Asimismo, el Proyecto incluye medidas de transparencia para garantizar que los titulares de derechos estén informados sobre el régimen de licencias. Las EEGG deben tomar las medidas adecuadas para dar a conocer las condiciones de las licencias, incluidos el alcance, la duración y los procedimientos de reparto de ingresos y de exclusión voluntaria.
Por otro lado, el Proyecto también impone obligaciones a los desarrolladores de IA. Los que obtengan licencias a través de este sistema deben respetar las opciones de exclusión de los titulares de derechos y garantizar que no se utilicen las obras excluidas, además remarcar que la duración de esta licencia es de 3 años.
Comentamos…
El gobierno argumenta que la opción de las licencias colectivas ampliadas para el desarrollo de la IA se presenta como la solución óptima para abordar los retos de la concesión de licencias de obras protegidas por derechos de autor para este fin, minimizando al mismo tiempo las cargas administrativas y garantizando la claridad jurídica.
No obstante, si bien ofrece un mecanismo de acceso y uso de obras de terceros, lo que hace es invertir el beneficio de acceso a obras publicadas en internet para TDM (acceso legítimo en muchos casos, según la DEMUD) – un equilibrio buscado con muchas dificultades en 2019 por la DEMUD – para que el valor por defecto pasa de ser “usar las obras disponibles salvo que el titular de derechos haya expresamente puesto una limitación” (a favor de la innovación basada en obras expuestas al público) a “ante todo, conseguir una licencia, salvo que un autor se haya excluido del sistema de licencia ampliada”.
¡Imaginad la complicación para todos los autores de obras bajo Creative Commons (más de 2,5 mil millones en Internet) para excluirse de esta lógica de licencias ampliadas por defecto!
Asimismo, las EEGG están principalmente obligadas a establecer tarifas por el uso efectivo, y deberán justificar el establecimiento del precio de estas licencias de uso de las obras como datos de entrenamiento (para un entrenamiento de IA… ¿una imagen vale más que un texto o artículo? ¿Una canción? Y ¿para qué tipo de IA para qué usos?).
Finalmente, el Proyecto pretende crear un marco que fomente la innovación en IA al tiempo que salvaguarde los intereses de los creadores. Argumenta que, para ello, simplifica el proceso de concesión de licencias para el uso masivo de datos en el desarrollo de la IA, garantizando una remuneración equitativa para los titulares de derechos y proporcionando un mecanismo claro para quienes deseen optar por no participar. Al equilibrar estos intereses contrapuestos, el Proyecto de Decreto pretende promover un ecosistema de IA próspero respetando al mismo tiempo los derechos fundamentales de los creadores. Pero también podrá tener el efecto de motivar a los fabricantes de IA a migrar hacía países en los que el acceso a obras para entrenar IA es más favorable, como el Japón o potencialmente – lo veremos después de los juicios actuales –en Estados Unidos.
En Across Legal, ya estamos asesorando varios proyectos empresariales y de investigación científica sobre el uso de los datos para el entrenamiento de IA, el impacto de las licencias abiertas y la negociación de licencias de acceso a datasets específicos. Si querréis saber más, dirigidos a nuestro Departamento de IT e IP. Asimismo, recomendamos leer comentarios de nuestros compañeros de Alicante en el blog Lucentinvs, entre otros. For further insights, contact our IT and IP Department. Additionally, we recommend reading our colleagues’ commentary on the Lucentinvs blog, among others.




