Lucrezia Berto y Marcelo Estrella, departamento de IP-IT y nuevas tecnologías.
¿Qué significa hacer “web scraping”? Se trata de una serie de técnicas dirigidas a obtener información de páginas web de forma automatizada, a través de software, comúnmente definidos como bots, que simulan la navegación de usuarios reales. La información así obtenida puede ser procesada y usada para fines diversos. Una gran cantidad de entidades usan datos extraídos de páginas webs de terceros a través de scraping para sus propios fines, y otras incluso basan su propuesta de valor en aquellos datos y otra información así obtenida.
Pero ¿es legal? ¿se puede efectuar siempre el web scraping? ¿Y se pueden usar siempre los datos obtenidos a través de esa técnica? El hecho de que las páginas webs y sus contenidos se encuentren publicados en Internet y disponibles para cualquier usuario de la red no significa que no estén protegidos y que sean de dominio público. Asimismo, a la hora de determinar la legalidad de la extracción de la información y su posterior uso, es necesario tener en cuenta una serie de riesgos que surgen a la luz de la normativa europea y, en particular, la española.
Los riesgos
El primer riesgo que estas técnicas pueden conllevar es la infracción de derechos de propiedad intelectual de los titulares o licenciantes de las páginas webs de las que se extraen los datos. En particular, en el caso de que la estructura de los datos contenidos en estas páginas webs reúna los requisitos para ser considerada una “base de datos”, según la definición del Real Decreto Legislativo 1/1996, de 12 de abril, por el que se aprueba el texto refundido de la Ley de Propiedad Intelectual (en adelante TRLPI), se podría incurrir en una vulneración de los derechos de autor y/o del derecho sui generis sobre dicha base de datos[1]. Cabe destacar que no todos los sitios web y su contenido reúnen los requisitos para obtener la protección prevista por el TRLPI para las “base de datos”, pudiendo faltar de originalidad y/o de la inversión para la obtención, verificación o presentación de su contenido, como han afirmado los jueces en el caso conocido como Ryanair vs Atrápalo[2].
Otro riesgo que hay que tener en cuenta es la violación de los términos legales de la web objeto de scraping, que suelen estar incluidos en el “aviso legal” o en los “términos y condiciones”. Asimismo, pese a la eventual protección otorgada por la TRLPI al contenido de las páginas web, los titulares pueden prohibir o limitar el scraping contractualmente.
Además, hay casos en los que los titulares de las páginas web publican el contenido de las mismas con licencias que no necesitan la aceptación expresa de quien acceda o use el contenido para ser vinculantes. Este es el caso de las licencias de contenido abierto, tales como las licencias Creative Commons, o las licencias abiertas sobre bases de datos. Dichas licencias pueden limitar el uso del contenido, excluyendo, por ejemplo, el uso para fines comerciales, o pueden obligar quien quiera publicar los datos recogidos a través de scraping a hacerlo solamente de manera abierta. Por ello, el uso o la publicación de los datos de manera contraria a lo previsto por estas licencias provocaría una infracción de las licencias sobre el contenido o las bases de datos objeto de scraping.
En caso de que los datos que se extraen sean datos personales, estas actividades podrían dar lugar a una vulneración de la normativa de protección de datos personales, el Reglamento General de Protección de Datos y la Ley Orgánica de Protección de Datos y Garantías de Derechos Digitales. Es relevante considerar aquí, que todo tratamiento de datos personales debe contar con una base legal apropiada, y todas las personas cuyos datos personales son tratados (los “Interesados”) deben ser debidamente informadas de, entre otras cosas, las finalidades del tratamiento y quien es la entidad responsable. No contar con el requisito de la base legal, así como la falta de informar a los Interesados, genera un incumplimiento y queda sujeto a infracción por parte de la correspondiente entidad de control competente.
Finalmente, en caso de que se efectúe web scraping sobre páginas web que prestan servicios similares a aquellos de la empresa que extrae los datos, esto puede tener la consideración de una conducta de competencia desleal.
Conclusiones
Con motivo de mitigar los riesgos que el web scraping acarrea, y poder llevar adelante estas técnicas en un entorno que genere una mayor certeza y seguridad jurídica, se recomienda un análisis previo caso por caso a los fines de determinar los riesgos específicos del scraping según el área, el tipo de datos y las características de las páginas webs, entre otras variables.
Además del fundamental análisis previo, existen buenas prácticas que reducen los riesgos derivados de estas técnicas, como, por ejemplo, no evadir los captchas y no hacer extracción cuando la web haya negado el acceso de manera explícita. Desde Across Legal podemos brindar el asesoramiento legal necesario y adecuado para poder valerse del web scraping y aportar valor a su proyecto o su empresa. Contamos con el expertise necesario y la trayectoria que nos avala.
DISCLAIMER
La información contenida en el presente documento es a los meros fines informativos y no debe considerarse asesoramiento legal. No se forma una relación de abogado-cliente con Across Legal hasta que las partes firmen un acuerdo de servicios legales.
[1] El del Real Decreto Legislativo 1/1996 prevé unos requisitos que la base de datos tiene que reunir para obtener protección a través de derechos de autor y/o derecho sui generis. Por ello, solamente si la base de datos objeto de web scraping los reúne, puede haber una infracción de estos.
[2] STS 572/2012, 9 de Octubre de 2012




