M
mwns
Nowy użytkownik
- Dołączył
- 04.2017
- Odpowiedzi
- 6
Jestem zainteresowany tematyką zbierania i analizowania danych z różnych źródeł w sieci, mam technologiczne przygotowanie do realizacji tego typu projektów i chciałbym ruszyć w niedalekiej przyszłości z własnym serwisem. To, czego mi brakuje to ugruntuowana wiedza na temat legalności przeprowadzania wspomnianego procesu gromadzenia i przetwarzania danych pobieranych z innych źródeł, z tego też powodu sporo czasu poświęciłem na zapoznanie się z tematyką ochrony baz danych, legalności scrapingu oraz crawlingu, a także praw autorskich. Stworzenie tego typu projektu wymaga ogromnych nakładów wolnego czasu, stąd przed startem chciałbym maksymalnie dobrze przygotować prawny grunt, działając cały czas legalnie.
W pierwszej kolejności natrafiłem na ten artykuł, który mnie szczególnie zaciekawił oraz zaskoczył:
Zgodnie z informacjami tam uzyskanymi sam crawling/scraping nie jest nielegalny, a niektóre z typów baz danych w ogóle nie są objęte ochroną prawną:
I tutaj pierwsze pytanie - czy to prawda? Czy można bez ograniczeń przeprowadzać scraping dowolnych serwisów udostępniających zestawienia "nieunikalne" (wyniki piłkarskie, tabele, fakty historyczne, aktualne teperatury etc.) i takowe dane gromadzić w pełni legalnie we własnej bazie danych? Nawet jeśli regulaminie takowego serwisu znajduje się zastrzerzenie dotyczące braku możliwości użycia crawlerów/scraperów? Nawet jeśli baza danych spełnia poniższe warunki?
Kolejny fragment ze wspomnianego artykułu:
Czy wszelkie fakty prawne, matematyczne, sportowe, historyczne etc. nie są w ogóle objęte wspomnianą opieką prawną? Trudno mi w to uwierzyć, stąd będę wdzięczny za wszelkie informacje w tym temacie. Druga kwestia to ten fragment ustawy o ochronie baz danych:
Czy zgodnie z tym zapisem nie ma przeciwskazań do pobierania i gromadzenia we własnej bazie (wraz z późniejszym analizowaniem i udostępnianiem we własnym serwisie wyników tej analizy) wszelkich FAKTÓW (żadnej unikalnej treści typu jakiekolwiek artykuły) w NIEWIELKIM PROCENCIE w stosunku całości bazy danych każdego źródła, za pomocą web scrapera jest w pełni legalnym procesem? Oczywiście przy założeniu, że każde z tego typu pobrań dokumentuję i mój projekt zawiera pełną historię w kontekście skąd i kiedy pobrałem ów fakty (tj. mogę udowodnić, że pobrałem ogółem niewielki danych udostępnianych przez serwis).
I ostatnia sprawa - czy web scraper służący do pobierania treści strony TYLKO I WYŁĄCZNIE w celu weryfikowania poprawności zgromadzonych przeze mnie danych w sposób niepodlegający dyskusji (np. wprowadzonych przeze mnie ręcznie poprzez panel administratora) jest również w pełni legalnym rozwiązaniem? Z góry dziękuję za poświęcony mi czas - jestem gotowy realizować projekt poprzez bardziej czasochłonną opcję, ale chciałbym mieć wypracowaną legalną ścieżkę jego realizacji. Sam proces przetwarzania zasobów internetu jest tematem mocno przyszłościowym, problem leży właśnie w ustaleniu konkretnych ram legalności tego procesu.
W pierwszej kolejności natrafiłem na ten artykuł, który mnie szczególnie zaciekawił oraz zaskoczył:
Zgodnie z informacjami tam uzyskanymi sam crawling/scraping nie jest nielegalny, a niektóre z typów baz danych w ogóle nie są objęte ochroną prawną:
W świetle przepisów unijnych, a w ślad za nimi – i naszych, bazy danych można podzielić na:
1. bazy danych, które w ogóle nie podlegają ochronie prawnej (np. zawierające zestawienia wyników meczów piłkarskich);
I tutaj pierwsze pytanie - czy to prawda? Czy można bez ograniczeń przeprowadzać scraping dowolnych serwisów udostępniających zestawienia "nieunikalne" (wyniki piłkarskie, tabele, fakty historyczne, aktualne teperatury etc.) i takowe dane gromadzić w pełni legalnie we własnej bazie danych? Nawet jeśli regulaminie takowego serwisu znajduje się zastrzerzenie dotyczące braku możliwości użycia crawlerów/scraperów? Nawet jeśli baza danych spełnia poniższe warunki?
wymagający istotnego, co do jakości lub ilości, nakładu inwestycyjnego
w celu sporządzenia, weryfikacji lub prezentacji jego zawartości
Kolejny fragment ze wspomnianego artykułu:
Zatem treści nie chronione (głównie prawem autorskim czy w związku z ochroną danych osobowych) mogą być w zasadzie wykorzystywane swobodnie. Nic nie chroni bowiem wspomnianych bowiem wyników meczów, czy informacji o wysokości temperatur
Czy wszelkie fakty prawne, matematyczne, sportowe, historyczne etc. nie są w ogóle objęte wspomnianą opieką prawną? Trudno mi w to uwierzyć, stąd będę wdzięczny za wszelkie informacje w tym temacie. Druga kwestia to ten fragment ustawy o ochronie baz danych:
Art. 7.
2. Producent bazy danych udostępnionej publicznie w jakikolwiek
sposób nie może zabronić użytkownikowi korzystającemu zgodnie z prawem z takiej
bazy danych, pobierania lub wtórnego wykorzystania w jakimkolwiek celu
nieistotnej, co do jakości lub ilości, części jej zawartości
Czy zgodnie z tym zapisem nie ma przeciwskazań do pobierania i gromadzenia we własnej bazie (wraz z późniejszym analizowaniem i udostępnianiem we własnym serwisie wyników tej analizy) wszelkich FAKTÓW (żadnej unikalnej treści typu jakiekolwiek artykuły) w NIEWIELKIM PROCENCIE w stosunku całości bazy danych każdego źródła, za pomocą web scrapera jest w pełni legalnym procesem? Oczywiście przy założeniu, że każde z tego typu pobrań dokumentuję i mój projekt zawiera pełną historię w kontekście skąd i kiedy pobrałem ów fakty (tj. mogę udowodnić, że pobrałem ogółem niewielki danych udostępnianych przez serwis).
I ostatnia sprawa - czy web scraper służący do pobierania treści strony TYLKO I WYŁĄCZNIE w celu weryfikowania poprawności zgromadzonych przeze mnie danych w sposób niepodlegający dyskusji (np. wprowadzonych przeze mnie ręcznie poprzez panel administratora) jest również w pełni legalnym rozwiązaniem? Z góry dziękuję za poświęcony mi czas - jestem gotowy realizować projekt poprzez bardziej czasochłonną opcję, ale chciałbym mieć wypracowaną legalną ścieżkę jego realizacji. Sam proces przetwarzania zasobów internetu jest tematem mocno przyszłościowym, problem leży właśnie w ustaleniu konkretnych ram legalności tego procesu.
Ostatnia edycja: