Ochrona serwisów przed botami AI: jak działa system Anubis
Administrator Infokatowice.pl wdrożył system Anubis chroniący przed zautomatyzowanym skrobaniem danych. Poznaj mechanizm obrony i przyszłe rozwiązania.
Coraz więcej serwisów internetowych musi radzić sobie z masowym pobieraniem treści przez zautomatyzowane narzędzia. Właśnie z tego powodu administrator serwisu Infokatowice.pl zdecydował się na wdrożenie systemu Anubis — rozwiązania zaprojektowanego do utrudniania tego rodzaju działalności.
Czym jest system Anubis i jak działa?
System Anubis to mechanizm obronny oparty na schemacie Proof-of-Work, który wzorowany jest na starszym rozwiązaniu o nazwie Hashcash. Zamiast tradycyjnych captch czy ograniczeń dostępu, Anubis wymaga od odwiedzającego wykonania pewnego obliczeniowego zadania — procesu, który jest łatwy dla zwykłego użytkownika, ale stanowi znaczną przeszkodę dla botów działających na dużą skalę.
Mechanizm ten działa w oparciu o nowoczesne funkcje JavaScript. To oznacza, że przeglądarki internetowe odwiedzających muszą obsługiwać zaawansowane skrypty, aby system mógł działać prawidłowo. Dla większości użytkowników przychodzących na stronę naturalnie jest to przejrzyste — proces zachodzi w tle, bez widocznego wpływu na doświadczenie przeglądania.
Jak Anubis utrudnia pracę skraperów?
Boty zajmujące się masowym pobieraniem danych działają najczęściej poprzez wysyłanie setek lub tysięcy żądań do serwera w krótkim czasie. System Anubis wprowadza barierę obliczeniową — każde żądanie musi być poprzedzone rozwiązaniem zadania matematycznego, które wymaga zasobów obliczeniowych. Dla pojedynczego użytkownika to nieznaczny koszt, ale dla bota próbującego pobrać miliony stron koszt ten staje się prohibicyjny.
Rozwiązanie opiera się na założeniu, że większość atakujących nie będzie chciała inwestować w tyle mocy obliczeniowej, ile byłoby potrzebne do obejścia bariery. W praktyce system zmusza skrapery do wyboru: albo zaakceptować znacznie wolniejsze tempo pobierania, albo zrezygnować z ataku.
Jakie narzędzia mogą uniemożliwić działanie Anubisa?
Nie wszystkie rozwiązania ochronne działają dla każdego użytkownika w ten sam sposób. Osoby korzystające z wtyczek przeglądarki takich jak JShelter — narzędzia zaprojektowanego do zwiększenia prywatności poprzez blokowanie lub ograniczanie zaawansowanych funkcji JavaScript — mogą napotkać problemy z dostępem do serwisu. Podobnie inne wtyczki, które limitują wykonywanie skryptów, mogą uniemożliwić prawidłowe działanie mechanizmu Anubis.
| Element | Wpływ na działanie Anubisa |
|---|---|
| Nowoczesny JavaScript | Wymagany do funkcjonowania |
| JShelter i podobne wtyczki | Mogą zablokować system |
| Przeglądarki headless | Cel przyszłych ulepszeń |
Dla zwykłych użytkowników przychodzących na stronę ze standardową przeglądarką to zazwyczaj nie stanowi problemu. Jednak osoby szczególnie zainteresowane prywatnością, które blokują zaawansowane skrypty, mogą doświadczyć utrudnień w dostępie.
Przyszłość ochrony: identyfikacja przeglądarek headless
Administrator Infokatowice.pl planuje rozszerzenie systemu obronnego o kolejny poziom zabezpieczeń. Chodzi o identyfikację przeglądarek headless — specjalnych narzędzi, które działają bez graficznego interfejsu użytkownika i są powszechnie wykorzystywane przez zaawansowane boty do automatyzacji.
Planowana metoda opiera się na renderowaniu czcionek. Przeglądarki headless, działające bez wizualnego wyświetlania, mają trudności z prawidłowym obsługiwaniem zaawansowanych operacji na czcionkach. Dzięki temu system będzie mógł rozróżnić rzeczywistego użytkownika od bota, nawet jeśli ten ostatni będzie starał się udawać zwykłą przeglądarkę.
Co to oznacza dla właścicieli serwisów i użytkowników?
Wdrożenie Anubisa na Infokatowice.pl pokazuje trend, który prawdopodobnie będzie się rozprzestrzeniać wśród polskich serwisów informacyjnych. Właściciele stron muszą balansować między ochroną swoich zasobów a zapewnieniem bezproblemowego dostępu dla czytelników. Rozwiązania takie jak Anubis stanowią kompromis — nie są tak inwazyjne jak tradycyjne captche, ale skutecznie zniechęcają do masowego skrobania.
Dla użytkowników oznacza to, że dostęp do serwisów będzie coraz bardziej warunkowy, ale warunki te będą działać przezroczyście dla tych, którzy nie używają specjalistycznych narzędzi blokujących skrypty. Osoby korzystające z wtyczek prywatności mogą napotkać problemy, ale stanowią one mniejszość odbiorców.
Dla branży technologicznej to sygnał, że ochrona przed sztuczną inteligencją i botami staje się priorytetem. Metody takie jak rendering czcionek do identyfikacji przeglądarek headless to dopiero początek — w przyszłości mogą pojawić się jeszcze bardziej zaawansowane techniki biometryczne lub behawioralne.
Na podstawie: Infokatowice.pl. Tekst opracowany redakcyjnie.