Poradniki

Anubis chroni serwisy przed zautomatyzowanym skrobaniem danych

Poznaj system Anubis, który chroni serwery przed agresywnym zbieraniem danych przez boty AI. Dowiedz się, jak działa i jakie są jego ograniczenia.

19.09.2026 — Rafał Skupień
Focused detail of a modern server rack with blue LED indicators in a data center.
Fot. panumas nikhomkhai / Pexels · Pexels License

System Anubis to rozwiązanie ochronne wdrożone na serwerach internetowych w celu powstrzymania zautomatyzowanego zbierania danych przez firmy zajmujące się sztuczną inteligencją. Problem, który rozwiązuje, jest realny: agresywne skrobanie zasobów powoduje przeciążenie infrastruktury, co prowadzi do przestojów serwera i niedostępności treści dla zwykłych użytkowników.

Czym jest Anubis i jak działa?

Anubis wykorzystuje mechanizm Proof-of-Work, czyli schemat obliczeniowy znany z technologii blockchain, konkretnie wzorowany na systemie Hashcash. Idea jest prosta: zanim użytkownik (lub bot) uzyska dostęp do zasobu, musi wykonać pewne obliczenia, które wymagają mocy procesora. Dla zwykłego człowieka, który odwiedza stronę raz dziennie, koszt ten jest znikomy. Dla firmy chcącej pobrać miliony stron danych, koszty operacyjne stają się znaczące.

W praktyce system Anubis wymaga od przeglądarki wykonania pracy obliczeniowej przed udzieleniem dostępu do strony. Mechanizm ten odstraszał potencjalnych skraperów poprzez zwiększenie ekonomicznego kosztu masowego zbierania informacji.

Wymagania techniczne i ograniczenia systemu

Anubis opiera się na nowoczesnych funkcjach JavaScript, które muszą być dostępne i aktywne w przeglądarce. To jest kluczowe ograniczenie: system nie zadziała, jeśli użytkownik korzysta z rozszerzeń przeglądarki, które wyłączają te funkcje.

Wtyczka o nazwie JShelter to przykład narzędzia, które może zablokować wymagane komponenty JavaScript potrzebne do działania Anubisa. Użytkownicy, którzy instalują tego rodzaju rozszerzenia w celu zwiększenia prywatności, mogą napotkać problemy z dostępem do stron chronionych tym systemem.

AspektOpis
MechanizmProof-of-Work wzorowany na Hashcash
WymaganiaNowoczesne funkcje JavaScript
OgraniczeniaBlokada przez wtyczki takie jak JShelter
CelZniechęcenie do masowego skrobania danych
StatusRozwiązanie tymczasowe

Przyszłość ochrony: identyfikacja przeglądarek headless

Administrator serwera, który wdrożył Anubis, ma świadomość, że to rozwiązanie ma charakter przejściowy. Docelowo planuje się przejście na bardziej zaawansowany system, który będzie polegać na identyfikacji przeglądarek headless poprzez technikę renderowania fontów.

Przeglądarki headless to narzędzia używane przez boty do automatycznego przeglądania stron internetowych bez interfejsu graficznego. System oparty na renderowaniu fontów miałby umożliwić rozróżnienie między rzeczywistym użytkownikiem a botem, analizując sposób, w jaki przeglądarka obsługuje zasoby typograficzne.

Co to oznacza dla właścicieli serwisów i użytkowników

Dla operatorów serwisów internetowych, zwłaszcza tych zawierających wartościowe dane lub treści, wdrożenie systemu ochrony przed skrobaniem staje się koniecznością. Koszty związane z obsługą masowych żądań od botów AI mogą być znaczące, zarówno w kontekście zużycia zasobów, jak i opłat za transfer danych.

Dla zwykłych użytkowników oznacza to, że mogą napotkać dodatkowe wymagania techniczne przy dostępie do niektórych stron. Osoby korzystające z rozszerzeń przeglądarki zwiększających prywatność powinny być świadome, że mogą to uniemożliwić dostęp do chronionych zasobów. W takim przypadku wyłączenie wtyczki lub przejście na inną przeglądarkę może być konieczne.

Równocześnie, dla firm zajmujących się AI i uczeniem maszynowym, wzrost kosztów operacyjnych związanych ze skrobaniem może zmienić ekonomikę ich modeli biznesowych. Rozwiązania takie jak Anubis mogą skłonić do poszukiwania alternatywnych źródeł danych lub negocjacji licencji z właścicielami serwisów.

Perspektywa branżowa

Wdrażanie systemów ochrony przed skrobaniem danych odzwierciedla szerszą tendencję w internecie: rosnącą świadomość właścicieli treści wobec wartości swoich zasobów. Jednocześnie rozwój technologii AI i rosnące zapotrzebowanie na dane treningowe tworzą presję w drugą stronę. Rozwiązania takie jak Anubis to próba znalezienia równowagi między dostępnością zasobów dla człowieka a ochroną przed masowym eksploatowaniem.

Przyszłość będzie zależeć od tego, czy systemy ochrony będą się rozwijać szybciej niż metody obejścia ich przez boty. Historia internetu pokazuje, że jest to zawsze wyścig — każde zabezpieczenie stymuluje nowe sposoby jego obejścia.

Na podstawie: Infokatowice.pl. Tekst opracowany redakcyjnie.