Analityka internetowa bez Google: drogi przyjazne prywatności
Kto chce zmienić analitykę internetową, robi to rzadko z niezadowolenia z liczb. Zwykle chodzi o zgodę, przekazywanie danych i o to, że znaczna część odwiedzających i tak nie jest mierzona.
Najważniejsze w skrócie
- Trzy drogi: analizować logi serwera, korzystać z usługi analitycznej niewymagającej zgody albo prowadzić rozwiązanie samodzielnie.
- Logi serwera już istnieją, nie kosztują nic dodatkowo i jako jedyne pokazują też wejścia robotów AI.
- Co odpada we wszystkich trzech przypadkach: rozpoznawanie tej samej osoby przy kolejnych wizytach i dokładne przypisanie płatnej reklamy.
- „Bez ciasteczek” nie znaczy automatycznie „bez zgody” – uregulowany jest dostęp do urządzenia końcowego jako całości.
Trzy drogi
| Logi serwera | Usługa bez zgody | Prowadzone samodzielnie | |
|---|---|---|---|
| Zgoda konieczna | nie | zależnie od ustawień | zależnie od ustawień |
| Dane zostają u was | tak | nie | tak |
| Dodatkowe koszty | brak | małe do średnich | utrzymanie serwera plus opieka |
| Nakład na wdrożenie | mały | mały | duży |
| Pokazuje roboty AI | tak | nie | nie |
| Pokazuje źródła odesłań | ograniczenie | tak | tak |
| Pokazuje czas na stronie | nie | tak | tak |
| Obejmuje wszystkich odwiedzających | tak | zwykle tak | zwykle tak |
Czy wiesz, że…?
Logi serwera są jedynym źródłem pokazującym, czy wasze strony są czytane przez roboty AI. Narzędzie analityczne w przeglądarce nie widzi z tego nic – roboty nie wykonują JavaScriptu.
Dla wszystkich, którzy budują widoczność w silnikach odpowiedzi, to nie efekt uboczny, lecz osobny powód: bez analizy logów nie da się stwierdzić, czy GPTBot, PerplexityBot i pobrania w czasie odpowiedzi w ogóle się pojawiają i które strony biorą. Ta analiza nic nie kosztuje i jest gotowa w godzinę.
Logi serwera szczegółowo
Serwer i tak zapisuje, jaki adres i kiedy został pobrany przez jaką sygnaturę. Te dane powstają niezależnie od analityki – trzeba je tylko przeanalizować.
Co pokazują
Wywołania na stronę, moment, sygnaturę pobierającego, źródło odesłania (o ile przekazane), kod statusu, strony błędu. I: wszystkie wejścia robotów.
Czego nie pokazują
Czasu na stronie, głębokości przewijania, ścieżek klikania wewnątrz strony, rozpoznania tej samej osoby przy kolejnych wizytach.
Na co uważać
Adresy IP są danymi osobowymi. Kto przechowuje logi dłużej, powinien je skracać albo anonimizować – i podać okres przechowywania w polityce prywatności.
Nakład
Godzina na uruchomienie analizy, potem dwadzieścia minut miesięcznie. Bez dodatkowego narzędzia.
Co odpada we wszystkich trzech przypadkach
- Rozpoznawanie przy kolejnych wizytach. Bez dostępu do urządzenia końcowego druga wizyta tej samej osoby nie jest jako taka rozpoznawalna.
- Dokładne przypisanie płatnej reklamy. Kto prowadzi reklamę w znaczącej skali, traci tu podstawę do rozdziału budżetu – to największa praktyczna strata.
- Grupy odbiorców reklam i ponowne docieranie. Zakładają punkt zliczający i tym samym wymagają zgody.
Przy zmianie niemal zawsze rzuca się w oczy, że nowe liczby są wyraźnie wyższe niż stare – i to nie dlatego, że przychodzi więcej odwiedzających, lecz dlatego, że wcześniej znaczna część w ogóle nie była mierzona: wszyscy, którzy odrzucili baner, plus wszyscy z aktywną blokadą reklam.
Prowadzi to regularnie do zamieszania w pierwszym raporcie miesięcznym. Dlatego do raportu należy zdanie mówiące, że szereg czasowy jest w tym miejscu przerwany – inaczej zmiana pomiaru zostanie odczytana jako wzrost.
Która droga do której sytuacji
| Jeśli … | … to |
|---|---|
| mały ruch, brak budżetu reklamowego | same logi serwera |
| potrzebny czas na stronie i działania docelowe | usługa bez zgody plus logi |
| wysokie wymagania grupy docelowej co do prywatności | prowadzone samodzielnie plus logi |
| znaczący budżet reklamowy | zostać przy rozwiązaniu ze zgodą |
| budowana jest widoczność w odpowiedziach AI | logi w każdym przypadku dodatkowo |
Pomóż mi zdecydować, jak powinniśmy ustawić naszą analitykę internetową. Nasza sytuacja: - Odwiedzający miesięcznie: [liczba] - Czy prowadzimy płatną reklamę? [tak / nie / skala] - Liczby, na których opieramy decyzje: [lista] - Obecne rozwiązanie: [opis] - Czy mamy baner zgody? [tak / nie] - Czy mamy dostęp do logów serwera? [tak / nie] - Czy budujemy widoczność w odpowiedziach AI? [tak / nie] Zadania: 1. Sprawdź na podstawie mojej listy, które z używanych liczb byłyby dostępne z samych logów serwera, a które nie. 2. Poleć jedną z trzech dróg – logi, usługa bez zgody, prowadzenie samodzielne – albo połączenie. Uzasadnij. 3. Wskaż konkretnie, co przy twojej rekomendacji stracimy, w odniesieniu do mojej listy. 4. Jeśli prowadzimy płatną reklamę: powiedz wyraźnie, co to znaczy dla rekomendacji. 5. Wskaż, na co zwrócić uwagę przy logach serwera od strony ochrony danych – zwłaszcza co do adresów IP i okresu przechowywania. 6. Sformułuj zdanie do pierwszego raportu miesięcznego po zmianie, wyjaśniające, dlaczego liczby nie są porównywalne. Nie polecaj konkretnych produktów.
Podsumowanie
Najprostsza droga leży bliżej, niż większość sądzi: logi serwera już są, nic nie kosztują i odpowiadają na pytania ważne dla małych stron – które strony są czytane, skąd przychodzą ludzie i czy jesteśmy pobierani przez roboty AI.
Kto potrzebuje czasu na stronie i działań docelowych, dokłada usługę bez zgody. A kto prowadzi reklamę w znaczącej skali, zostaje przy rozwiązaniu ze zgodą – tam strata jest realna.
Częste pytania
Jakie są alternatywy dla klasycznej analityki internetowej?
Trzy: analiza i tak istniejących logów serwera, usługa analityczna niewymagająca zgody albo rozwiązanie prowadzone samodzielnie. Pierwsza nie kosztuje nic dodatkowo, druga jest szybka we wdrożeniu, trzecia trzyma wszystkie dane w firmie, ale wymaga utrzymania i opieki.
Co pokazują logi serwera, czego nie pokazują inne narzędzia?
Wejścia robotów AI. Narzędzia analityczne w przeglądarce nie widzą z tego nic, bo roboty nie wykonują JavaScriptu. Kto buduje widoczność w silnikach odpowiedzi, bez analizy logów nie stwierdzi, czy własne strony są w ogóle pobierane.
Co się traci przy analityce bez zgody?
Trzy rzeczy: rozpoznawanie tej samej osoby przy kolejnych wizytach, dokładne przypisanie płatnej reklamy do zamknięć i budowanie grup odbiorców reklam. Drugi punkt jest największą praktyczną stratą – kto prowadzi reklamę w znaczącej skali, traci podstawę rozdziału budżetu.
Czy narzędzie bez ciasteczek automatycznie nie wymaga zgody?
Nie. Uregulowany jest dostęp do urządzenia końcowego jako całości – podpadają pod to także lokalna pamięć przeglądarki i analiza cech urządzenia w celu rozpoznania. To, co narzędzie faktycznie robi, trzeba sprawdzić i nie wynika to z opisu produktu.
Dlaczego liczby rosną po zmianie?
Bo wcześniej znaczna część odwiedzających w ogóle nie była mierzona – wszyscy, którzy odrzucili baner zgody, plus wszyscy z aktywną blokadą reklam. To nie wzrost, lecz pełniejszy pomiar. Do pierwszego raportu miesięcznego należy więc uwaga, że szereg czasowy jest przerwany.
Marketing, który konfiguruje się sam
Beta Studio Engine jest otwarta. Zarezerwuj miejsce i współtwórz od początku.
Dołącz do bety →