AI i tracking - czy chatboty przekazują dane reklamodawcom?
Rozmowa z chatbotem AI może wydawać się w pełni prywatna. Otwieramy okno czatu, wpisujemy pytanie i błyskawicznie otrzymujemy odpowiedź. Nie widzimy krzykliwych banerów reklamowych, nie przeglądamy klasycznej witryny, a sam interfejs do złudzenia przypomina dyskretny komunikator. Problem polega jednak na tym, że technologia ukryta pod spodem nadal potrafi korzystać z mechanizmów doskonale znanych z tradycyjnego internetu. Najnowsze badanie naukowców z IMDEA Networks uświadamia, że w przypadku części popularnych chatbotów informacje powiązane z prowadzonymi rozmowami mogą trafiać bezpośrednio do zewnętrznych korporacji zajmujących się analityką, reklamą i profilowaniem użytkowników. Zespół badawczy przeanalizował dziewięć popularnych platform opartych na sztucznej inteligencji i zidentyfikował 124 domeny należące do 44 organizacji. Aż 34 z nich zostały jednoznacznie zaklasyfikowane jako podmioty zarabiające na śledzeniu cyfrowych śladów. W tym miejscu rodzi się niezwykle istotne pytanie. Czy internauta korzystający z wirtualnego doradcy rzeczywiście ma świadomość tego, jakie dokładnie dane o jego konwersacji opuszczają system?
Badacze sprawdzili 9 popularnych chatbotów AI
Naukowa analiza wzięła pod lupę czołowych graczy na rynku. Oceniono następujące usługi:
ChatGPT
Claude
Grok
DeepSeek
Perplexity
Gemini
Microsoft Copilot
Mistral Le Chat
Meta AI
Testom poddano zarówno wersje przeglądarkowe, jak i dedykowane aplikacje mobilne. Eksperymenty zostały przeprowadzone na terytorium Hiszpanii i uwzględniały rozmaite warianty ustawień prywatności, różne typy kont oraz funkcjonalność udostępniania rozmów na zewnątrz. Ostateczny wynik okazuje się wysoce interesujący, ponieważ absolutnie każda z dziewięciu badanych usług nawiązywała po cichu komunikację z przynajmniej jednym zewnętrznym modułem reklamowym lub analitycznym. Prawdziwy niepokój budzi jednak sam charakter wysyłanych informacji.
Tracker może dowiedzieć się, o czym rozmawiasz z AI
W kodzie części testowanych usług badacze zaobserwowali niepokojące transferowanie do podmiotów trzecich niezwykle wrażliwych pakietów informacji. Należały do nich między innymi:
pełne adresy trwających rozmów
unikalne identyfikatory konwersacji
automatycznie wygenerowane tytuły czatów
dokładne treści wpisywanych promptów
zrzuty ekranu interfejsu
indywidualne identyfikatory przypisane użytkownikom
Wycieki danych powiązanych z treścią rozmów wykryto w sześciu z dziewięciu analizowanych klientów webowych oraz w trzech z ośmiu badanych aplikacji na urządzenia z systemem Android. Stanowi to gigantyczną zmianę w porównaniu do klasycznego monitoringu w sieci. Jeśli użytkownik odwiedza internetową aptekę, skrypt śledzący rejestruje zaledwie fakt wyświetlenia konkretnego preparatu. Jeśli natomiast ta sama osoba wpisuje zapytanie do asystenta AI, a system wygeneruje mu nagłówek brzmiący Objawy choroby Parkinsona we wczesnym stadium, taki ciąg znaków błyskawicznie staje się niezwykle wartościowym materiałem dla branży reklamowej. Raport prezentuje dokładnie takie scenariusze. W jednym z przeprowadzonych testów prompt dotyczący pierwszych symptomów Parkinsona został natychmiast zamieniony przez algorytm na jawny tytuł rozmowy zawierający tę kluczową informację. Innym razem długa dyskusja o możliwościach zakupu nieruchomości wygenerowała gotowy nagłówek bezpośrednio odnoszący się do wysokości wynagrodzenia oraz potencjalnego kredytu hipotecznego.
Problemem są nie tylko ciasteczka
Naiwnością byłoby zakładać, że wystarczy po prostu odrzucić pliki cookies w przeglądarce, aby problem całkowicie zniknął. Zgromadzone dane udowadniają, że sytuacja jest o wiele bardziej skomplikowana. Po zablokowaniu nieobowiązkowych ciasteczek część wektorów śledzących faktycznie przestawała funkcjonować. Jednocześnie badacze wskazują, że blisko 80,8 procent zewnętrznych trackerów pozostawało w pełni aktywnych niezależnie od tych ustawień. Twórcy raportu lojalnie zastrzegają przy tym, że w różnych fragmentach publikacji stosowane są odmienne mianowniki, dlatego dokładnych liczb dotyczących usług i trackerów nie należy bezpośrednio ze sobą zrównywać.
Dostarcza to niezwykle surowej lekcji właścicielom stron internetowych. Typowy baner z prośbą o zgodę absolutnie nie przypomina magicznego przełącznika wyłączającego całą inwigilację. Współczesny ekosystem cyfrowy potrafi obejmować potężną gamę rozwiązań, do których zalicza się:
standardowe pliki cookies
niewidzialne piksele konwersji
numery seryjne urządzeń końcowych
unikalne profile użytkowników
pakiety SDK zagnieżdżone w aplikacjach
zamknięte środowiska WebView
rozbudowane narzędzia analityczne
oprogramowanie typu server side tracking
nowoczesne protokoły Conversions API
wyrafinowane techniki fingerprintingu
skomplikowane systemy ciągłej synchronizacji tożsamości
Właśnie dlatego samo zweryfikowanie wygenerowanej listy ciasteczek rzadko pozwala na pełne zrozumienie tego, jakie precyzyjnie pakiety danych potajemnie opuszczają konkretny serwis.
Szczególnie interesujące są adresy rozmów
Jednym z najbardziej ryzykownych zjawisk namierzonych przez naukowców pozostaje kwestia udostępniania linków. W pięciu przeglądarkowych klientach wykryto mechanizmy transmitujące pełne adresy URL lub identyfikatory pozwalające na bezproblemowe odtworzenie przebiegu dyskusji na serwerach zewnętrznych. W niektórych usługach transfer ten zachodził w pełni domyślnie, w innych natomiast dopiero po naciśnięciu przycisku akceptacji w komunikacie o prywatności. Jeszcze większe emocje budzi odpowiednie zabezpieczenie wygenerowanych odnośników. Weryfikacja systemów współdzielenia rozmów udowodniła, że linki do zapisanych konwersacji pozwalały na swobodne odczytanie pełnej treści bez jakiejkolwiek konieczności logowania do platformy. Oznacza to, że trafienie takiego hiperłącza w ręce niepowołanego podmiotu generuje gigantyczne zagrożenie dla bezpieczeństwa zebranych tam materiałów.
Nowe wyzwanie dla RODO wynikające z połączenia AI i monitoringu
Odkryte luki architektoniczne sprawiają, że poruszony temat nabiera ogromnego znaczenia z perspektywy europejskich przepisów RODO. Konwersacje z wirtualnymi maszynami bardzo często obfitują w szczegóły, których klient nigdy nie zdecydowałby się wpisać do standardowego formularza kontaktowego. Poruszane z maszyną wątki mogą bez przeszkód dotyczyć:
szczegółowego stanu zdrowia
ukrywanej sytuacji finansowej
zawiłych warunków zatrudnienia
bolesnych problemów rodzinnych
intymnych relacji międzyludzkich
długofalowych planów zawodowych
skomplikowanych kłopotów z prawem
bardzo wrażliwych danych dotyczących osób trzecich
Autorzy raportu dobitnie akcentują, że internauci na całym świecie coraz chętniej traktują inteligentne boty jak zaufanych doradców, zwierzając się z kwestii o skrajnie prywatnym charakterze. Równolegle infrastruktura utrzymująca te platformy bez skrępowania korzysta z narzędzi analitycznych zapożyczonych wprost ze starego rynku reklamowego. Oczywiście nie wolno z automatu zakładać, że każda pojedyncza transmisja danych brutalnie łamie przepisy unijne. W ferowaniu tego typu wyroków niezbędna jest duża ostrożność. Twórcy opracowania otwarcie przyznają, że nie przeprowadzali ostatecznej oceny prawno-podatkowej poszczególnych firm. Ich głównym celem pozostawało wyłącznie techniczne zidentyfikowanie kierunku przepływów oraz głośne zasygnalizowanie rodzących się dylematów.
Czy zgoda na cookies obejmuje również analizę promptów?
Zebrane dowody prowadzą do jednego z najbardziej fascynujących pytań w całym tym zamieszaniu. Jeśli odwiedzający wchodzi na stronę oferującą asystenta AI i odruchowo klika akceptację w lakonicznym powiadomieniu o plikach marketingowych, czy rzeczywiście spodziewa się włączenia w to analizy własnych zapytań? Gdzieś tutaj ujawnia się potężny problem związany z brakiem świadomości internautów oraz granicami udzielanego pozwolenia. Patrząc z perspektywy projektantów rzetelnych systemów zarządzania preferencjami, proste stwierdzenie o używaniu technologii do celów reklamowych w żaden sposób nie wyczerpuje tematu. Administrator witryny musi bezbłędnie wiedzieć, jakie konkretnie zmienne są przesyłane, do kogo ostatecznie trafiają, z jakiego dokładnego powodu są gromadzone oraz przy użyciu jakiej technologii realizuje się dany proces. Bez tych odpowiedzi klient będzie po prostu formalnie klikać przycisk zgody, żyjąc w całkowitej nieświadomości o faktycznej skali inwigilacji własnych zachowań.
Tradycyjny tracking wkracza do świata sztucznej inteligencji
Zjawiska opisane przez hiszpańskich naukowców naświetlają znacznie szerszy i bardziej uniwersalny trend rynkowy. Algorytmy nie tworzą wokół nas całkowicie nowej i bezpiecznej bańki prywatności. Koncerny prężnie przenoszą do okienek czatowych sprawdzone rozwiązania wypracowane na klasycznych witrynach. Potężne narzędzia analityczne oferowane przez gigantów technologicznych oraz rozbudowane sieci reklamowe wcale nie zniknęły tylko dlatego, że społeczeństwo zaczęło chętniej rozmawiać z wirtualnymi doradcami. Jest wręcz przeciwnie. Cały ten arsenał zyskał właśnie wyłączny dostęp do bezcennego strumienia wiedzy napływającego z bezpośrednich interakcji człowieka z generatywną sztuczną inteligencją. Rynkowa wartość tak wyprofilowanych pakietów bywa ogromna. Zwykła wizyta na stronie dewelopera sygnalizuje zaledwie luźne zainteresowanie zakupem. Szczera debata z botem doradczym potrafi natomiast ujawnić dokładną kwotę odłożonych oszczędności, precyzyjną lokalizację, planowaną datę transakcji oraz aktualną zdolność kredytową. To zupełnie inna, o niebo wyższa jakość gromadzonego profilu konsumenta.
Co to oznacza dla właścicieli stron i administratorów biznesowych?
Zaprezentowane wnioski powinny zadziałać jak ostry sygnał ostrzegawczy dla tysięcy firm decydujących się na wdrażanie zaawansowanych gadżetów. Jeśli planujesz lub już wdrożyłeś do własnej infrastruktury:
nowoczesnego chatbota AI
inteligentny widget wspierający obsługę klienta
zautomatyzowany system rekomendacji produktów
wirtualnego doradcę sprzedażowego
skomplikowane rozwiązania agregujące ruch
skrypty łączące platformę z popularnymi social mediami
zaawansowane moduły analityki ruchu
rozwiązania typu server side tracking
Zdecydowanie powinieneś wnikliwie zweryfikować nie tylko to, jakie ciasteczka instaluje Twój portal, ale prześwietlić absolutnie cały przepływ informacji pomiędzy serwerami.
Każdy świadomy administrator musi uczciwie odpowiedzieć sobie na listę fundamentalnych pytań.
Jakie dokładnie dane lądują na dyskach zewnętrznych podwykonawców?
Czy przesyłane pakiety mogą potajemnie przechwytywać szczere zapytania wpisywane przez Twoich klientów?
Czy system dyskretnie przekazuje dalej unikalne numery urządzeń logujących się do platformy?
Czy skrypty monitorujące uruchamiają się samowolnie jeszcze przed podjęciem przez gościa jakiejkolwiek decyzji?
Czy odrzucenie opcjonalnych technologii faktycznie i bezpowrotnie zrywa niepożądane połączenia?
Czy użytkownik został w jasny i bezpośredni sposób poinformowany o tych skomplikowanych mechanizmach? Podjęcie takiego wysiłku świadczy o nieporównywalnie bardziej dojrzałym podejściu do biznesu niż samo upewnienie się, że dół ekranu zdobi estetyczny baner informacyjny.
AI wymaga wdrożenia nowej kultury dbania o prywatność
Rezultaty opublikowanych eksperymentów pokazują problem o dużo cięższym kalibrze niż kolejna uciążliwa usterka w kodzie strony. Jesteśmy bezpośrednimi świadkami momentu, w którym wyraźna niegdyś granica między poufną konwersacją a cenną metryczką reklamową zostaje całkowicie zatarta. Jeszcze niedawno cyfrowe śledzenie kojarzyliśmy głównie z analizą liczby odsłon, tworzeniem map ciepła i sprawdzaniem opuszczonych koszyków. W dobie powszechnej algorytmizacji korporacje wdzierają się do zupełnie nowej sfery, badając dokładnie to, co zdezorientowany człowiek opowiedział syntetycznej inteligencji. Zagwarantowanie nam cyfrowego bezpieczeństwa w przyszłości będzie zatem wymagało nie tylko rygorystycznego zarządzania zgodami, ale przede wszystkim bezwzględnej transparentności w obrocie danymi generowanymi podczas luźnych rozmów z botami. Najistotniejsze pytanie, jakie stawia przed sobą dzisiejszy internauta, brzmi niezwykle prosto. Czy pisząc o swoich problemach do okienka czatu, na pewno mam po drugiej stronie wyłącznie sztuczną inteligencję? Przeprowadzone w Hiszpanii badania bezlitośnie obnażają, że optymistyczna odpowiedź na to pytanie bywa w wielu przypadkach całkowitym złudzeniem.