ChatGPT i tracking - czy OpenAI śledzi użytkowników poza czatem?
ChatGPT zaczyna przypominać nie tylko inteligentnego chatbota, ale także zaawansowaną platformę reklamową. To z kolei rodzi wyzwania, które powinny zainteresować każdego specjalistę od prywatności użytkowników oraz zarządzania zgodami. Najnowsze doniesienia skupiają się na mechanizmie oznaczanym jako __obi. Według ustaleń ekspertów mechanizm ten może tworzyć techniczne warunki do powiązania aktywności internauty na witrynach zewnętrznych reklamodawców z unikalnym identyfikatorem konta w systemie ChatGPT. Trzeba przy tym podkreślić, że nie udowodniono, by OpenAI skanowało pełną historię przeglądania lub dzieliło się poufną treścią samych promptów z zewnętrznym biznesem. Niemniej jednak sam zidentyfikowany szkielet techniczny tego rozwiązania jest niezmiernie interesujący.
Nowe oblicze reklamy w platformie ChatGPT
Firma OpenAI oficjalnie pracuje nad rozwojem własnego systemu reklamowego wewnątrz ChatGPT. Z zapowiedzi wynika, że materiały sponsorowane mogą być profilowane w oparciu o kontekst prowadzonej w danym momencie rozmowy. Co więcej, po włączeniu opcji personalizacji system może wykorzystywać wybrane sygnały pochodzące z wcześniejszej aktywności w usłudze. Równocześnie gigant technologiczny stanowczo zapewnia, że reklamodawcy w żadnym wypadku nie otrzymują dostępu do zapisów konwersacji. To jednak zaledwie jedna ze stron medalu. Równie istotne jest to, co dzieje się po zamknięciu okna czatu, gdy użytkownik udaje się na inne witryny.
Zasada działania ciasteczka __obi
Jak wynika z przeprowadzonych analiz technicznych, wejście w interakcję z ChatGPT może skutkować umieszczeniem w przeglądarce specyficznego ciasteczka o nazwie __obi. Plik ten jest bezpośrednio przypisany do domeny OpenAI. Aktualna polityka prywatności klasyfikuje go jako rozwiązanie o charakterze czysto analitycznym, a jego żywotność w systemie ustalono na równy rok. Wygenerowanie ciasteczka samo w sobie nie stanowi jeszcze odstępstwa od rynkowych standardów. Kontrowersje rodzą się dopiero wtedy, gdy nadany identyfikator może być sprawnie odczytywany na zewnętrznych stronach, które mają zintegrowane kody reklamowe dostarczone przez OpenAI.
Mechanika przypomina doskonale znane sztuczki branży AdTech. Sklep internetowy instaluje specjalny skrypt z sieci partnerskiej. Gdy potencjalny klient odwiedza witrynę, zagnieżdżony kod wyłapuje dostępne identyfikatory i śle pakiet danych wprost na serwery systemu reklamowego. Fundamentalna różnica sprowadza się tu do faktu, że owym ekosystemem reklamowym staje się potężny algorytm stojący za ChatGPT.
Trzy etapy nowego śledzenia
Działanie całego mechanizmu można uprościć do trzech sekwencyjnych etapów:
Użytkownik nawiązuje konwersację z ChatGPT, a jego przeglądarka otrzymuje i zapisuje unikalny znacznik __obi.
Ten sam internauta przechodzi na docelową stronę reklamodawcy, która w tle obsługuje odpowiedni kod źródłowy lub autorskie pakiety SDK od OpenAI.
Przeglądarka posłusznie dołącza zebrany identyfikator do standardowego żądania HTTP. W efekcie witryna sprzedażowa zyskuje techniczną możliwość przesłania informacji o wizycie klienta wprost do chmury OpenAI.
Obserwacje wykazują, że taki model działania można odnaleźć na setkach zewnętrznych pikseli reklamowych ulokowanych na przeszło tysiącu przebadanych domen. Sprawia to, że cały schemat niepokojąco mocno upodabnia się do klasycznego mechanizmu śledzenia w różnych witrynach (ang. cross-site tracking).
Wrażliwość przekazywanych informacji
Na tym etapie sprawa nabiera naprawdę niebezpiecznych kolorów. Według badaczy biblioteki SDK wykorzystywane przez zewnętrznych partnerów dysponują potężnymi możliwościami odczytu. Do infrastruktury OpenAI mogą spływać takie parametry jak:
kompletne adresy odwiedzanych podstron URL,
widoczny tekst ze struktury strony,
treść wpisywana w formularze kontaktowe,
głębokie warstwy informacyjne typu window.dataLayer,
dokładne pozycje geolokalizacyjne odwiedzających,
wszelkie inne identyfikatory zaszyte w systemie.
Część z obserwowanych przez ekspertów adresów URL bez problemu wskazywała na witryny poświęcone sprawom zdrowotnym, zadłużeniom, a nawet toczącym się postępowaniom sądowym. To dobitnie uzmysławia, dlaczego rzucanie w tym kontekście luźnym hasłem "tracking" nie oddaje całej powagi sytuacji. Mechanizm nie informuje ogólnikowo o samym wejściu do danego e-sklepu. W tym wariancie do centrali potrafi popłynąć wyraźny komunikat świadczący o analizowaniu przez użytkownika konkretnej podstrony dotyczącej trudnego kredytu lub rzadkiej choroby zakaźnej.
Czy OpenAI faktycznie wie o Twoich zakupach?
Tutaj konieczne jest ostudzenie emocji i zachowanie zdrowego dystansu. Pojawiające się krzykliwe nagłówki sugerujące pełną inwigilację każdej naszej transakcji przez ChatGPT są bardzo mocno na wyrost. Mechanizm owszem, posiada techniczne predyspozycje do masowego zbierania takich sygnałów. Nie udowodniono jednak, by OpenAI na dużą skalę automatycznie zgrywało historię zakupów i na tej podstawie modyfikowało profile wszystkich posiadaczy kont na platformie. Niezależni eksperci nie zdołali uchwycić działania centralnego systemu (ang. server-side), który potwierdzałby istnienie trwałego i bezwzględnego parowania tych logów z bazą konkretnych użytkowników. O wiele bezpieczniej i precyzyjniej jest więc stwierdzić, że mechanizm przygotowuje solidny, techniczny grunt do takich operacji. Faktyczny zakres bieżącego wykorzystania i łączenia zebranych profili pozostaje jednak trudny do jednoznacznego ustalenia bez wglądu w procedury wewnętrzne twórców.
Zderzenie dwóch światów: poufna rozmowa a cyfrowy profil
Dlaczego zatem sprawa z ciasteczkiem __obi budzi nieporównywalnie większy niepokój niż wdrożenie standardowych kodów od Google czy Meta? Odpowiedź leży w unikalnej relacji człowieka z maszyną. Internauci zdradzają inteligentnym czatom najbardziej intymne szczegóły ze swojego życia, powstrzymując się jednocześnie przed wpisywaniem ich w publiczne wyszukiwarki. Konsultacje ze sztuczną inteligencją regularnie dotyczą diagnoz medycznych, rozwodów, planów życiowych, ukrywanych problemów prawnych, stanu konta czy trudnych zakupów.
Połączenie tak głęboko poufnej bazy wiedzy z agresywnymi mechanizmami profilowania po wyjściu z serwisu rodzi potężne dylematy. OpenAI stanowczo zaznacza, że sponsorzy wyświetlający u nich materiały promocyjne nigdy nie otrzymają bezpośredniego wglądu do bazy naszych promptów. Główny znak zapytania nie polega tu na ryzyku bezpośredniego przekazania logów biznesowemu partnerowi. Niepokój wywołuje raczej techniczna możliwość stworzenia wysoce precyzyjnego megaprofilu konsumenta, w którym codzienna podróż przez z pozoru anonimowe portale złączy się z wiedzą na temat ukrywanych intencji wyjawionych w cichym oknie asystenta AI.
Sprzeciw wobec plików marketingowych a realna ochrona
Istotny problem związany z tym znaleziskiem uderza bezpośrednio w sposób zarządzania zgodami użytkowników. OpenAI kategoryzuje ciasteczko __obi wyłącznie jako rozwiązanie usprawniające ogólną analitykę usługi. Taki zabieg sprawia, że mechanizm zbierania danych bywa potajemnie wznawiany nawet w przypadku wyraźnego odrzucenia przez internautę zgód o charakterze marketingowym.
Kieruje to uwagę w stronę zasadniczego pytania o sens istnienia modułów CMP i transparentność okienek wyskakujących przy wejściu na serwis. Internauta blokujący pliki marketingowe ma uzasadnione prawo wierzyć, że skutecznie ukręcił łeb inwigilacji reklamowej. Niestety, we współczesnym internecie ciasteczka są tylko wierzchołkiem lodowej góry. Prawdziwe śledzenie realizowane jest w tle, przy wykorzystaniu takich rozwiązań jak identyfikatory sprzętowe, zagnieżdżone wtyczki SDK, techniki fingerprintingu, bezbłędne łączenie żądań HTTP i ukryta wymiana między bazami na szczeblu serwerów (ang. server-side tracking). Z tego powodu solidny audyt każdej powiązanej z prywatnością strony musi wykraczać dalece poza sprawdzenie, czy odpowiednio odznaczono główny suwak ustawień w przeglądarce.
Zgodność nowoczesnych technologii z RODO
Wnioskowanie o masowym łamaniu przepisów o ochronie danych przez każdą stronę korzystającą z tych technologii wymaga dużej ostrożności. Sam fakt zainstalowania w systemie piksela lub przekazania identyfikatora na wyjściu nie stanowi jeszcze twardego dowodu na naruszenie RODO. Organ kontrolny bierze pod uwagę cały szereg skomplikowanych zależności, weryfikując rodzaj zbieranych materiałów, prawne cele tego działania, sposób zabezpieczenia przepływów, jasne określenie odbiorców i czytelne poinformowanie o tym klienta końcowego. Należy mieć na uwadze, że swobodne podpięcie skryptu pod bezpieczną zakładkę "analityka" w żaden sposób nie legalizuje automatycznie rozbudowanego procederu przekazywania danych zewnętrznemu gigantowi, który planuje czerpać z niego finansowe profity przy targetowaniu własnych reklam.
Deklaracje giganta a rynkowe realia
Obserwacje badaczy należy zrównoważyć z oświadczeniami samych twórców platformy. OpenAI komunikuje, że wdrażany format reklamowy jest całkowicie odseparowany od silnika generującego właściwe odpowiedzi. Zgodnie z oficjalną linią, marki wykupujące czas promocyjny otrzymują dostęp zaledwie do szczątkowych statystyk i uśrednionych raportów skuteczności, bez wglądu w historie konwersacji. Nie zmienia to faktu, że system wyraźnie ewoluuje. Komercyjne treści u asystenta AI przestają być niewinnym dodatkiem w formie paska, a stają się kręgosłupem wyznaczającym kierunek przyszłego rozwoju potężnego, inteligentnego organizmu reklamowego.
Lekcja dla administratorów portali
Całe to zamieszanie dobitnie pokazuje, w jakim kierunku zmierza dzisiejszy biznes cyfrowy. Ograniczenie się do skontrolowania listy lokalnych ciasteczek na prowadzonym serwisie to obecnie mrzonka. Właściciele sklepów muszą regularnie sprawdzać:
wszystkie podpięte, ładujące się w tle skrypty zewnętrzne i tajemnicze domeny,
pakiety z ukrytymi parametrami wyciekającymi poprzez warstwy okien dataLayer,
moment uruchomienia procedury zbierania informacji względem momentu udzielenia wyraźnej zgody przez klienta,
faktyczny cel technologii wrzucanych lekką ręką do ogólnikowej kategorii "Niezbędne",
rzetelność napisanej kiedyś polityki prywatności w zderzeniu z bieżącym modelem technicznym,
skuteczność zablokowania niechcianych kanałów przepływu natychmiast po wycofaniu zgody przez odwiedzającego.
Sprawa skryptu od OpenAI stanowi mocny dowód na gwałtowną zmianę dotychczasowych proporcji. Im mocniej zamazuje się cienka linia między doradzającą nam uczynnie maszyną, zaawansowaną reklamą, a brutalnym trackingiem internetowym, tym wyżej należy oceniać przydatność skrupulatnie wdrożonych na stronach inteligentnych i godnych zaufania modułów zarządzania prawami użytkowników. Sam przycisk akceptacji nie uchroni dziś przed wezwaniami organu kontrolnego. Ochronę musi zaoferować zaporowy mechanizm faktycznie odcinający kurek ze strumieniem danych przy jakiejkolwiek próbie ominięcia wyborów konsumenta.