Przejdź do treści

Czy ChatGPT śledzi, co robisz w internecie? Ciasteczko __obi już to robi

Mapa śladów: ciasteczko __obi wychodzi z ChatGPT na strony reklamodawców: sklep, kurs, zdrowie, prawnik; 936 pikseli, ważność 365 dni

Od wiosny OpenAI mierzy reklamy w ChatGPT własnym pikselem pomiarowym. 20 września 2026 roku badacz publikujący się jako Buchodi rozłożył ten mechanizm na czynniki pierwsze i wyszło z tego coś więcej niż licznik konwersji. Ciasteczko o nazwie __obi przenosi tożsamość konta ChatGPT na strony reklamodawców, a tam skrypt OpenAI zbiera dane o tym, co przeglądasz i kupujesz. Wątek na Hacker News urósł do 763 punktów i 394 komentarzy (stan na 25 września), bo dotyka produktu, do którego ludzie piszą rzeczy, których nie napisaliby do wyszukiwarki.

Samych pomiarów nie odtwarzaliśmy. Tekst opiera się na analizie Buchodiego z 20 września, opracowaniu serwisu Cyber Security News z 21 września i branżowym kontekście z kwietnia. Stan wiedzy: 25 września 2026. Gdy przeprowadzimy własne pomiary na polskich kontach, dopiszemy je tutaj.

Spis treści:

Ciasteczko, które wychodzi z ChatGPT

Mechanizm zaczyna się w czacie. Przeglądarka na chatgpt.com losuje 16 bajtów, backend OpenAI podpisuje je tokenem ważnym 60 sekund, a token wiąże dwie rzeczy: identyfikator Twojego konta oraz krótki, 22-znakowy identyfikator obi. Identyfikator ląduje jako ciasteczko __obi w domenie .openai.com, ustawione na rok, z atrybutem SameSite=None. Ten atrybut pozwala wysyłać ciasteczko w żądaniach do obcych stron i __obi jest jedynym ciasteczkiem OpenAI, które go ma.

Drugą połowę układanki wstawia reklamodawca. Firma, która kupuje reklamy w ChatGPT, dodaje na swoją stronę skrypt pomiarowy z bzrcdn.openai.com. Samo załadowanie tego skryptu wysyła __obi z powrotem do OpenAI, zanim wykona się jakikolwiek kod pomiarowy, więc mechanizm „bez credentials” w SDK nic nie zmienia. Buchodi ujął to tak: „samo załadowanie tagu ujawnia identyfikator”. Reklamodawca tego ciasteczka nie widzi, siedzi ono w domenie OpenAI, więc widzieć oba końce połączenia może wyłącznie OpenAI.

Nikt nie zaobserwował wprost, jak po stronie serwera dane sklejają się z kontem. Tokeny zawierają identyfikator konta, więc taka możliwość jest wpisana w konstrukcję, ale samego złączenia badacz wywnioskował, a nie uchwycił. Reszta ustaleń jest empiryczna, z kilkumiesięcznego przechwytu ruchu.

Co piksel zbiera na stronach reklamodawców

Badanie objęło 936 pikseli rozsianych po 1029 hostach. Skrypt podpina się pod warstwy danych, które strony używają do własnej analityki: łapie wpisy do window.dataLayer, czyta adobeDataLayer, odnajduje nawet przemianowane warstwy Google Tag Managera. Stamtąd wyjmuje tożsamość odwiedzającego i w zestawieniu badacza dane wygrzebane ze stron przeważyły nad danymi przekazanymi świadomie przez reklamodawców, 685 do 255. Wersja 0.1.31 zbierała przy okazji imiona i lokalizacje; zakres zawężono 27 sierpnia.

Część pól idzie jako skróty SHA-256, między innymi adresy e-mail, telefony i nazwiska, ale kraj, region, miasto i kod pocztowy jadą jawnym tekstem. Kod pocztowy okazał się najczęściej zbieranym polem: 100 zdarzeń z 28 serwisów. Adresy URL są przycinane do domeny i ścieżki, co nie uchroniło nikogo, bo w zbiorze wylądowały ścieżki zdradzające stan zdrowia, kłopoty z długami i kontakt z kancelarią. Wykluczenia też istnieją: hasła, numery kart, daty urodzenia i historia medyczna mają być odsiewane. Automatyczne dopasowanie pól i tak włączyło 638 z 881 pikseli z znanym ustawieniem, w tym wszystkie z branży kredytowej.

Działa nawet po wylogowaniu

Z 932 rozszyfrowanych tokenów 736 pochodziło z kont użytkowników, a 196 od osób wylogowanych. Te anonimowe identyfikatory trzymały się urządzenia przez co najmniej 27 dni, więc wylogowanie z ChatGPT nie zamyka tematu. Na telefonie badacza jedno __obi wyszło z dwunastu sklepów i serwisów, między innymi Chewy, Wayfair, HelloFresh i Coursera, a 12 z 30 obserwowanych identyfikatorów obsługiwało kilku reklamodawców naraz. Skala nie jest totalna: token synchronizacji produkowała mniej więcej co piąta sesja.

Mapa nie jest też jednolita. Obserwacje pochodzą z Chrome na Androidzie, gdzie ciasteczka stron trzecich chodzą swobodnie. Na iOS mechanizm nie działa: Safari, a za nim wszystkie przeglądarki na WebKicie, blokuje ciasteczka stron trzecich.

OpenAI nazywa to analityką

W polityce ciasteczek OpenAI __obi figuruje jako ciasteczko analityczne, nie marketingowe. Klasyfikacja robi robotę. Każdy rozszyfrowany token w badaniu niósł wpis analytics_allowed, również wtedy, gdy użytkownik odmówił zgody marketingowej. Badacz wysłał 14 września dwa pytania na adresy prasowy i prywatnościowy OpenAI: dlaczego __obi jest klasyfikowane jako analityka i czy odmowa zgody marketingowej faktycznie je wyłącza. Support przyjął zgłoszenie, obiecał przekazać je do wewnętrznego przeglądu i na oba pytania nie odpowiedział.

Piksel nie miał premiery, bo OpenAI nigdy go nie ogłosiło. Branża dowiedziała się o nim w kwietniu z analizy kodu, a AdExchanger pisał wtedy, że narzędzia pomiaru konwersji są już testowane przez reklamodawców w pilocie reklam ChatGPT. Buchodi porównuje cały mechanizm do tego, co Meta zbudowała lata temu, z jedną różnicą podaną wprost: „Mechanizm jest standardowym adtechem. Bez precedensu jest uruchomienie go na produkcie czatowym AI.”

Jak to zatrzymać

Najprostsza odpowiedź siedzi w przeglądarce:

  • Safari na macOS i iOS oraz Firefox blokują ciasteczka stron trzecich domyślnie, więc __obi nie ma jak wyjść z chatgpt.com;
  • w Chrome na Androidzie i desktopie trzeba to ustawić ręcznie: ustawienia prywatności albo lista zablokowanych witryn z domeną openai.com;
  • aplikacja ChatGPT na iPhone’ie omija sprawę z definicji, bo nie używa ciasteczek przeglądarkowych.

Na odmowę zgody analitycznej bym nie liczył. Badanie pokazuje, że tokeny powstawały mimo odmowy zgody marketingowej, a pytanie o granice zgody analitycznej zostało u OpenAI bez odpowiedzi.

Co z tego dla Polski

Konta używane z Polski działają w tym mechanizmie tak samo jak amerykańskie, ale lista hostów w badaniu to serwisy anglojęzyczne i nic nie wskazuje, żeby polskie sklepy już kupowały reklamy w ChatGPT. Polskiej wersji tej historii nie znalazłem: opracowań po polsku brak, a popyt właśnie się buduje, fraza „czy chatgpt śledzi” i „reklamy w chatgpt” wiszą już w podpowiedziach Google.

Zostało pytanie prawne, na które odpowiedzą regulatorzy, nie ja: czy ciasteczko klasyfikowane jako analityczne, wysyłane mimo odmowy zgody marketingowej, spina się z wymogami RODO. Badacz tego nie rozstrzyga; przedkłada dane i czeka na odpowiedź OpenAI.

Źródła

  1. Buchodi, „ChatGPT now knows what you do on other websites via ad collector”, 20.09.2026, buchodi.com
  2. Cyber Security News, „ChatGPT Ad Tracking Cookie Follows Users Across Third-Party Advertiser Websites”, 21.09.2026, cybersecuritynews.com
  3. AdExchanger, „The OpenAI Pixel Has Landed; Amazon’s Credit Card Ban Triggers an Ad Boycott”, 17.04.2026, adexchanger.com
  4. Dyskusja pod analizą na Hacker News, wrzesień 2026, news.ycombinator.com

Powiązane artykuły