Czy to pierwszy „Citation Core Update”? Jak jedna zmiana przemodelowała cytowania w ChatGPT
Synteza czterech niezależnych źródeł danych z lipca i sierpnia 2026: DecaGEO, Peec AI, Promptwatch oraz własnych testów dostępności robots.txt.

Myślę, że można zacząć powoli mówić o czymś takim jak „Citation Core Update” . Między 25 lipca, a 14 sierpnia 2026 roku doszło do pewnych całkiem dużych zmian, ponieważ to seria powiązanych zmian w jaki ChatGPT wyszukuje i cytuje informacje. Zmiana wywołana kolejnymi wersjami modelu (GPT-5.6 w wariantach Terra i Luna). Efekt taki, że strony jak Reddit, arXiv, YouTube, listy porównawcze straciły od 80 do 90% cytowań w ChatGPT w ciągu 3 tygodni, podczas gdy strony producentów (product, pricing, feature pages) przejęły całą pozostałą przestrzeń.
Mamy tu 4 niezależne pomiary, na 3 różnych warstwach pomiarowych i wszystkie potwierdzają ten sam kierunek. Jednocześnie ten sam okres obnażył jak niebezpieczne jest wyciąganie trwałych wniosków strategicznych z danych sprzed jednego wdrożenia modelu.
Droga do Citation Core Update
| Data | Wydarzenie | Źródło |
|---|---|---|
| Maj 2026 | Semrush/The Verge: Reddit najczęściej cytowaną domeną w ChatGPT, Perplexity, Gemini, Google AI Mode) | Semrush via The Verge |
| Lipiec 2026 | Ahrefs Brand Radar: Reddit z 19,9% udziału w cytowaniach Google AI Mode w USA – pozycja lidera | Ahrefs |
| 11-18 lipca 2026 | GPT-5.4 w API: site: w 34-38% zapytań fan-out12-12,5 cytowań na odpowiedź udział domen producenckich ~94,6% | DecaGEO |
| 18 lipca – 7 sierpnia | Reddit stabilnie na poziomie 3,8% udziału cytowań w ChatGPT Search | Promptwatch |
| 23 lipca 2026 | OpenAI wycofuje GPT-5.4 z produkcji | DecaGEO |
| 25 lipca 2026 | Pipeline DecaGEO (API, tier Terra) przechodzi na GPT-5.6: site: skacze z 38% do 90,5%cytowania na odpowiedź spadają z 12,5 do 6,3 udział third-party (recenzje, prasa, community) spada z 1,9% do 0,3% | DecaGEO |
| 7 sierpnia 2026 | Jaxon Parrott publikuje artykuł ogłaszający Reddit jako „najczęściej cytowaną domenę w AI-search” na podstawie danych sprzed rolloutu | Authority Tech |
| 8 sierpnia 2026 | GPT-5.6 Luna staje się domyślnym modelem ChatGPT dla użytkowników Free i Go Tego samego dnia: fetch Reddita w ChatGPT spada o 63%, udział cytowań zaczyna zjeżdżać z „wysokich 3%” do „średnich 2%” | Promptwatch, Tomek Rudzki |
| 8-17 sierpnia 2026 | DecaGEO (tier Terra) potwierdza stabilność nowego reżimu: site: na poziomie 90-91% przez kolejny tydzień, powtarzalność wzorca w dziesięciu kategoriach B2B | DecaGEO |
| 10 sierpnia 2026 | David Konitzny (Peec AI, konsumencki ChatGPT, tier Luna) publikuje niezależną analizę: liczba iteracji fan-outu rośnie drastycznie (jednokrokowe wyszukiwanie spada z 94% do 43,5% promptów) liczba pobieranych źródeł podwaja się (12→24), product pages wyprzedzają listy/rankingi jako najczęściej pobierany typ strony | David Konitzny, Peec AI |
| 14 sierpnia 2026 | Udział Reddita w cytowaniach ChatGPT zapada się poniżej 1% (średnia 0,52% w kolejne cztery dni) – spadek o 86% względem poziomu z lipca Google AI Overviews i AI Mode notują w tym samym czasie jedynie łagodny, ciągły spadek (-11% i -30% w skali miesiąca, bez uskoku) | Promptwatch |
| 18-20 sierpnia 2026 | Tomek Rudzki potwierdza dziesięciodniowy bilans rolloutu: Reddit -88% arXiv -84% YouTube -78% jednocześnie brak analogicznego spadku w Google AI Overviews, AI Mode, Perplexity i Grok | Tomek Rudzki |
Rozpiętość dat – 25 lipca (Terra, API) i 8 sierpnia (Luna, konsument) – to dwa zdarzenia tego samego wdrożenia dotykające różnych grup użytkowników w różnym tempie. Rollout modelu w produktach Open AI jest serią etapowych wdrożeń na różne tiery i segmenty użytkowników
Model nie odkrywa, tylko sprawdza – i sprawdza inaczej
DecaGEO policzyło na własnych logach wywołań narzędzi, że czyste zapytania odkrywcze – bez podanej nazwy marki, w rodzaju „najlepsze narzędzia CRM” – stanowiły mniej niż pół procenta zapytań fan-out i dotyczy to GPT-5.4 i GPT-5.6. Model przychodzi do wyszukiwania z gotową listą marek wyciągniętą z pamięci parametrycznej i używa zapytań wyłącznie do weryfikacji: ceny, limitów planu, listy funkcji.
Zmieniła się tylko trasa jaką model idzie, żeby potwierdzić marki, a sama lista marek, nie zmieniła się między wersjami modelu.
Na GPT-5.4 trasa była mieszana:
- model pytał o markę po nazwie na otwartym webie w dwóch trzecich przypadków, a operatora
site:używał w jednej trzeciej - na GPT-5.6 operator
site:stał się domyślną trasą w dziewięciu na dziesięć zapytań
Skoro zapytanie brzmi site:jakaś-domena.pl cena, to model z definicji nie ma okazji trafić na wątek na Reddicie ani na artykuł porównawczy na jakimś blogu.
David Konitzny dorzuca eksplozję liczby iteracji wyszukiwania, a ten sam element nie był widoczny w danych DecaGEO:
- Na GPT-5.5 pojedyncze wyszukanie wystarczało w 94% promptów
- Na GPT-5.6 odsetek promptów kończących się na jednej iteracji spadł do 43,5%, a udział promptów wymagających sześciu i więcej iteracji, wcześniej praktycznie nieistniejący, sięgnął 7,2%
Model szerzej bada, bo średnia liczba pobranych źródeł podwoiła się z 12 do 24 na prompt, ale filtruje mocniej na wyjściu. DecaGEO odnotowuje spadek liczby cytowań na odpowiedź z 12,5 do 6,3. Więcej materiału wchodzi na wejściu, mniej wychodzi na końcu.
Ten sam kierunek w 4 niezależnych pomiarach
Siła tego materiału leży w zbieżności kilku zespołów mierzących różne rzeczy, w różnym czasie, różnymi metodami, którzy dochodzą do tego samego wniosku:
- DecaGEO (API OpenAI, tier Terra, 10 kategorii B2B, dane od 25 lipca):
site:z 38% do 90%, cytowania na odpowiedź o połowę mniejsze, udział domen producenckich rośnie z 94,6% do 97,4%. - David Konitzny (konsumencki ChatGPT, tier Luna, dane od 8-10 sierpnia):
site:z 0,3% do 23%, liczba iteracji fan-out rośnie kilkukrotnie, product pages wyprzedzają listicle’e (+119% w ujęciu bezwzględnym dla stron produktowych, -9,8% dla listicle’i). - Promptwatch (dzienny tracking domen w czterech silnikach, dane od lipca do sierpnia): Reddit spada z 3,8% do 0,5% udziału cytowań w ChatGPT w ciągu jednego tygodnia, przy dużo łagodniejszym spadku w Google AI Overviews i AI Mode.
- Tomek Rudzki (dziesięciodniowy bilans rolloutu): Reddit -88%, arXiv -84%, YouTube -78% cytowań; fetch Reddita jako kandydata na źródło spada o 63% niezależnie od tego, czy ostatecznie zostaje zacytowany.
Rozbieżności w wielkościach liczbowych (23% u Davida Konitznego kontra 90% u DecaGEO) są efektem mierzenia różnych wdrożeń tego samego modelu (Luna vs Terra) na różnych populacjach użytkowników. Kierunek jest identyczny we wszystkich 4 przypadkach, co czyni to zjawisko czymś więcej niż anomalią jednego narzędzia pomiarowego.
Ofiary aktualizacji, czyli kto i dlaczego stracił
Reddit, arXiv, YouTube
Trzy domeny, które przed 8 sierpnia budowały sporą część widoczności w ChatGPT, straciły od 78% do 88% cytowań w ciągu 9 dni od wdrożenia GPT-5.6 Luna. Mechanizm jest ten sam co opisany wyżej:
- żadna z tych domen nie jest celem zapytań typu
site:, bo żadna z nich nie jest domeną producenta, którego model akurat chce zweryfikować
Tomek Rudzki wskazuje, że spadek dotyczy fazy pobierania, a nie samego etapu doboru cytowań z już pobranego materiału. Reddit jest rzadziej w ogóle brany pod uwagę jeszcze przed tym zanim dojdzie do decyzji, czy go zacytować.
Listy porównawcze
David Konitzny dostarcza dowód odporny na najczęstszy błąd metodologiczny tego typu analiz – myli udziału procentowego z liczbą bezwzględną. Skoro całkowita liczba pobieranych stron na prompt podwoiła się, to spadek udziału procentowego danej kategorii może być czystym artefaktem powiększenia mianownika, a nie realnym spadkiem częstości. David Konitzny autor demonstruje to na przykładzie słowa „best” w zapytaniach, którego udział spadł z 20% do 10%, mimo że liczba bezwzględna wystąpień pozostała praktycznie stała. Listy są jednak wyjątkiem, bo ich udział ORAZ liczba bezwzględna pobrań spadają jednocześnie (-9,8% w ujęciu bezwzględnym), w tym samym czasie strony produktowe rosną o 119%. To jedyny kierunek w całym zestawie danych, który nie da się wytłumaczyć samym powiększeniem puli wyszukiwania.
Trzecia strona ogółem, w liczbach DecaGEO
W kategoriach B2B śledzonych przez DecaGEO udział recenzji i społeczności w cytowaniach spadł z 1,9% do 0,3% między wersjami modelu. Sami autorzy zastrzegają, że w liczbach bezwzględnych to garstka cytowań w próbie o wysokim nasyceniu domenami producenckimi ale to dokładnie ta garstka, której zniknięcie zauważa każdy dashboard śledzący widoczność poza własną domeną.
Problem dotyka ChatGPT, a nie AI-search
Cała sprawa dotyczy konkretnie ChatGPT, a nie AI-search w ogóle. Promptwatch mierzy Reddita równolegle w trzech silnikach i widzi trzy zupełnie różne krzywe:
- ChatGPT: uskok o 86% w ciągu jednego tygodnia, precyzyjnie datowany na 14 sierpnia
- Google AI Overviews: łagodny, ciągły spadek o 11% w skali miesiąca, bez punktu przełomowego
- Google AI Mode: łagodny spadek o 30% w skali miesiąca, z najwyraźniejszym „stopniem” pod koniec lipca
Tomek Rudzki potwierdza to samo z drugiej strony. Widoczność Reddita w Google AI Overviews, AI Mode, Perplexity i Grok pozostaje niezmieniona w tym samym oknie czasowym, w którym ChatGPT traci 90% cytowań tej domeny.
Ewidentnie jest to decyzja po stronie OpenAI i konkretnego modelu. W takim razie trzeba mierzyć per silnik, a najlepiej per wersja modelu w obrębie tego samego silnika.
Uwaga: dlaczego dane o Redditcie się nie zgadzają
Zestawiając liczby o udziale Reddita w cytowaniach z różnych źródeł, widać rozrzut rzędu dziesięciokrotnego dla tego samego silnika w podobnym okresie:
| Źródło | Silnik | Udział Reddita |
|---|---|---|
| Promptwatch (lipiec, przed spadkiem) | ChatGPT | 3,8% |
| Discovered Labs (cyt. przez Jaxon Parrott) | ChatGPT | 27% |
| Ahrefs Brand Radar | Google AI Mode | 19,9% |
| Promptwatch | Google AI Mode | ~1,5-2,2% |
| Semrush (cyt. przez Jaxon Parrott) | Google AI Overviews | 21% |
| Promptwatch | Google AI Overviews | ~2,1-2,4% |
| Semrush (cyt. przez Jaxon Parrott) | Perplexity | 46,7% |
Najbardziej prawdopodobnym wyjaśnieniem są różnice w metodzie liczenia. Ahrefs liczy „udział wzmianek” jako procent sumy cytowań ograniczonej do listy najczęściej pojawiających się domen (top 50), co sztucznie zawyża pozycję liderów w porównaniu z pomiarem „procent wszystkich cytowań wszystkich domen bez ograniczeń” (jak robi to Promptwatch). Dodatkowo dobór zestawu zapytań ma ogromne znaczenie. Na przykładzie DecaGEO, wprost pokazują na własnym przykładzie, że wąska, komercyjna próba B2B daje zupełnie inną ekonomię cytowań pierwszej i trzeciej strony niż szeroka próba informacyjna.
Wniosek: liczby w rodzaju „Reddit ma X% cytowań w AI-search” krążące w branży nie są ze sobą porównywalne, mimo że są tak podawane. Część mitu o „dominacji Reddita w AI-search” jest realna, część jest artefaktem metody liczenia – i te 2 elementy trzeba rozdzielać przy każdej takiej analizie.
Case study: artykuł, który zdezaktualizował się w tydzień
7 sierpnia 2026 roku – dosłownie dzień przed pierwszymi sygnałami spadku Reddita w ChatGPT – ukazał się obszerny artykuł ogłaszający jakoby Reddit był „najczęściej cytowaną domeną w AI-search” i budujący na tej podstawie pięcioetapową strategię content-marketingową. Tekst opierał się na rzetelnych, aktualnych na moment publikacji danych z maja i lipca. Tydzień później już nie był aktualny.
Nie krytykuję rzetelności autora, bo dane, na których się opierał, były w momencie ich zbierania jak najbardziej poprawne. Natomiast to dowód reguły, którą postawiło DecaGEO na własny użytek:
- zmiana wersji modelu jest zmianą pomiaru, a nie zmianą rzeczywistości opisywanej treści
Tyle że tutaj konsekwencją jest dezaktualizacja publicznej narracji strategiczne. Rekomendacja „bądź lepszym źródłem niż wątek na Reddicie” jest cały czas słuszna.
Dlaczego robots.txt nie tłumaczy tego, co się stało
Osobny wątek, który trzeba rozłączyć od mechanizmu opisanego wyżej, dotyczy dostępności treści Reddita dla botów AI. Ponownie przeprowadziłem testy na pliku robots.txt Reddit i nic sie nie zmieniło od 2024 roku – Reddit stosuje cloaking na robots.txt i dostęp do tej platformy mają tylko podmioty należące do białej listy:
- Google i OpenAI (obaj mają płatne umowy licencyjne, ujawnione w wynikach finansowych Reddita za drugi kwartał 2026 – ok. 60 mln USD rocznie od Google, podobna relacja z OpenAI)
- Cała reszta dostaje
Disallow: /w tym Common Crawl, Anthropic i Perplexity
To tłumaczy trwale niższą i bardziej stabilną obecność Reddita w silnikach niekorzystających z jego danych na licencji (Claude, Common Crawl) i jednocześnie nie tłumaczy sierpniowego załamania w ChatGPT, ponieważ OpenAI ma pełny, płatny dostęp i żadna blokada go nie ograniczała przed, ani po 8 sierpnia.
Zagadka Perplexity
Perplexity – mimo blokady w robots.txt – miałoby cytować Reddit na poziomie 46,7% według danych cytowanych przez Jaxona Parrotta. Najbardziej prawdopodobne wyjaśnienie: silniki AI-search nie zawsze pobierają treść własnym botem w czasie rzeczywistym, tylko korzystają z cudzego indeksu wyszukiwania (własnego lub zewnętrznego), a robots.txt blokuje bezpośredni crawl, niekoniecznie pojawianie się adresu URL jako wyniku w cudzym indeksie. To rozdziela dwie różne bramki dostępu – dostęp treningowy/pełny crawl (regulowany umowami i robots.txt) oraz dostęp cytowalny w czasie rzeczywistym (może iść inną drogą) – które łatwo pomylić przy powierzchownej analizie.
Co z tego wynika
To co mierzymy jako „widoczność w AI” jest w rzeczywistości migawką 1 konkretnej wersji i 1 konkretnego modelu. Artykuł Jaxona Parrotta, opublikowany dzień przed pierwszymi sygnałami załamania Reddita w ChatGPT, jest tego najlepszym dowodem. Jego dane były aktualne i rzetelne w momencie zbierania i publikacji. Następnie w ciągu dnia zostały zdezaktualizowane. Strategie AI-search oparte na pojedynczym pomiarze, bez wskazania wersji modelu i daty, mają w tej rzeczywistości żywotność liczoną w dniach i ewentualnie tygodniach, a nie w kwartałach.
Dążę do tego, że spadek w ChatGPT jest decyzją OpenAI, dlatego zastosowałem rzuciłem hasłem „CITATION CORE UPDATE„, jako analogię do Google’owskich Core Update, które równie mocno potrafią zrobić rollout.
Bibliografia:
- Promptwatch – Reddit Citations Are Dropping in ChatGPT
- DecaGEO – ChatGPT’s site: Searches Jumped From 38% to 90%. Its Citations Barely Moved.
- Post Tomka Rudzkiego na LinkedIn
- David Konitzny – ChatGPT’s New Default Model GPT-5.6: More Retrieval, More Fan-Outs, More First-Party Content
- AuthorityTech – Reddit Is the Most-Cited Domain in AI Search. Here Is What That Means for Your Brand.
