Kiedy ugruntowany model AI odpowiada na pytanie o markę, podaje swoje źródła. Zebraliśmy te cytowania na dużą skalę: 167 551 cytowań ugruntowanych w adresach URL (189 974 wiersze atrybucji) dla 128 marek, 13 języków i 12 rynków macierzystych, pochodzących z GPT, Gemini i Perplexity z włączonym wyszukiwaniem na żywo w sieci.
Zbiór danych łączy trzy badania Rankfor w jeden korpus cytowań, rozwiązuje przekierowania ugruntowujące Google z powrotem do rzeczywistych wydawców i oznacza każde cytowanie jego domeną, typem źródła, językiem i modelem. Jest dostępny otwarcie na licencji CC-BY-4.0: doi.org/10.5281/zenodo.20829524.
Oto co z niego wynika.
85,7% Twojej reputacji w AI pisze ktoś inny
W całym korpusie AI opiera odpowiedzi o markach na źródłach zewnętrznych w 85,7% przypadków. Własna witryna marki odpowiada za 14,3%.
Zestaw to z tym, jak dzielone są budżety marketingowe. Większość zespołów odpowiedzialnych za markę wydaje większość pieniędzy na treści na te 14,3%, które kontrolują, a pozostałe 85,7% traktuje jako problem działu PR. Modele robią to odwrotnie: kiedy muszą Cię opisać, w przeważającej mierze cytują strony, których nigdy nie napisałeś.
18% domen niesie 80% cytowań
Wolumen cytowań podąża za rozkładem potęgowym: około 18% domen odpowiada za 80% wszystkich cytowań (Zipf alfa 0,86, R² 0,983). Sieć ugruntowująca to wąskie grono. Marka, która zadba o to, by opisano ją poprawnie na kilkudziesięciu domenach o wysokiej częstotliwości, pokryła większość tego, co AI kiedykolwiek o niej zacytuje.
Które domeny? Wikipedia jest najczęściej cytowaną domeną w 11 z 12 języków. Wyjątkiem jest litewski, gdzie dziennik biznesowy vz.lt wyprzedza ją w rankingu. Jeśli Twoja obecność w Wikipedii jest uboga lub błędna, jest uboga lub błędna niemal we wszystkich językach naraz.
Polska jedzie po innych torach
Polska to rynek odstający od reszty korpusu. Najczęściej cytowaną domeną w polskich odpowiedziach o markach jest YouTube, a cztery portale HR i rekrutacyjne razem cytowane są mniej więcej dwa razy częściej niż polska Wikipedia. AI opisujące polską markę chętniej cytuje jej ogłoszenia o pracę i strony z opiniami pracowników niż hasło encyklopedyczne. Rozkładamy ten wniosek na czynniki pierwsze w badaniu o portalach z ofertami pracy.
Wniosek ma szerszy wymiar: profile ugruntowania są specyficzne dla rynku. Lista domen, która kontroluje Twoją reputację w Niemczech, to inna lista w Polsce, a tej drugiej nikt nie audytuje.
Modele cytują też inaczej
Perplexity to model o najwyższym wolumenie cytowań w korpusie, przywołujący więcej źródeł na odpowiedź niż GPT czy Gemini. To czyni go modelem, na który najłatwiej wpłynąć poprzez zasięg (bądź obecny na wielu domenach), podczas gdy modele cytujące oszczędniej nagradzają głębię (bądź najlepszym źródłem na tych nielicznych domenach, którym ufają).
Co z tym zrobić
Trzy ruchy wynikają wprost z danych:
- Zaudytuj te 85,7%. Wypisz domeny, które AI faktycznie cytuje w Twojej kategorii (zbiór danych zawiera tabele domen w podziale na języki) i sprawdź, co mówią o Tobie. Nasze strony marek w Index pokazują najczęstsze domeny cytowań dla każdej zmierzonej marki.
- Napraw Wikipedię i lokalny wyjątek. Jeden poprawny, dobrze udokumentowany artykuł w Wikipedii pokrywa ugruntowanie w 11 językach naraz. Potem znajdź vz.lt swojego rynku.
- Traktuj domeny o wysokiej częstotliwości jak partnerów dystrybucyjnych. Skoro 80% cytowań płynie przez 18% domen, dwie lub trzy publikacje na tych właściwych poruszają więcej odpowiedzi AI niż pięćdziesiąt wpisów na blogu w Twojej własnej witrynie.
Pełny zbiór danych, rejestr analiz i skrypt do odtworzenia wyników znajdziesz w rekordzie Zenodo: 10.5281/zenodo.20829524. Odpowiedź na pytanie towarzyszące, czyli co AI wie o markach, choć nie potrafi tego w ogóle zacytować, znajdziesz w naszym badaniu o nieprzejrzystości źródeł, gdzie 70,2% wiedzy o markach nie dało się powiązać z żadnym źródłem.
