När en grundad AI-modell besvarar en fråga om ett varumärke anger den sina källor. Vi samlade in dessa citeringar i stor skala: 167 551 URL-grundade citeringar (189 974 attributionsrader) över 128 varumärken, 13 språk och 12 hemmamarknader, från GPT, Gemini och Perplexity med aktiv webbsökning påslagen.
Datasetet slår samman tre Rankfor-studier till ett enda citeringskorpus, löser upp Googles grundningsomdirigeringar tillbaka till de verkliga utgivarna och taggar varje citering med dess domän, källtyp, språk och modell. Det är öppet under CC-BY-4.0: doi.org/10.5281/zenodo.20829524.
Här är vad det visar.
85,7 % av ditt AI-rykte skrivs av någon annan
Över hela korpuset grundar AI sina varumärkessvar i tredjepartskällor 85,7 % av tiden. Varumärkets egen webbplats står för 14,3 %.
Läs det mot hur marknadsföringsbudgetar fördelas. De flesta varumärkesteam lägger merparten av sina innehållspengar på de 14,3 % de kontrollerar och behandlar de 85,7 % som PR-avdelningens problem. Modellerna gör tvärtom: när de behöver beskriva dig citerar de i överväldigande grad sidor du aldrig skrev.
18 % av domänerna bär 80 % av citeringarna
Citeringsvolymen följer en potenslag: ungefär 18 % av domänerna står för 80 % av alla citeringar (Zipf alpha 0,86, R² 0,983). Grundningswebben är en liten klubb. Ett varumärke som får sig självt korrekt beskrivet på några dussin högfrekventa domäner har täckt det mesta av vad AI någonsin kommer att citera om det.
Vilka domäner? Wikipedia är den mest citerade domänen på 11 av de 12 språken. Undantaget är litauiska, där affärstidningen vz.lt går om den. Om din närvaro på Wikipedia är tunn eller felaktig, är den tunn eller felaktig på nästan alla språk samtidigt.
Polen går på andra spår
Polen är korpusets avvikande marknad. Den mest citerade domänen för polska varumärkessvar är YouTube, och fyra HR- och karriärportaler citeras tillsammans ungefär dubbelt så ofta som polska Wikipedia. AI som beskriver ett polskt varumärke citerar dess jobbannonser och arbetsgivarrecensioner lättare än dess uppslagsverksartikel. Vi går igenom det fyndet i studien om jobbportaler.
Lärdomen går att generalisera: grundningsprofiler är marknadsspecifika. Domänlistan som styr ditt rykte i Tyskland är en annan lista i Polen, och ingen granskar den andra.
Modellerna citerar också olika
Perplexity är korpusets citerare med högst volym och anger fler källor per svar än GPT eller Gemini. Det gör den till den enklaste modellen att påverka genom bredd (var närvarande på många domäner), medan de mer sparsamma citerarna belönar djup (var den bästa källan på de få domäner de litar på).
Vad du ska göra med det här
Tre drag följer direkt av datan:
- Granska de 85,7 %. Lista de domäner som AI faktiskt citerar om din kategori (datasetet innehåller domäntabellerna per språk) och kontrollera vad de säger om dig. Våra Index-varumärkessidor visar varje uppmätt varumärkes främsta citeringsdomäner.
- Rätta till Wikipedia och det lokala undantaget. En korrekt, välkällad Wikipedia-artikel täcker grundning på 11 språk samtidigt. Hitta sedan din marknads vz.lt.
- Behandla högfrekventa domäner som distributionspartner. När 80 % av citeringarna flödar genom 18 % av domänerna flyttar två eller tre placeringar på rätt domäner fler AI-svar än femtio blogginlägg på din egen webbplats.
Hela datasetet, analysloggen och ett reproduktionsskript finns i Zenodo-posten: 10.5281/zenodo.20829524. För den kompletterande frågan, vad AI vet om varumärken som det inte kan citera alls, se vår studie om källopacitet, där 70,2 % av varumärkeskunskapen spårades till ingen källa.
