Når en grounded AI-model besvarer et spørgsmål om et brand, angiver den sine kilder. Vi indsamlede disse kildehenvisninger i stor skala: 167.551 URL-grounded kildehenvisninger (189.974 attributionsrækker) på tværs af 128 brands, 13 sprog og 12 hjemmemarkeder, fra GPT, Gemini og Perplexity med live websøgning slået til.
Datasættet samler tre Rankfor-studier i ét kildehenvisningskorpus, opløser Googles grounding-redirectors tilbage til de rigtige udgivere og mærker hver kildehenvisning med dens domæne, kildetype, sprog og model. Det er åbent under CC-BY-4.0: doi.org/10.5281/zenodo.20829524.
Her er, hvad det viser.
85,7 % af dit AI-omdømme er skrevet af andre
På tværs af hele korpusset grounder AI brandsvar i tredjepartskilder 85,7 % af tiden. Brandets eget website står for 14,3 %.
Hold det op mod, hvordan marketingbudgetter fordeles. De fleste brandteams bruger størstedelen af deres indholdspenge på de 14,3 %, de kontrollerer, og behandler de 85,7 % som PR-afdelingens problem. Modellerne gør det omvendt: når de skal beskrive dig, citerer de overvældende ofte sider, du aldrig har skrevet.
18 % af domænerne bærer 80 % af kildehenvisningerne
Kildehenvisningsvolumen følger en potenslov: cirka 18 % af domænerne står for 80 % af alle kildehenvisninger (Zipf alpha 0,86, R² 0,983). Grounding-webbet er en lille klub. Et brand, der får sig selv beskrevet korrekt på nogle få dusin højfrekvente domæner, har dækket det meste af, hvad AI nogensinde vil citere om det.
Hvilke domæner? Wikipedia er det mest citerede domæne på 11 af de 12 sprog. Undtagelsen er litauisk, hvor erhvervsdagbladet vz.lt rangerer højere. Hvis din tilstedeværelse på Wikipedia er tynd eller forkert, er den tynd eller forkert på næsten alle sprog på én gang.
Polen kører på andre skinner
Polen er korpussets afvigende marked. Det mest citerede domæne for polske brandsvar er YouTube, og fire HR- og karriereportaler citeres tilsammen omkring dobbelt så ofte som polsk Wikipedia. AI, der beskriver et polsk brand, citerer dets jobopslag og sider med medarbejderanmeldelser mere villigt end dets encyklopædiopslag. Vi udfolder den konklusion i studiet om jobportaler.
Læren gælder generelt: grounding-profiler er markedsspecifikke. Domænelisten, der styrer dit omdømme i Tyskland, er en anden liste i Polen, og ingen auditerer den anden.
Modellerne citerer også forskelligt
Perplexity er den model, der citerer mest volumen i korpusset, og henter flere kilder pr. svar end GPT eller Gemini. Det gør den til den model, der er lettest at påvirke gennem bredde (vær til stede på mange domæner), mens de mere sparsomme citatorer belønner dybde (vær den bedste kilde på de få domæner, de stoler på).
Hvad du skal gøre med det her
Tre træk følger direkte af dataene:
- Auditér de 85,7 %. Kortlæg de domæner, AI faktisk citerer om din kategori (datasættet indeholder domænetabellerne pr. sprog), og tjek, hvad de siger om dig. Vores Index-brandsider viser hvert målt brands mest citerede kildehenvisningsdomæner.
- Ret Wikipedia og den lokale undtagelse. Én korrekt, velkildeangivet Wikipedia-artikel dækker 11 sprogs grounding på én gang. Find så dit markeds vz.lt.
- Behandl højfrekvente domæner som distributionspartnere. Med 80 % af kildehenvisningerne flydende gennem 18 % af domænerne flytter to eller tre placeringer på de rigtige flere AI-svar end halvtreds blogindlæg på dit eget site.
Hele datasættet, analyseledgeren og et reproduktionsscript ligger i Zenodo-posten: 10.5281/zenodo.20829524. For det beslægtede spørgsmål, hvad AI ved om brands, som den slet ikke kan citere, se vores studie om kildeopacitet, hvor 70,2 % af brandviden ikke kunne spores til nogen kilde.
