En markedsforsker hos Ahrefs skapte et fullstendig fiktivt luksusfirma for brevvekter kalt Xarumei. Han bygde nettsiden på en time ved hjelp av AI, og testet systematisk åtte store AI-verktøy med 56 spørsmål.
Resultatene viser målbare svakheter i hvordan AI håndterer informasjon om merkevarer - med direkte konsekvenser for omdømmehåndtering (ORM) online.
Eksperimentet
GPT-4 og GPT-5 klarte seg best, og svarte oftest at “dette merket eksisterer ikke”. Perplexity feilet i ca 40% av tilfellene, og forvekslet ofte Xarumei med Xiaomi. Microsoft Copilot falt i “smigrer-fellen”: Da den ble spurt om hvorfor merket var så populært på Twitter, diktet den opp forklaringer om utsøkt håndverk, i stedet for å sjekke om det faktisk var populært.
Fase to: kontrollert kaos
Forskeren plantet motstridende informasjon:
- Offisiell FAQ: Benektet rykter.
- Medium-artikkel og Reddit: Påsto at grunnleggeren var Jennifer Lawson fra Portland.
Medium viste seg å være spesielt overbevisende. Modellene (Gemini, Grok) valgte å stole på Medium-artikkelen fremfor den offisielle nettsiden, fordi artikkelen virket mer “journalistisk” og troverdig.
Konklusjon
Store språkmodeller (LLM) “glemmer” å være skeptiske. Hvis de finner en kilde som ser troverdig ut (som en detaljert Medium-artikkel med falske kilder), overskriver den tidligere kunnskap om at merket ikke finnes.
Anbefalinger for merkevarer
- Skriv en detaljert FAQ: Si eksplisitt hva som er sant og usant der rykter finnes.
- Lukk informasjonsgap: La ikke tomrom stå - AI fyller dem med Reddit-kommentarer.
- Overvåk sidekanaler: Reddit, Medium og Quora er del av merkevarens sentrale flater.
- Foretrekk konkrete påstander: Gi tall i stedet for vage “bransjeledende”-formuleringer.
For norske merkevarer er også Forbrukertilsynet-saker og Digdir-veiledning relevante signaler: modeller plukker gjerne opp konkrete tall fra offentlige klagesaker når FAQ er vag om organisasjonsnummer, adresse eller eierstruktur i Brønnøysundregistrene.
Oppfølging: fra syntetiske merker til first-party-måling
Xarumei handler om hva modellene finner på. På et ekte merke måler vi hva de faktisk henter: i 90-dagers serien for AI-sitasjonssporing (Geoboard-baseline 2026-06-11) lå wppoland.com først i fem av seks modeller på identitet, og på null på transaksjonelle Woo-prompts. Hvorfor Perplexity og ChatGPT divergerer, står i hvorfor Perplexity siterer merkevaren din, men ChatGPT ikke.
Kilder
- Patrick Stox (Ahrefs): “I Created A Fake Luxury Brand To Test How AI Handles Truth” (ahrefs.com/blog/ai-test-fake-brand/).
- Marius Comper (Facebook): Post om eksperimentet.





