Hur verifierbara är AI-svaren? Studien om citatens stöd i generativ sökning
Att en AI-motor citerar er sajt är ingen garanti för att den återger er rätt. I Stanford-studien om generativa sökmotorers verifierbarhet var bara 51,5 % av svarens meningar helt stödda av sina citat — och i snitt stödde 74,5 % av citaten den mening de hängde på (Liu, Zhang & Liang, Findings of EMNLP 2023).
Det gör själva citatet till en egen riskzon. Motorn kan peka på er källa och ändå formulera en slutsats som källan inte täcker — och för den som läser svaret är det motorns mening som gäller, inte er. Citatfunktionerna finns för att lösa ett förtroendeproblem, men en källlista under svaret löser inget om texten ovanför inte stämmer med listan.
Här går vi igenom vad studien mätte, hur de fyra motorerna skilde sig åt, varför gapet mellan att citera och att stödja uppstår — och vad du gör för att bli den källa som är svår att misscitera. Behöver du sammanhanget först: börja med vad GEO är eller hur GEO skiljer sig från SEO.
Vad mätte Stanford-studien egentligen?
Studien ”Evaluating Verifiability in Generative Search Engines” testade fyra då aktuella motorer — Bing Chat, NeevaAI, Perplexity.ai och YouChat — med 1 450 frågor per system, tagna bland annat från historiska Google-sökfrågor och öppna Reddit-frågor. Mänskliga bedömare granskade svaren utifrån två mått (arXiv:2304.09848):
- Citation recall — är meningen fullt stödd av de citat som anges? Saknas stöd i källan är påståendet overifierat, även om det låter rimligt.
- Citation precision — stödjer citatet faktiskt sin mening? En källa som handlar om ämnet men inte om påståendet räknas inte.
Författarnas poäng är att verifierbarhet kräver båda samtidigt: ett svar som citerar brett men stödjer slarvigt är minst lika opålitligt som ett som citerar snålt men stödjer varje ord.
Hur ofta stämmer AI:s citat?
I snitt över de fyra motorerna var 51,5 % av meningarna fullt stödda av sina citat, och 74,5 % av citaten stödde sin mening — alltså stödde runt var fjärde citat inte den mening det hängde på. Spridningen mellan motorerna var dock stor:
| Motor (2023) | Helt stödda meningar (recall) | Citat som stödjer meningen (precision) |
|---|---|---|
| Bing Chat | 58,7 % | 89,5 %Liu m.fl., tabell 7–8 · arXiv:2304.09848 |
| NeevaAI | 67,6 % | 72,0 %Liu m.fl., tabell 7–8 · arXiv:2304.09848 |
| Perplexity.ai | 68,7 % | 72,7 %Liu m.fl., tabell 7–8 · arXiv:2304.09848 |
| YouChat | 11,1 % | 63,6 %Liu m.fl., tabell 7–8 · arXiv:2304.09848 |
| Snitt över motorerna | 51,5 % | 74,5 %Liu m.fl., abstract · Findings of EMNLP 2023 |
YouChat stack ut negativt: bara 11,1 % av dess meningar var fullt stödda av sina källor. Och snittet är värt att läsa långsamt — drygt hälften av allt motorerna sa gick inte att belägga i de källor de själva pekade ut.
Varför citerar motorerna bredare än de stödjer?
För att citat framför allt är en trovärdighetssignal: en motor som visar källor framstår som pålitlig, oavsett hur hårt texten hänger ihop med dem. Källan väljs dessutom för att svara på frågans ämne — inte för att innehålla varje påstående som svaret råkar innehålla. Därför uppstår gapet mellan att citera och att stödja som en systematisk egenskap, inte som en slump.
Tabellen visar också en avvägning. Bing Chat citerade snålt och träffsäkert — högst citation precision (89,5 %) men lägre recall (58,7 %) — medan Perplexity.ai och NeevaAI citerade bredare, med recall runt 68–69 % och precision strax över 70 %. Ingen motor i studien lyckades med båda.
För er som källa pekar det på något användbart: motorerna tenderar att luta sig mot sidor som är lätta att stödja — självbärande påståenden som kan återges rakt av, utan att motorn måste fylla i eller dra slutsatser själv. En sida full av vaga marknadsbudskap ger motorn något att peka på, men inget den kan återge korrekt.
Spelar det någon roll att nästan ingen klickar på citaten?
Ja — för att citatet i texten är det de flesta faktiskt ser. När Google visar en AI-sammanfattning klickar 8 % på något resultat, mot 15 % utan sammanfattning; bara 1 % klickar sig vidare till källorna (Pew Research, 2025-07-22). De flesta möter alltså citatet som text, inte som ett besök på er sida.
Det vänder problemet från trafikfråga till varumärkesfråga. Om motorn skriver att ni ”erbjuder X” när er sida säger något mer nyanserat, är den meningen som blir er offentliga beskrivning — för de flesta läsare finns ingen andra källa. Att felcitering är ett verkligt mönster, inte en teoretisk risk, visar granskningar av motorernas nyhetscitering; vi går igenom dem i inlägget om felcitering i AI-motorer.
Till detta kommer att svaret växlar över tid: i månadsjämförelser av samma frågor byts upp till cirka 60 % av de citerade domänerna, enligt mätningar från Profound Research. Instabiliteten har egen behandling i inlägget om varför AI-svar ändras mellan körningar — och den är ytterligare ett skäl att kontrollera löpande i stället för att checka en gång.
Hur blir ni en källa som är svår att misscitera?
Du kan inte styra hur en motor summerar, men du kan minska utrymmet för feltolkning. Tre åtgärder gör störst skillnad:
- Skriv självbärande meningar. Varje nyckelpåstående ska fungera på egen hand — siffra, definition, slutsats i en mening som kan återges ordagrant. Undvik påståenden som bara stämmer tillsammans med stycket runt omkring.
- Avgränsa explicit. ”I Sverige 2026”, ”för B2B-företag utan säljorganisation”, ”enligt SFS 2025:123”. Ju tydligare ram påståendet har, desto svårare är det för motorn att sträcka det.
- Håll källan spårbar och uppdaterad. Synligt datum, egna källhänvisningar och konsekvent företagsnamn gör det enkelt för motorn att stödja påståendet — och enkelt för er att senare visa vad ni faktiskt skrivit.
Hela arbetsgången — från crawler-åtkomst till citerbart innehåll — finns i GEO-guiden. Och om du undrar hur motorerna väljer bland kandidaterna i första hand är mekaniken beskriven i inlägget om hur AI-motorerna väljer källor.
Vad ska ni använda siffrorna till i dag?
Studien är från 2023 och motorerna har förändrats, men diagnosfrågorna har inte åldrats: stödjer källan citatet, och stödjer citatet påståendet? Det är en kontroll du kan köra på dagens svar, motor för motor: ställ era köpfrågor, jämför påståendena mot era sidor och notera var återgivningen slarvar.
Ofta slutar kontrollen inte i tekniska justeringar utan i redaktionella: påståenden som behöver göras självbärande, ramas in eller dateras. Det är den disciplinen GEO som arbetssätt handlar om — att göra er sajt till den källa som är lättast att stödja korrekt.
Vanliga frågor
Kan jag lita på att AI återger min webbplats korrekt?
Inte automatiskt. I Stanford-studien var 51,5 % av meningarna i AI-svaren helt stödda av sina citat, och 74,5 % av citaten stödde sin mening (motorernas 2023-versioner). Du minskar risken genom självbärande, tydligt avgränsade påståenden — och genom att kontrollera löpande hur motorerna faktiskt återger er.
Vad betyder det att ett citat ”stödjer” en mening?
Att källan innehåller påståendet, inte bara behandlar ämnet. Studien skiljer på citation recall — att meningen är fullt stödd av sina citat — och citation precision — att citatet stödjer sin mening. Ett svar med tio källor under sig kan fortfarande innehålla påståenden som ingen av dem täcker.
Hur kontrollerar jag om motorerna återger oss rätt?
Ställ de frågor dina kunder faktiskt ställer — samma formuleringar, upprepade över tid — och jämför svarens påståenden mot vad era sidor säger. Notera avvikelser och vilken källa motorn pekar på. Enstaka avvikelser är normal brus; en stabil felaktig återgivning är en signal att er källa behöver göras tydligare.
Vill du veta var er webbplats står i dag?
Beställ den fria granskningsrapporten — ni får synlighetspoängen, luckorna och de tre första åtgärderna.
Starta med fri granskning