Blogg · Forskning · Tow Center 2025

Granskningen av åtta AI-motorer: fel citerat innehåll i mer än 60 % av testerna

Av Nils Malmberg · Publicerad 5 september 2026 · Läsningstid ca 7 min · Källor under varje påstående

Åtta AI-sökmotorer svarade fel på mer än 60 % av 1 600 testfrågor. Tow Center for Digital Journalism granskade ChatGPT Search, Perplexity, Perplexity Pro, DeepSeek Search, Copilot, Grok-2, Grok-3 (beta) och Gemini på hur de citerar nyhetsartiklar. Ingen motor klarade uppgiften: den bästa svarade fel på 37 % av frågorna, den sämsta på 94 %.

Granskningen heter ”AI Search Has a Citation Problem” och publicerades i mars 2025 av Klaudia Jaźwińska och Aisvarya Chandrasekar (CJR/Tow Center 2025-03). Sammanlagt ställdes 1 600 frågor till åtta verktyg med sökfunktion — 200 per verktyg — och varje svar bedömdes mot tre krav: rätt artikel, rätt utgivare, rätt webbadress.

Det som gör resultatet svårt att avfärda är upplägget: textutdragen valdes medvetet så att Google returnerade rätt källa bland de tre översta organiska träffarna. Informationen var alltså lättillgänglig vid testtillfället — ändå blev svaret fel i drygt sex fall av tio. Det är hittills det tyngsta belägget för hur opålitligt generativ sökning citerar, och det sätter ramen för hela fältet som GEO arbetar i: motorerna är varken perfekta eller neutrala.

Hur gick granskningen till?

Metoden var enkel att följa och svår att argumentera bort. Tow Center valde 20 nyhetsutgivare med olika hållning i robots.txt, plockade tio slumpvis utvalda artiklar per utgivare och ställde alla åtta verktyg samma frågor utifrån förhandsvalda utdrag. Det gav 20 × 10 × 8 = 1 600 frågor, 200 per verktyg.

  • Sextonhundra svar, sex omdömen. Varje svar etiketterades i sex kategorier: korrekt; korrekt men ofullständigt; delvis felaktigt; helt felaktigt; inget svar; crawler blockerad.
  • 60 %-siffran är helheten. Den täcker alla felkategorier samlade över alla åtta verktyg — inte bara svaren som var helt fel.
  • Frågorna var lätta på pappret. Utdragen var valda så att rätt källa låg bland Googles topp-3 organiska träffar för samma sökning.

En detalj i etikettskalan förtjänar egen notering: kategorin ”crawler blockerad”. Utgivare som tekniskt blockerar motorernas botar finns alltså med i materialet — men som vi strax ska se skyddade blocket inte mot felaktiga svar.

Vilken motor svarade bäst — och vilken sämst?

Ingen svarade bra. Det är granskningens egentliga poäng: åtta motorer, samtliga dåliga på att citera nyheter. Men spridningen mellan dem är stor:

MotorHuvudfynd i granskningen
PerplexityLägst felfrekvens: 37 % av svaren felaktiga — fortfarande fel på mer än var tredje frågaCJR/Tow Center 2025-03
Grok-3 (beta)Högst felfrekvens: 94 % av svaren felaktiga; av 200 testpromptar ledde 154 citeringar till felsidorCJR/Tow Center 2025-03
ChatGPT SearchIdentifierade 134 artiklar felaktigt; signalerade osäkerhet i bara 15 av 200 svar — och vägrade aldrig att svaraCJR/Tow Center 2025-03
DeepSeek SearchAngav fel källa för de givna utdragen 115 av 200 gångerCJR/Tow Center 2025-03
GeminiMer än hälften av svaren citerade trasiga eller fabrikerade webbadresserCJR/Tow Center 2025-03
CopilotVägrade fler frågor än den besvaradeCJR/Tow Center 2025-03
Perplexity ProHämtade material som var robotblockerat eller bakom betalvägg — och återgav det korrekt i nästan en tredjedel av de nitti utdrag verktyget egentligen inte skulle ha haft tillgång tillCJR/Tow Center 2025-03
Grok-2Ingår i helhetsresultatet — över 60 % felaktiga svar samlade över samtliga verktyg; ingen separat andel redovisas i granskningens sammanfattningCJR/Tow Center 2025-03

Premiumversionerna — som Perplexity Pro — svarade oftare rätt än gratisvarianterna. Men de gav också fler självsäkert felaktiga svar, och det är den svåraste feltypen för en läsare att upptäcka: ett fel svar som inte tvekar ser ut som ett rätt svar.

Varför svarar motorerna fel när källan ligger bland Googles topp-3-träffar?

Felciteringen sker alltså inte i svåra lägen — den sker när informationen ligger i öppen dager. Mönstret i materialet är motorer som svarar med full självsäkerhet, oavsett underlag:

  • Fabrikerade och trasiga källor. Mer än hälften av Geminis och Grok-3:s svar pekade på webbadresser som var trasiga eller aldrig hade existerat. En citering som ser trovärdig ut behöver alltså inte leda någonstans.
  • Fel artikel, fel utgivare. DeepSeek Search felattribuerade källan i 115 av 200 fall; ChatGPT Search identifierade 134 artiklar felaktigt. Modellen hittar ett innehåll — men skriver fel namn under det.
  • Osäkerhet signaleras nästan aldrig. ChatGPT markerade tveksamhet i 15 av 200 svar och vägrade inte en enda gång. Självsäkerheten i tonen är ingen indikator på att innehållet stämmer.
Vad det betyder i praktiken: Copilot var den enda motor som vägrade fler frågor än den besvarade — det låter sämst i en tabell, men att avstå är bättre än att hitta på. När en kund får ett AI-svar om er bransch är tonens självsäkerhet därför ingen information alls.

Respekterar AI-motorerna utgivarnas robotblock?

Inte alltid — det är granskningens mest omdiskuterade fynd. Kategorin ”crawler blockerad” fanns med i etiketteringen, men Perplexity Pro visade att block inte är någon garanti: verktyget återgav innehåll från artiklar som var robotblockerade eller låg bakom betalvägg, och gjorde det korrekt i nästan en tredjedel av de nitti utdrag det egentligen inte skulle ha haft tillgång till.

För utgivaren är det dubbelt obehagligt: innehållet tas ändå, och svaret blir ändå ofta fel. För företagssajter är slutsatsen besläktad men omvänd — öppen crawler-åtkomst är en förutsättning för att överhuvudtaget citeras, men ingen försäkring för att citatet blir rätt. Det du själv kan påverka är grunderna på egen sajt: entydiga källuppgifter och innehåll som går att återge rakt av.

Vad betyder studien för ditt företag?

Först avgränsningen: granskningen mätte nyhetsartiklar på engelska på den amerikanska marknaden, i mars 2025. Den säger ingenting mätbart om svenska sajter eller om B2B-innehåll. Men riktningen är relevant för alla som vill synas i AI-svar:

  • Synlighet är inte samma sak som korrekt synlighet. Att en motor nämner er är inget bevis för att den återger er rätt — fel artikel, fel utgivare och fabrikerade källor var normalfallet, inte undantaget.
  • Felen gynnar ingen riktning. Motorerna är varken perfekta eller partiska till din fördel: varken du eller dina konkurrenter kan utgå från att svaret blir rätt.
  • Det du styr är ditt eget material. Citerbarhet och korrekta, entydiga källuppgifter på egen sajt är det enda i kedjan som står under din kontroll.

Vill du se läget för er egen del är nästa steg ett självtest av vad motorerna faktiskt citerar. Den vetenskapliga ramen kring källvalet tar vi upp i studien om källbias i AI-sök och i inlägget om verifiabilitet i generativ sökning.

Hur granskar ni vad motorerna säger om erat varumärke?

1

Ställ era riktiga frågor

Använd frågor som kunder faktiskt frågar, mot flera motorer. Klicka sedan på varje källa i svaret: leder den till er? Stämmer påståendet mot vad sajten säger?

2

Kontrollera källuppgifterna

Företagsnamn, organisation och fakta om verksamheten ska vara entydiga och identiska på sajten. Motsägelsefulla uppgifter är exakt det som ger modellen utrymme att gissa fel.

3

Repetera med mellanrum

Enstaka svar är inte statistik. Samma frågor över tid visar om felen är systematiska eller slumpmässiga — och om era ändringar får effekt.

Skälet till att överhuvudtaget göra detta ger granskningen själv: med över 60 % felaktiga svar är det en rimlig hypotes — inte overdriven försiktighet — att er verksamhet redan återges fel någonstans.

Vanliga frågor

Vilken AI-sökmotor är mest pålitlig?

Ingen av de åtta i Tow Centers granskning klarade sig. Perplexity hade lägst felfrekvens med 37 % felaktiga svar, Grok-3 (beta) högst med 94 % — men även den bästa svarade fel på mer än var tredje fråga. Motorvalet är därför ingen kvalitetsgaranti, och mätningen är från mars 2025; modellerna uppdateras löpande. Läs alltid källorna bakom ett AI-svar, oavsett vilken motor du använder.

Gäller de 60 procenten även svenska webbplatser?

Nej. Granskningen mätte 20 nyhetsutgivare och engelskspråkiga artiklar på den amerikanska marknaden, mars 2025. Den säger ingenting mätbart om svenska sajter eller B2B-innehåll. Det den visar är en egenskap hos verktygen själva — att de citerar opålitligt även när källan är lättillgänglig — och därför är det skäl nog att kontrollera hur just era sidor återges.

Kan man få en AI-motor att rätta ett felaktigt svar?

Det finns ingen rättelsekanal. Svaret genereras vid frågetillfället, och nästa svar kan se annorlunda ut. Det du kan påverka är inmatningen: entydiga källuppgifter om företaget, innehåll som går att återges rakt av och öppen crawler-åtkomst. Utöver det återstår att övervaka — ställ återkommande samma frågor och kontrollera källorna, i princip som Tow Centers metod.

Vill du veta var er webbplats står i dag?

Beställ den fria granskningsrapporten — ni får synlighetspoängen, luckorna och de tre första åtgärderna.

Starta med fri granskning