Studien om källbias: varför AI-motorerna älskar stora medier — och stora varumärken
AI-sökmotorer litar på andra mer än på dig — och det är systematiskt. I Toronto-studien följer AI-svarens källor mönstret earned ≫ brand ≫ social, medan Google snarare följer brand ≫ earned ≫ social. I de mätta vertikalerna var 69–92 % av AI-svarens källor earned media — oberoende medier, recensions- och jämförelsesajter — medan Google blandar in betydligt mer varumärkesägda sidor.
Studien ”Generative Engine Optimization: How to Dominate AI Search” kommer från University of Toronto (Mahe Chen, Xiaoxuan Wang, Kaiwen Chen, Nick Koudas) och publicerades som preprint i september 2025 (arXiv:2509.08919). Den mätte Perplexity (sonar-pro), Claude (3.5 Sonnet med webbsökverktyg), Gemini (2.5 Flash med Google Search-grounding) och GPT:s sökläge (gpt-4o-search-preview), med Googles topp-10-resultat som jämförelse.
Fyndet vänder på en bekväm föreställning: att bra innehåll på den egna sajten räcker för att bli citerad. I AI-sök är den egna sajten en källa av lägre rang — det är kärnan i hur motorerna väljer, som vi beskriver i hur AI väljer källor. Det som väger är närvaron i oberoende källor, och det ändrar hela arbetslistan för ett företag som vill synas i svaret.
Hur mätte forskarna källbiasen?
Upplägget är kontrollerat och storskaligt. 1 000 konsumentinriktade rankingfrågor — tio kategorier gånger hundra — kördes i två regioner, USA och Kanada. Därtill ett språkexperiment: 100 basfrågor i tio vertikaler översatta till fem språk (kinesiska, japanska, tyska, franska och spanska), och ett paraphrasexperiment där samma frågor formulerades om med sju olika mallar. Tillsammans ger det en bild av hur källvalen varierar över vertikal, region, språk och formulering (arXiv 2025). Studien fördjupade sig dessutom i Reddit: fem subreddits med de 1 000 mest ”hot”-rankade och de 1 000 senaste inläggen vardera, plus ytterligare tre subreddits i en köp-fördjupning.
Varje citerad källa kategoriserades i tre typer. Brand är officiella varumärkessajter som direkt säljer eller erbjuder något — studiens exempel är chase.com. Social är sociala plattformar, forum och användargenererat innehåll. Earned är oberoende media-, recensions- och jämförelsesajter — exemplen är nerdwallet.com och forbes.com. Notera att earned alltså inte betyder enbart press: jämförelse- och recensionssajter räknas dit, medan forum och sociala medier utgör en egen kategori — den som låg sist i AI-motorernas mönster.
Hur stor är skillnaden mellan AI-sök och Google?
I Regional/Vertical-experimentet — automotive, konsumentelektronik och mjukvara, i USA och Kanada — blev mönstret konkreta procenttal. AI-sökarnas källmix dominerades helt av earned media, medan Google blandade in mer brand-ägt och socialt:
| Vertikal (region) | AI-sök: earned / brand / social | |
|---|---|---|
| Automotive (Kanada) | 69,1 / 30,9 / 0 | 40,6 earned / 36,6 brand / 22,8 socialarXiv:2509.08919 |
| Automotive (USA) | 81,9 / 18,1 / — | 45,1 earned (rapporterat)arXiv:2509.08919 |
| Konsumentelektronik (Kanada) | 77,6 / 22,1 / 0,3 | 54,1 earned (rapporterat)arXiv:2509.08919 |
| Konsumentelektronik (USA) | 92,1 earned, försumbar social | Brand 32,9 %, social 15,4 % (earned ej explicit rapporterad)arXiv:2509.08919 |
| Mjukvara (Kanada) | 74,2 / 25,8 / 0 | 31,8 earned / 53,8 brand / 14,4 socialarXiv:2509.08919 |
| Mjukvara (USA) | 72,7 / 26,7 / — | 45,4 earned / 43,7 brand / 10,9 socialarXiv:2509.08919 |
Varför gynnas stora varumärken — och vad kan en nischaktör göra?
Utöver mediebias identifierar studien en bias mot stora varumärken — big brand bias — och rekommenderar uttryckligen nischaktörer att bygga strategi för att kringgå den. En viktig begränsning: i det verifierade materialet är den delen kvalitativ. Studien visar riktningen, men konkreta procentsatser för stora mot små varumärken finns inte att hämta i den publicerade textens huvuddel — var försiktig mot alla som citerar exakta siffror där. Att det ändå spelar roll är uppenbart: ChatGPT stod enligt studien för omkring 81 % av den globala marknadsandelen bland AI-chattbotar i juli 2025 (arXiv 2025).
Motorerna skiljer sig också åt, vilket ger handlingsutrymme. Perplexity var den mest varumärkestunga av AI-motorerna. Claude återanvände engelska auktoritetsdomäner över språkgränserna, med högre stabilitet över språk än Google. GPT:s sökläge bytte i praktiken sajt-ekosystem nästan helt per språk. Över lag var AI-motorerna mer stabila när frågorna formulerades om än Google — källvalet hänger alltså fastare vid ämnet än vid den exakta formuleringen.
För en nischaktör är motstrategin att bli den citerbara källan i det smala: djup på ett område där de stora är vaga, plus närvaro i de oberoende källor motorerna föredrar. Nämningar korrelerar med citering — korrelation, inte garanti — men i en källmix där 69–92 % är earned är frånvaro där ett säkert sätt att inte synas. Var ni står i dag visar självtestet i varför ChatGPT citerar konkurrenten.
Kan man lita på de medier som citeras?
Nej, inte blint — och det är en viktig nyans mot att läsa den här studien som ”media vinner alltid”. Tow Centers granskning av åtta AI-sökmotorer fann att mer än 60 % av svaren på nyhetsfrågorna var felaktiga — fel artikel, fel påstående eller fel källa (CJR/Tow Center, mars 2025). Motorerna är alltså partiska mot earned media och samtidigt slarviga med just de källorna — en kombination som varken är perfekt eller till fördel för nya aktörer. Granskningen i detalj har vi i om felciteringen.
Tre avgränsningar för Toronto-studien själv. Motorerna som testades var Perplexity, Claude, Gemini och GPT:s sökläge — inte Google AI Overviews, och ”ChatGPT” i abstracten är den populära benämningen på GPT:s sökfunktion. Procentsatserna kommer från Regional/Vertical-experimentet i tre konsumentvertikaler och två nordamerikanska regioner — inte från svenska frågor. Och klassificeringen i earned, brand och social är studiens tre typer; verkligheten har mellanformer, som en branschtidning som också säljer tjänster.
Vad gör ett svenskt B2B-företag åt källbiasen?
Studiens fyra rekommendationer är påfallande praktiska: bygg innehåll som maskiner kan skanna och motivera, bygg auktoritet genom earned media, anpassa efter motor och språk — och arbeta som nischaktör aktivt mot big brand bias. Översatt till en svensk arbetslista:
Earn närvaron
Branschmedia, register, listor, jämförelser och omdömen är den källtyp AI-söket väger högst. En omnämning i rätt sammanhang är värdefullare än ännu en egensida.
Gör egen sajt citerbar
Earned-källorna behöver något solidt att peka på: svar-först, specifika siffror, neutral ton. Annars avstannar kedjan vid er webbplats — GEO-guiden har åtgärderna.
Mät per motor
Källmixen skiljer sig mellan Perplexity, Claude, Gemini och GPT — mät samma frågor mot samtliga i stället för att gissa från en enskild motor.
Hur det här skiljer sig från klassiskt sökarbete — där den egna sajten är huvudscenen — går vi igenom i GEO vs SEO. Och håll en sak i minnet: källbiasen är ett förhållande att arbeta med, inte en bugg att vänta in. Preferensen för oberoende källor är dokumenterad, inte tillfällig — och den som redan finns i rätt källor när kunderna börjar fråga har ett försprång som är svårt att ta igen.
Vanliga frågor
Är AI-synlighet meningslös för små företag när medierna dominerar?
Nej — men vägen dit går via andra än den egna sajten. Studien visar att AI-sök väger earned media högst (69–92 % av källorna i de mätta vertikalerna), samtidigt som den medföljande big brand-biasen enligt forskarnas egen rekommendation kan kringgås av nischaktörer. Djup i en smal nisch, citerbart innehåll och närvaro i oberoende källor är motstrategin.
Testade studien ChatGPT och Google AI Overviews?
ChatGPT indirekt: experimentmotorn var gpt-4o-search-preview — GPT:s sökläge — tillsammans med Perplexity (sonar-pro), Claude 3.5 Sonnet med webbsök och Gemini 2.5 Flash. Google användes som jämförelse via topp-10-resultaten, men Google AI Overviews testades inte. Generalisera därför med försiktighet till motorer utanför uppsättningen.
Räknas omdömen och forum som earned media?
Delvis. I studiens definitioner är earned oberoende media-, recensions- och jämförelsesajter. Sociala plattformar, forum och användargenererat innehåll är en separat kategori — den som låg sist i AI-motorernas mönster. Ett foruminlägg och en oberoende jämförelseartikel väger alltså olika i källvalet, även om båda kan citeras.
Vill du veta var er webbplats står i dag?
Beställ den fria granskningsrapporten — ni får synlighetspoängen, luckorna och de tre första åtgärderna.
Starta med fri granskning