Hoppa till innehåll
CitationLab
Tillbaka till Måling og verktøy
Måling og verktøy

AI skickar trafik till sidor du inte har

AI-assistenter skickar användare till URL:er som inte finns på din webbplats. Hallucination får skulden, men den viktigaste orsaken idag är gammalt minne — en modell som pekar mot URL-strukturen du lämnade för två migreringar sedan.

KR
Krister Ross
Grundare och VD, CitationLab
Publicerad Uppdaterad 8 min läsning
Nyfiken på hur AI beskriver ditt varumärke?Kör en gratis synlighetskoll

404 är inget nytt problem. Användaren är ny

404 betyder helt enkelt att resursen inte finns. Statuskoden skapades för att svara på förfrågningar mot innehåll som inte är där, inte för att hantera stavfel.

Volymen kom heller aldrig från folk som skrev fel i adressfältet. Den kom från oss själva. Ny design, ny URL-struktur, flyttat innehåll, och plötsligt pekade allt det gamla ut i tomma intet. Google började tidigt vikta detta, och redan runt 2012 var 404-jakt standard i all seriös webbanalys. De dyraste fallen var alltid samma två: en URL som låg i sökresultatet och ledde till ingenting, och en annons du betalade för som landade på en felsida.

Sedan dess har vi blivit betydligt bättre på omdirigeringar. Men inte nödvändigtvis på rätt omdirigeringar. Väldigt många webbplatser löser 404 genom att skicka allt till startsidan. Det tar bort felkoden och bevarar noll relevans.

Det höll så länge trafiken kom från en crawler som följde länkar. Nu kommer den från något annat.

Hallucination är inte längre huvudförklaringen

Detta är värt att slå fast, eftersom halva branschen fortfarande upprepar det.

Tidiga modeller konstruerade URL:er genom ren mönsterigenkänning. De visste hur en webbplats brukar se ut och gissade. Det blev ett tillräckligt stort problem för att leverantörerna skulle bygga egna lager runt länkhantering. Moderna assistenter hämtar i betydligt högre grad URL:er från faktiska sökningar och hämtade sidor i stället för att räkna ut dem ur minnet. Gissade URL:er förekommer fortfarande, men andelen har fallit kraftigt och fortsätter att falla.

Det som inte har fallit är allt det andra.

Fyra orsaker som fortfarande gäller

1. Modellen minns rätt, men gammalt. Detta är den viktigaste, och den ingen pratar om. En modell har ingen bra intern tidsstämpling. Den vet inte alltid vad den lärde sig 2023 och vad den lärde sig 2025. Lanserade du en ny webbplats 2025 lever den gamla strukturen från 2023 vidare i minnet och kan användas som om den vore aktuell. Det är inte hallucination. Det är teknisk skuld som plötsligt får trafik igen.

2. Modellen citerar något du har tagit bort. En kampanjsida, en gammal artikel, en produktsida du avpublicerade. Den lever vidare i modellens minne och i tredjeparts citat långt efter att den försvann från din webbplats.

3. Länken bryts på vägen. Avslutande parenteser, avkortade URL:er, markdown-formatering som inte överlever kopiering ut ur chattfönstret. Trivialt, men mätbart.

4. Modellen gissar fortfarande ibland. Mer sällan än förr, men det händer. Särskilt på webbplatser med lite hämtbart innehåll, där modellen har lite annat att gå på.

Detta är ett urval, inte en fullständig lista. 404 uppstår också av intern fellänkning, trasiga kanoniska URL:er, tredjeparter som länkar fel, utgångna kampanj-URL:er och en lång rad andra skäl. Poängen här är inte att täcka alla, utan att peka på dem som är nya.

Så ser det ut i en logg

Vi körde siffrorna på en kundwebbplats. Tabellen nedan är en ögonblicksbild av bot-loggen där per den 10 augusti 2026, sorterad efter antal träffar. Varje rad går ihop: 200-svar plus 404-svar är lika med totalt antal förfrågningar, så detta är fullständiga siffror per bot, inte ett urval.

BotKategoriTräffar404Andel 404
BingbotSökmotor2 1191396,6 %
Unknown BotOkänd1 9041 63185,7 %
CCBotAI-crawler1 5241 52299,9 %
GooglebotSökmotor1 18331326,5 %
BaiduspiderSökmotor56818632,7 %
ChatGPT-UserAI-crawler1838747,5 %
PerplexityBotAI-crawler1494530,2 %
SemrushBotSEO-verktyg1463221,9 %
YandexBotSökmotor682638,2 %
TwitterbotSociala medier1700,0 %
DuckDuckBotSökmotor14321,4 %
LinkedInBotSociala medier500,0 %
Alla bots7 8803 98450,6 %
Bot-logg från en kundwebbplats, ögonblicksbild 10 augusti 2026. AI-crawlers markerade.

Hälften av all bot-trafik träffade en sida som inte finns. Men fördelningen är det intressanta. Sökmotorerna som grupp låg på 16,9 % — Bingbot, den enskilt största källan till förfrågningar, på 6,6 %. AI-crawlerna som grupp låg på 89,1 %.

En rad bär den siffran. CCBot, Common Crawls crawler, missade på 1 522 av 1 524 förfrågningar. Common Crawl är ett av de korpus som matar träningsdata till modellerna, och den arbetar sig genom en URL-lista som är flera år gammal — alltså orsak nummer ett ovan, observerad direkt i stället för argumenterad för. Håller vi CCBot utanför ligger de återstående AI-crawlerna på 39,8 %, fortfarande mer än dubbelt så högt som sökmotorerna. Den ärliga läsningen är att en crawler dominerar rubriksiffran, och att mönstret överlever att den tas bort.

Raden som betyder mest kommersiellt är ändå ChatGPT-User: 87 av 183 förfrågningar, 47,5 %. Det är inte en crawler som indexerar i bakgrunden. Det är agenten som hämtar en sida för att en faktisk människa sitter i chatten och väntar på svaret. Nästan hälften av dem fick en felsida.

Detta är en webbplats vid en tidpunkt, inte en branschmätning. Siffran du ska agera på är din egen.

Volymargumentet håller inte längre

För ett år sedan var det rimligt att avfärda detta. AI-hänvisningar var marginella för de allra flesta webbplatser, och 404-träffar var en bråkdel av det.

Det har förändrats snabbt. Vi ser webbplatser där AI-driven trafik har mångdubblats på sex månader och där den nu är bland de viktigaste organiska källorna. Inte i volym i nivå med Google, men i betydelse.

Och även om volymen fortfarande vore låg skulle argumentet hålla. För det egentliga argumentet är värde per träff.

En användare som klickar sig in från ChatGPT eller Perplexity har redan gått igenom research- och utvärderingsfasen, med modellen som rådgivare. De har ställt följdfrågor. De har fått en rekommendation. De kommer inte för att orientera sig. De kommer för att agera.

Det är inte ett klick från position fyra i sökresultatet. Det är en hänvisning — och det är också därför ranking och citering är två olika spel.

Att möta den hänvisningen med «Tyvärr, sidan finns inte» är bland de dyraste förlusterna per träff i hela din funnel. Och till skillnad från ett förlorat organiskt klick får du ingen ny chans. Användaren går inte tillbaka till chatten för att be om ett alternativ. De går till konkurrenten som modellen nämnde i samma mening.

404-loggen som innehållsdata, och varför den har ett utgångsdatum

Här är en vinkel som har varit verkligt användbar och som är värd att använda just nu.

När en modell upprepade gånger gissade på en URL du inte hade berättade den något värdefullt: vad den förväntade sig att ett företag som ditt erbjuder. Pekar flera modeller oberoende av varandra mot /priser har du ett transparensproblem. Pekar de mot en kalkylator du aldrig byggt har du ett innehållsgap validerat av själva systemet du försöker bli citerad i.

Men var ärlig om hållbarheten. Grunden för den här metoden försvinner i takt med att modellerna slutar gissa URL:er. Använd den så länge den varar. Bygg ingen metodik på den.

Det som ersätter den är fan-out. När en användare ställer en fråga bryter modellen ner den i en rad delfrågor som den söker på internt innan den svarar. Det är där den faktiska efterfrågan ligger, och det är betydligt rikare data än en handfull gissade URL:er. Fan-out berättar vilka frågor du måste besvara. 404-loggen berättade bara vilka URL:er någon trodde att du hade.

Så gör du i praktiken

Kontrollera först att du överhuvudtaget mäter 404-sidan. 404-sidor går utmärkt att mäta. Problemet är att nästan ingen gör det. Vissa skickar alla 404-träffar vidare till startsidan med en omdirigering, vilket ser städat ut och samtidigt raderar det enda underlag som skulle visa dig att detta sker. Andra har en 404-sida som ligger utanför det ordinarie mallsystemet och därför saknar analytics-taggning. I båda fallen finns problemet inte i dina rapporter. Det finns bara i verkligheten. Serverloggar eller Cloudflare-analytics fångar det GA4 inte ser.

Identifiera AI-trafiken. Filtrera på hänvisningar från chatgpt.com, perplexity.ai, gemini.google.com och copilot.microsoft.com. Vissa assistenter lägger också på UTM-parametrar automatiskt — ChatGPT använder utm_source=chatgpt.com, vilket förenklar spårningen. Var medveten om att en betydande andel AI-hänvisningar kommer in helt utan referrer, eftersom användaren kopierar länken manuellt. Serverloggen är sanningen här, inte analysverktyget.

Räkna med att fördelningen är skev. Över tolv veckor på en annan kundwebbplats (14 maj till 8 augusti 2026) registrerade GA4 594 sessioner från AI-källor. 559 av dem — 94 % — kom från chatgpt.com. Perplexity stod för sex. Claude.ai för en. Lägger du upp mätningen kring fyra plattformar med lika vikt läser du fel på något som i praktiken är en plattform plus en svans.

Räkna också med falska positiva. Den fjärde «AI-källan» i samma rapport var inte AI-trafik alls: en Vercel-preview-domän som råkade ha texten «gemini» i värdnamnet, infångad av ett filter som matchade på textsträng. 28 sessioner, felplacerade. Ett värdnamnsfilter är en utgångspunkt, inte ett svar — läs källistan innan du litar på totalen.

GA4-rapport över sessioner från AI-källor: 594 sessioner fördelade på fyra källor, där chatgpt.com står för 559, en felklassificerad Vercel-preview-domän för 28, Perplexity för sex och Claude.ai för en.
Sessioner från AI-källor på en annan kundwebbplats, 14 maj till 8 augusti 2026. Rad två är en falsk positiv, inte en AI-plattform.

Kör en omdirigeringsgenomgång mot historiska URL-strukturer. Detta är den största och snabbaste vinsten, och den följer direkt av orsak nummer ett. Ta fram sitemap eller crawl från före förra migreringen och kontrollera vad som faktiskt svarar idag. Omdirigera till närmaste motsvarande sida, inte till startsidan.

Gör 404-sidan till en navigationspunkt. Sökfält. Huvudkategorier. Ett tydligt nästa steg. Inte en ursäkt och en länk till startsidan. Behåll statuskod 404. Gör den inte till en soft 404 som returnerar 200, det skapar indexeringsproblem utan att lösa någonting.

Hantera mönster, inte enskilda träffar. Återkommer en URL över tid? Fanns sidan tidigare: sätt en 301. Har den aldrig existerat: överväg att faktiskt bygga den. Enskilda träffar är brus.

Bygg inte en sida för varje gissning. Då skapar du doorway-sidor och indexuppblåsning, och har bytt ett problem mot ett större.

Var du börjar

Hämta ut de senaste 90 dagarnas 404-träffar från serverloggarna, sortera på frekvens, och börja med de URL:er som faktiskt fanns tidigare — det är omdirigeringar du är skyldig dig själv, och de följer av den orsak som betyder mest. Vill du se vilka sidor modellerna tror att du har innan du gräver i loggarna, kör en gratis AI-synlighetskontroll, eller följ det löpande med AI Monitor.

Vanliga frågor

Hallucinerar modellerna fortfarande URL:er?
Ja, men betydligt mer sällan än förr. Leverantörerna har lagt in egna mekanismer för länkhantering, och assistenterna hämtar i stor utsträckning URL:er från faktiska sökningar i stället för att konstruera dem. Den vanligaste orsaken till AI-drivna 404:or idag är föråldrat minne, inte påhittade URL:er.
Ska 404-sidan returnera statuskod 404 eller 200?
404. En sida som ser ut som ett felmeddelande men returnerar 200 är en soft 404, och både sökmotorer och AI-crawlers hanterar det dåligt. Optimera innehållet på sidan, inte statuskoden.
Hjälper det att sätta upp omdirigeringar för gamla URL:er från 2023?
Ja, och det är ofta den snabbaste vinst som finns. Gamla URL:er i träningsdata försvinner inte för att du migrerar. Omdirigera till närmaste motsvarande sida, inte till startsidan, som inte bevarar något av relevansen.
Hur vet jag vilka AI-verktyg som skickar trafik till mig?
Kombinera referrer-analys, UTM-parametrar och serverloggar. Ingen av dem ger hela bilden på egen hand — en betydande andel AI-hänvisningar kommer in helt utan referrer, eftersom användaren kopierar länken manuellt ut ur chattfönstret.

Var detta till hjälp?

Dela:

Hold deg oppdatert

Få fagartikler, produktnyheter og analyser rett i innboksen.