AI-crawlere: GPTBot, ClaudeBot, PerplexityBot og de andre
Trening, søkeindeks eller sanntidshenting? Se hvilke AI-crawlere som betyr noe i 2026, og hvorfor skillet avgjør om en blokkering koster deg synlighet.
Begrep · Teknisk AI-søk
Slipper du i det hele tatt inn crawleren som avgjør om ChatGPT kan sitere deg?
OAI-SearchBot er OpenAIs crawler for innhold som skal kunne vises og siteres i ChatGPTs søk. Blokkerer du den, kan du ikke bli sitert i ChatGPT — uansett hvor godt innholdet er.
Dette er den ene tekniske innstillingen som er binær i AI-synlighet. Slipper du den ikke inn, kan ChatGPT ikke oppgi deg som kilde — uansett hvor godt innholdet er, hvor sterk entiteten er eller hvor mye du har investert i resten.
Forvirringen oppstår fordi OpenAI har flere crawlere med ulike formål, og fordi mange robots.txt-oppsett er kopiert fra en mal skrevet før skillet fantes.
Avgrensning
Begrepene under ligger nært, og blandes ofte sammen. Forskjellen avgjør hvilket arbeid som faktisk hjelper.
Plass i kjeden
Blir det søkt i det hele tatt, og finnes du der det søkes?
Motoren avgjør selv om den skal slå opp eksternt eller svare fra det den lærte under trening. Svarer den fra minnet, avgjøres omtalen av hva modellen allerede vet om deg — ikke av det du publiserte i går.
Svikter leddetDu er usynlig uansett hvor god teksten er, fordi teksten aldri blir slått opp.
Leddet hører til trinn 1, aktivering, i TRUST-modellen, og står i sin helhet på ledd 1 av kjeden. Arbeidet eies av tilstedeværelse.
Mekanisme
Crawlere identifiserer seg med et user-agent-navn, og robots.txt svarer med tillatelse eller avslag per navn. En regel som blokkerer alt bortsett fra Googlebot og Bingbot, blokkerer også OAI-SearchBot — uten at noen har tatt et valg om det.
Blokkeringen er stille. Ingenting går i stykker, ingen feilmelding kommer, og trafikktallene ser normale ut. Det eneste symptomet er at du ikke dukker opp som kilde i ChatGPT, og det symptomet ser identisk ut med «innholdet vårt er ikke godt nok».
Robots.txt er heller ikke det eneste stedet det kan gå galt. En brannmur eller bot-beskyttelse kan avvise crawleren på nettverksnivå selv om robots.txt tillater den, og det er en vanligere årsak enn folk tror i oppsett med aggressiv botfiltrering.
Merk at tillatelse ikke er det samme som å bli hentet. Crawleren må også finne sidene, klare å lese dem uten JavaScript, og vurdere dem som relevante. Tilgang er den første porten, ikke hele veien.
Eksempel
Et vanlig mønster i robots.txt er en generell avvisning etterfulgt av unntak for de crawlerne noen husket på. Sto den fila skrevet før 2024, finnes ikke OAI-SearchBot blant unntakene, og resultatet er en blokkering ingen har tatt stilling til.
Det motsatte mønsteret er like vanlig: alt er tillatt, men bot-beskyttelsen foran nettstedet svarer med 403 på alt som ikke ser ut som en nettleser. Robots.txt sier ja, serveren sier nei, og det er serveren som avgjør.
Beskrivelse av to konfigurasjonsmønstre som går igjen, ikke en revisjon av et bestemt nettsted.
Sjekk selv
Kort nok til å gjøre nå, konkret nok til at du sitter igjen med et funn om din egen bedrift.
Sjekk at crawleren slipper gjennom brannmuren
curl -sS -o /dev/null -w "%{http_code}\n" -A "OAI-SearchBot/1.0; +https://openai.com/searchbot" https://dittdomene.no/En 200 fra din egen IP betyr ikke at OpenAI får samme svar. Geografisk eller rate-basert filtrering kan slå ut annerledes for dem enn for deg.
Taktikker
Prioritert etter forholdet mellom innsats og effekt. Rekkefølgen er en del av anbefalingen.
Søkecrawleren og treningscrawleren er to ulike valg med ulike konsekvenser. Ett samlevedtak om «AI» er nesten alltid feil på minst én av dem.
Bot-beskyttelse, WAF og rate-grenser kan avvise crawlere som robots.txt slipper inn. Det er serveren som avgjør, ikke fila.
Tilgang hjelper ikke hvis siden er tom i kildekoden. Det crawleren ser er view-source, ikke det du ser etter at skriptene har kjørt.
Serverloggen er det eneste stedet du kan se om de faktisk kommer. Uten den gjetter du på om tilgangen virker.
Anti-patterns
Måling
Crawlerbesøk i serverlogg, og svarkoder per user-agent
Tell besøk per crawler per uke og andelen som får 200. Et fall til null er den tidligste indikasjonen på at noe er blokkert — den kommer måneder før du merker det på siteringene.
FrekvensMånedlig gjennomgang, og alltid etter endringer i brannmur, CDN eller robots.txt.
Alle tall følger de samme minimumskravene: gjentakelser, aktiveringsrate som eget felt, nullresultater beholdt og målt spredning oppgitt. Se kravene i metoden.
Spørsmål
Det er et annet valg enn søkecrawleren, og det er legitimt å si nei. GPTBot handler om at innholdet kan inngå i modellutvikling. Sier du nei, mister du ikke muligheten til å bli sitert i ChatGPTs søk — det er OAI-SearchBot som styrer.
Fra du åpner tilgangen må crawleren finne sidene på nytt og indeksen oppdateres. I praksis snakker vi dager til uker, avhengig av hvor ofte nettstedet ditt besøkes fra før. Det er ingen måte å be om prioritering.
Nei. En fil som beskriver innholdet ditt har ingen virkning hvis crawleren ikke får lov til å hente den, og heller ikke særlig virkning når den får det. Tilgang og indeksering er det som avgjør.
Takk — dette hjelper meg med å gjøre artikkelen bedre.
Nærliggende
Begrepene som grenser mot dette. De med egen side er lenket.
Egne tester og analyser som går dypere enn definisjonen.
Trening, søkeindeks eller sanntidshenting? Se hvilke AI-crawlere som betyr noe i 2026, og hvorfor skillet avgjør om en blokkering koster deg synlighet.
97 prosent av llms.txt-filene blir aldri hentet av en AI-crawler. Filen selges som et AI-synlighetstiltak. Det er den ikke.
Strukturerte data hjelper en modell å forstå hva en side handler om. De skaper ikke autoritet — og det er autoritet siteringen henger på.
Egne tester og analyser av hvordan språkmodellene velger kilder. Ingen fast frekvens — jeg sender når jeg faktisk har noe å si.
Vi tar en uforpliktende prat på 30 minutter. Du får en konkret vurdering av hvor du står i AI-søk — og hva som er første steg. Ingen presentasjon, ingen forpliktelse.
Eller ring +47 466 144 18
La en spesialist se på AI-synligheten din