Hvordan AI-systemer tolker og velger innhold
De fleste tror at AI-modeller som ChatGPT leser og forstår en hel artikkel på samme måte som et menneske. I praksis dekonstruerer disse systemene innhold…

Hvordan AI-systemer tolker og velger innhold
De fleste tror at AI-modeller som ChatGPT leser og forstår en hel artikkel på samme måte som et menneske. I praksis dekonstruerer disse systemene innhold til små, logiske biter kalt «ChunkEn chunk er en avgrenset tekstbit som en språkmodell henter og vurderer for seg. Modellen siterer sjelden en hel side — den siterer den chunken som best besvarer spørsmålet.Se i ordlisten» for analyse. Det er kvaliteten og den semantiske rikheten i disse individuelle bitene, ikke den samlede teksten, som avgjør om innholdet ditt blir valgt som en kilde.
Hva chunking og embeddings betyr
Chunking betyr kort sagt å dele opp et større dokument i mindre, sammenhengende tekstsegmenter. I AI-kontekst handler det om å forberede innhold for embeddings, en prosess der hvert tekstsegment blir omgjort til en numerisk representasjon (vektor) som fanger den semantiske betydningen.
Slik fungerer RAG-arkitekturen
Når et AI-system skal besvare et spørsmål, bruker det en RAGRAG (Retrieval-Augmented Generation) er når en språkmodell henter inn eksterne dokumenter før den svarer, i stedet for å svare kun fra det den er trent på. Det er denne mekanismen som gjør at ferskt innhold kan siteres.Se i ordlisten (RAG)-arkitektur. Denne prosessen innebærer flere steg:
- Chunking: Innhold fra en kilde (f.eks. en nettside) deles opp i biter, ofte på rundt 512 tokens, med en viss overlapp for å bevare kontekst.
- Embedding: Hver chunk blir konvertert til en embedding-vektor av en språkmodell og lagret i en vektordatabase.
- Retrieval: Når en bruker stiller et spørsmål, blir også spørsmålet konvertert til en embedding-vektor. Systemet søker deretter i vektordatabasen for å finne de tekst-chunkene hvis vektorer er semantisk nærmest spørsmålets vektor.
- Generation: De hentede chunkene blir gitt som kontekst til en stor språkmodell (LLM), som bruker informasjonen til å formulere et presist og kildebasert svar.
Konsekvensen av dårlig struktur
Problemet er at hvis innholdet er dårlig strukturert, vil chunking-prosessen skape usammenhengende eller meningsløse tekstbiter.
Resultatet er ofte at selv verdifull informasjon blir oversett fordi de individuelle chunkene ikke har nok semantisk tetthet eller kontekst til å bli ansett som relevante under retrieval-steget.
Tenk i kunnskapsblokker, ikke narrativ
I stedet for å tenke på en artikkel som en lineær fortelling, bør man se på den som en samling av autonome, siterbare kunnskapsblokker. Hver del av teksten må kunne stå på egne ben og levere verdi uavhengig av resten av artikkelen.
Praktiske grep for bedre AI-tolkning
Det betyr i praksis at man bør se nærmere på:
- Chunk-størrelse og overlapp: Eksperimentere med optimale chunk-størrelser (f.eks. 256, 512, eller 1024 tokens) og overlapp (typisk 10-20%) for å sikre at konteksten bevares.
- Semantisk tetthet: Sikre at hver chunk inneholder nok relevante EntitetEn entitet er en identifiserbar ting — en person, et selskap, et produkt eller et sted — som søkemotorer og språkmodeller kan knytte fakta til. Konsistent navn, kontaktinfo og profiler på tvers av kilder er det som gjør entiteten entydig.Se i ordlisten og nøkkelinformasjon til å være meningsfull alene.
- Strukturell klarhet: Bruke klare overskrifter, lister og tabeller for å guide chunking-prosessen og skape logiske segmenter.
Neste steg i optimaliseringen
Dette er ofte punktet hvor mange innser at teknisk struktur er like viktig som selve innholdet. Å analysere hvordan ens eget innhold blir «chunket» av AI-systemer, for eksempel med verktøy som CitationLab Chunkalyzer, er et nødvendig neste steg for å optimalisere for SiteringEn sitering er når en AI-tjeneste oppgir kilden bak et svar, som regel med lenke. Sitering er noe annet enn omtale: du kan bli nevnt uten å bli lenket til, og lenket til uten å bli nevnt ved navn.Se i ordlisten.
Vil du ha denne analysen gjort for ditt eget innhold, i stedet for å gjette deg fram til hvilke chunks som faktisk fungerer, er det nettopp den jobben AI SEO Analyse er satt opp for.
Takk — dette hjelper meg med å gjøre artikkelen bedre.
Ordforklaringer
Begrepene som brukes i denne artikkelen.
- Chunk
- En chunk er en avgrenset tekstbit som en språkmodell henter og vurderer for seg. Modellen siterer sjelden en hel side — den siterer den chunken som best besvarer spørsmålet.
- Entitet
- En entitet er en identifiserbar ting — en person, et selskap, et produkt eller et sted — som søkemotorer og språkmodeller kan knytte fakta til. Konsistent navn, kontaktinfo og profiler på tvers av kilder er det som gjør entiteten entydig.
- Sitering
- En sitering er når en AI-tjeneste oppgir kilden bak et svar, som regel med lenke. Sitering er noe annet enn omtale: du kan bli nevnt uten å bli lenket til, og lenket til uten å bli nevnt ved navn.
- RAG
- RAG (Retrieval-Augmented Generation) er når en språkmodell henter inn eksterne dokumenter før den svarer, i stedet for å svare kun fra det den er trent på. Det er denne mekanismen som gjør at ferskt innhold kan siteres.
Få det jeg lærer om AI-søk
Egne tester og analyser av hvordan språkmodellene velger kilder. Ingen fast frekvens — jeg sender når jeg faktisk har noe å si.
