Prompt-sett slår søkeordslister
Søkeord og prompts er ikke det samme, og forskjellen avgjør hvem du konkurrerer mot. Slik bygger du et sett som faktisk speiler kundene dine.
Begrep · Måling av AI-synlighet
Hvor mange spørsmål må du måle på før tallene faktisk betyr noe?
Et promptbibliotek er en kuratert samling ekte brukerformulerte spørsmål som synligheten måles mot. Minimum 50, ideelt 200, og minst 80 prosent non-brand — merkevareprompts måler gjenkjennelse, ikke oppdagelse.
Settet er måleinstrumentet ditt. Er det for lite, måler du støy og kaller det utvikling. Er det bygget av merkevarespørsmål, måler du gjenkjennelse hos folk som allerede kjenner deg.
Det er også det eneste stedet i AI-synlighet der du kan gjøre en feil som ikke lar seg rette senere: er settet endret mellom to målinger, finnes det ingen tidsserie å sammenligne.
Avgrensning
Begrepene under ligger nært, og blandes ofte sammen. Forskjellen avgjør hvilket arbeid som faktisk hjelper.
Plass i kjeden
Skjer det noe hos deg etterpå?
Leddet der synlighet blir forretning: merkevaresøk, direkte trafikk, henvendelser. Det er det eneste leddet kunden faktisk betaler for, og det som lettest blir påstått uten kontroll.
Svikter leddetRapporten viser oppgang i siteringer, og ingenting i pipeline.
Leddet hører til trinn 5, virkning, i TRUST-modellen, og står i sin helhet på ledd 8 av kjeden. Arbeidet eies av tilbakemelding.
Mekanisme
Et promptsett er et utvalg, og utvalg har usikkerhet. Med ti prompts kjørt én gang har du ti observasjoner, og et intervall så bredt at nesten enhver endring passer inn i det. Det er derfor små sett nesten alltid gir «forbedring» — de kan ikke skille forbedring fra støy.
Utvalget må også være representativt for behovene, ikke for temaene dine. Kunder spør om pris, om ulemper, om alternativer og om hvem de skal velge. Sett bygget av det bedriften vil snakke om, måler noe annet enn det som avgjør salg.
Minst åtti prosent bør være non-brand. Merkevareprompts måler om modellen kjenner navnet ditt når du selv nevner det — det er en helt annen ting enn om du dukker opp uoppfordret, og det er den andre som er verdt penger.
Til slutt: gjentakelser er ikke sløsing. Samme prompt gir ulike svar mellom kjøringer, og uten gjentakelser vet du ikke om forskjellen fra forrige måned er en effekt eller den samme variasjonen målt to ganger.
Eksempel
Et vanlig oppsett er 50 prompts kjørt tre ganger, altså 150 kjøringer. Det høres solid ut. Ligger du på 12 prosent siteringsandel, klarer det oppsettet å påvise en endring på rundt tolv og et halvt prosentpoeng — altså at du må mer enn doble deg før tallet er til å stole på.
Alt under det vil se ut som bevegelse i rapporten uten å være det. Det er ikke et argument for å måle mindre, men for å si det høyt: settet avgjør hvilke spørsmål du kan svare på, og det bør bestemmes før målingen, ikke etter.
Regneeksempel med utgangspunkt i formelen under. Ikke tall fra et kundeprosjekt.
Sjekk selv
Kort nok til å gjøre nå, konkret nok til at du sitter igjen med et funn om din egen bedrift.
Et sett bygget på magefølelse er bedre enn ingen sett, men bør valideres mot faktiske søk og kundedialoger før det brukes som fasit.
Legg inn dagens nivå og endringen du vil kunne påvise. Kalkulatoren gir deg antall kjøringer som skal til — og hva settet du allerede har faktisk kan avgjøre.
I prosent. Bruk den ubetingede siteringsandelen.
I prosentpoeng. 8 betyr fra 12 til 20 prosent.
Minst 80 prosent bør være non-brand.
Samme prompt gir ulikt svar mellom kjøringer.
Settet er for lite. Du mangler rundt 59 prompts ved 3 gjentakelser, og slik det står nå kan du bare påvise endringer på 12,5 prosentpoeng eller mer. Alternativet til et større sett er å måle sjeldnere og over lengre perioder.
Utregningen er standard dimensjonering for sammenligning av to andeler, med 95 prosents signifikansnivå og 80 prosents styrke:n = 7,85 × (p₁(1−p₁) + p₂(1−p₂)) / (p₂−p₁)² per måletidspunkt, der 7,85 er(1,96 + 0,84)².
To ting følger av formelen, og begge er kontraintuitive. Små endringer er dyre: å halvere endringen du vil påvise firedobler antall kjøringer. Og lave nivåer er billigere enn nivåer rundt femti prosent, fordi variansen er størst på midten.
Gjentakelser teller som egne kjøringer her. Det er en forenkling: svar fra samme prompt henger noe sammen, så det reelle behovet ligger litt over tallet du får. Bruk det som en nedre grense, ikke som en fasit — og husk at et sett på under 50 prompts uansett måler for smalt til å si noe om en kategori.
Taktikker
Prioritert etter forholdet mellom innsats og effekt. Rekkefølgen er en del av anbefalingen.
Pris, sammenligning, ulemper, forutsetninger og «hvem bør jeg velge» er de fem behovene som gir salg. De fleste sett dekker bare det første og det siste.
Endrer du settet, mister du tidsserien. Vil du utvide, gjør det som en egen gruppe som måles ved siden av, ikke som en endring av det opprinnelige.
Under det kan du ikke oppgi spredning, og uten spredning er tallet et inntrykk. Tre er minimum, fem er merkbart bedre.
Prompts som aldri gir treff er data. Fjernes de fordi de «ikke fungerer», stiger alle andelene uten at noe har blitt bedre.
Anti-patterns
Måling
Settstørrelse, gjentakelser og andel non-brand
Tre tall som alltid skal stå i metodedelen av rapporten, sammen med hvilke motorer som ble kjørt og i hvilken periode. Uten dem er ikke resultatene etterprøvbare, og et resultat som ikke kan etterprøves er en påstand.
FrekvensSettet revideres kvartalsvis, måles månedlig.
Alle tall følger de samme minimumskravene: gjentakelser, aktiveringsrate som eget felt, nullresultater beholdt og målt spredning oppgitt. Se kravene i metoden.
Spørsmål
Minst 50 for å dekke en kategori i det hele tatt, og gjerne 200 hvis du skal kunne skille mellom segmenter eller motorer. Det riktige tallet avhenger av nivået ditt og hvor stor endring du vil kunne påvise — det er nettopp det kalkulatoren over regner ut.
Som utgangspunkt for temaer, ja. Som sett, nei. Folk skriver hele setninger med kontekst til en chat, og de spør om ting de aldri ville søkt på — som «er dette verdt pengene». Det er de spørsmålene som avgjør, og de finnes ikke i en søkeordsliste.
Fordi svaret varierer mellom kjøringer, også når ingenting er endret. Uten gjentakelser kan du ikke skille en reell endring fra den variasjonen, og da blir hver måling en fortelling i stedet for et måltall.
Takk — dette hjelper meg med å gjøre artikkelen bedre.
Nærliggende
Begrepene som grenser mot dette. De med egen side er lenket.
Egne tester og analyser som går dypere enn definisjonen.
Søkeord og prompts er ikke det samme, og forskjellen avgjør hvem du konkurrerer mot. Slik bygger du et sett som faktisk speiler kundene dine.
Kundesamtaler, support-logger, forum og autofullføring — fire kilder til spørsmålene folk faktisk stiller. Slik bygger du et spørsmålssett for…
Search Console viser ikke om ChatGPT anbefaler deg. Se de fire måltallene for AI-synlighet, hvordan du samler dem inn, og tre feller som gir feil svar.
Egne tester og analyser av hvordan språkmodellene velger kilder. Ingen fast frekvens — jeg sender når jeg faktisk har noe å si.
Vi tar en uforpliktende prat på 30 minutter. Du får en konkret vurdering av hvor du står i AI-søk — og hva som er første steg. Ingen presentasjon, ingen forpliktelse.
Eller ring +47 466 144 18
La en spesialist se på AI-synligheten din