TRUST 3.0 · Pilar 5 av 5

Tilbakemelding i AI-søk

Måler du signal eller støy — og stemmer egentlig det som siteres om deg?

Kort svar

Hva er tilbakemelding i TRUST-modellen?

TInfrastrukturen som gjør resten av rammeverket målbart og justerbart, og som avdekker om synligheten du bygger faktisk er korrekt. To komponenter: måling og troskap.

Plass i modellen

Hvilket trinn denne pilaren løser

Forankret iTrinn 5, og kontroll av alle foregående trinn.

  1. 1Aktivering
  2. 2Henting
  3. 3Kontekst
  4. 4Sitering
  5. 5VirkningDenne pilaren
  • Trinn 5

    Virkning

    Blir du gjengitt korrekt, og skjer det noe?

    To ting måles her, og de er ikke det samme: om siteringen faktisk stemmer med det du har sagt, og om synligheten fører til noe. En høy siteringsrate med feil innhold er et tap forkledd som en gevinst.

Se hele modellen for hvordan trinnene henger sammen. Svikter et trinn lenger opp, er arbeid på denne pilaren uten virkning.

Mekanisme

Hvorfor dette avgjør noe

Synlighet i generative flater er ustabil på en måte klassisk rangering ikke er. Målt over flere motorer og halvannen måned ligger overlappen i siterte kilder fra dag til dag rundt en tredjedel til drøyt førti prosent. Overlappen mellom to måneder for én generativ flate er målt til under en femtedel, mot rundt 45 prosent for organiske resultater i samme periode. Selv der temperaturen kan settes til null, endres mellom 9 og 28 prosent av beslutningene mellom kjøringer.

Det følger direkte at én kjøring per prompt ikke er en måling. Det er ett trekk fra en fordeling. Uten gjentakelser kan du ikke skille effekten av arbeidet ditt fra normal svingning, og du vil systematisk feiltolke støy som drift.

Troskapsmekanismen er en annen. Motoren kan sitere en kilde for en påstand kilden ikke fremmer. Revisjoner finner at rundt halvparten av setningene i generative svar er fullt understøttet av kildene de peker på, og at rundt tre av fire siteringer faktisk støtter påstanden de er knyttet til. Feil om deg som får spre seg ukorrigert blir en del av bakgrunnskunnskapen.

Subdimensjoner

Dette avgjør tilbakemelding

  1. 01

    Promptbibliotekforvaltning

    Etablering og vedlikehold av et kvalifisert bibliotek som reflekterer faktiske brukermønstre. Minimum 50 spørringer, ideelt 200, minst 80 prosent non-brand, tre til fem parafraser per informasjonsbehov.

  2. 02

    Måleprotokoll

    Gjentakelser, parafraser, aktiveringsrate, nullresultater og spredning. Minst tre kjøringer per prompt per periode, sju til åtte som mål. Dette er ikke forhandlingsbart, fordi tallene ellers ikke betyr noe.

  3. 03

    Troskapskontroll

    Manuell verifisering av at siteringene faktisk er korrekte. Ny som obligatorisk i 3.0, lagt under denne pilaren framfor å få egen bokstav, og med egen kontrollport i metoden.

  4. 04

    KPI-struktur

    Tre nivåer — eksponering, kvalitet og virkning. De besvarer forskjellige spørsmål og skal ikke slås sammen til ett tall.

  5. 05

    Konkurrentbenchmark

    Samme bibliotek, samme protokoll, samme kjøring. Du kan vokse i absolutte tall og tape i relativ posisjon — og relativ posisjon er det mest robuste tallet i hele stabelen.

  6. 06

    Kontrollert eksperimentering

    Strukturerte før- og etter-tester med kontrollperiode eller kontrollgruppe, og dedikerte prompts knyttet til akkurat den endringen som gjøres.

Oppstilling

De tre KPI-nivåene

Nivåene besvarer ulike spørsmål og skal ikke slås sammen til ett tall. Nivå 3 rapporteres alltid med eksplisitt usikkerhet.

Nivå 1 · eksponering
Aktiveringsrate, hentbarhet, siteringsandel betinget og ubetinget, andel av sitatmasse.
Nivå 2 · kvalitet
Siteringsposisjon, sentiment, kontekstkvalitet og faktisk korrekthet.
Nivå 3 · virkning
Henvisningstrafikk, merkevaresøkvolum og konvertering. Svakest dokumentert i feltet — rapporteres med usikkerhet.

Signaler

Hva motoren faktisk plukker opp

Listen er sjekkbar med vilje. Er du usikker på om pilaren er dekket, er dette punktene å gå gjennom først.

  • Aktiveringsrate: andel kjøringer der søk faktisk ble aktivert.
  • Hentbarhet: andel kjøringer der du er blant kildene, per motor.
  • Siteringsandel, betinget og ubetinget, oppgitt hver for seg.
  • Andel av total sitatmasse mot konkurrentene.
  • Siteringsposisjon: primærkilde, støttekilde, eller navn nevnt uten attribusjon.
  • Sentiment og kontekstkvalitet: nevnes du i riktig sammenheng, for riktig tema?
  • Faktisk korrekthet: er det som sies om deg sant?
  • Henvisningstrafikk, merkevaresøkvolum og konvertering fra AI-kanaler.

Taktikker

Hva du faktisk gjør

Prioritert etter forholdet mellom innsats og effekt. Ta «må ha» i rekkefølge før du åpner de to neste gruppene.

Må ha

Gjøres først. Uten disse er resten uten feste.

  1. Etabler promptbiblioteket

    Minimum 50, ideelt 200, fra faktiske brukerformuleringer. Minst 80 prosent non-brand. Tre til fem parafraser per informasjonsbehov, kategorisert per emne, intensjonstype og konkurrent.

  2. Kjør med gjentakelser

    Minst tre kjøringer per prompt per periode, sju til åtte som mål. Under tre kan variasjon ikke skilles fra effekt.

  3. Registrer aktiveringsrate som eget felt

    Aldri skjult i nevneren på siteringstall.

  4. Behold nullresultatene

    Svar uten søk, uten siteringer eller med feil er utfall, ikke data som skal kastes. Fjernes de, blir tallet systematisk for høyt.

  5. Mål på tvers av motorer

    Minimum fire. Siteringsmønstrene varierer for mye til at én motor sier noe om helheten.

  6. Etabler baseline før endringer

    Minimum fire uker under gjeldende protokoll. Dette er kontrollport 1.

Bør ha

Neste lag. Tydelig effekt, høyere innsats.

  1. Kjør kontrollerte før- og etter-tester

    Ved hver intervensjon: dedikerte prompts knyttet til akkurat den endringen, målt før og etter, med kontrollperiode eller kontrollgruppe.

  2. Mål troskap systematisk

    Stratifisert utvalg, manuelt verifisert: blir du gjengitt riktig, i riktig sammenheng, til støtte for noe du faktisk står for?

  3. Benchmark konkurrentene

    Samme bibliotek, samme protokoll. Du kan vokse absolutt og tape relativt.

  4. Sett opp varsling

    Automatiske varsler ved endringer som overstiger normal spredning. Terskelen settes ut fra målt spredning, ikke ut fra et rundt tall.

Kan ha

Der grunnlaget står, og kapasiteten finnes.

  1. Mål per emne, ikke bare aggregert

    Hvilke emner er du sterk på, og hvor er gapene?

  2. Mål per persona

    Motoren svarer ulikt til en forbruker, en fagperson og en journalist.

  3. Skill rangert sitering fra ren omtale i brødtekst

    De har svært ulik verdi, og slås rutinemessig sammen i verktøyene.

Anti-patterns

Den vanligste feilen

Å rapportere et punktestimat uten spredning. Nær beslektet: å kaste nullresultatene, som gir systematisk for høye tall, og å bruke merkevareprompts som hovedmål, som måler gjenkjennelse og kaller det synlighet. Alle tre gir en rapport som ser bedre ut enn virkeligheten.

  • Å måle én gang per prompt. Måler støy, rapporterer som signal.
  • Å bare måle trafikk. Størstedelen av AI-søk ender uten klikk.
  • Å bruke pyntede showspørringer framfor et kvalifisert bibliotek.
  • Å bruke merkevareprompts som hovedmål. Måler gjenkjennelse, ikke oppdagelse.
  • Å kaste nullresultater. Gir systematisk for høye tall.
  • Å rapportere punktestimat uten spredning.
  • Å ikke måle konkurrentene.
  • Å rapportere kvartalsvis. For tregt — skaden er skjedd før du ser den.
  • Å attribuere effekt uten kontroll. Se kontrollport 4.

Måling

Hva som lar seg måle, og hvor ofte

Denne pilaren er målingen. Minimum: gjentatt kjøring per prompt, aktiveringsrate registrert separat, nullresultater beholdt, og spredning oppgitt sammen med hvert tall. Troskap kontrolleres som stikkprøve — 20 til 30 siteringer per periode, stratifisert over motorer og emner, gjennomgått manuelt.

Ukentlig
Gjennomføringsgrad på promptbiblioteket. Datakvalitetskontroll: er resultatene sammenliknbare med forrige periode, eller har noe i oppsettet endret seg?
Månedlig
Trendgjennomgang på alle tre KPI-nivåer. Hvilke endringer er implementert, og hva var effekten — med oppgitt usikkerhet.
Kvartalsvis
Full protokollgjennomgang. Promptbiblioteket friskes opp: nye spørringer inn, utdaterte ut. Revisjon av verktøyvalg.

Alle tall følger de samme minimumskravene: gjentakelser, aktiveringsrate som eget felt, nullresultater beholdt og spredning oppgitt. Se kravene i metoden.

Sjekkliste

Implementering: tilbakemelding

  • Promptbibliotek etablert, minimum 50 spørringer
  • Minst 80 prosent non-brand
  • Tre til fem parafraser per informasjonsbehov
  • Minst tre kjøringer per prompt per periode
  • Aktiveringsrate registrert som eget felt
  • Nullresultater beholdt i datasettet
  • Måling på minimum fire motorer
  • Baseline over minimum fire uker før endringer
  • Spredning oppgis i all rapportering
  • Troskapskontroll etablert med stratifisert utvalg
  • Konkurrentbibliotek for benchmark
  • Varslingsterskler satt ut fra målt spredning
  • Protokoll for før- og etter-eksperimenter dokumentert
  • Månedlig gjennomgang i kalenderen
  • Kvartalsvis protokollrevisjon planlagt

Les videre om tilbakemelding

Egne tester og analyser som utdyper denne pilaren.

Vil du vite hvordan du står på tilbakemelding?

En AI-synlighetsanalyse måler deg på alle fem pilarene og sier hvilken av dem som faktisk stopper deg. Vi tar 30 minutter på det først — uforpliktende.