AI i hverdagen

Kan du stole på AI-sammendraget øverst i Google-søket ditt?

O
Ole Gunnar Hellenes··6 min lesing

Sist faktasjekket:

Et sammendragskort med grønne hakemerker og gule spørsmålstegn under en lupe viser ulik pålitelighet i påstandene

Kort oppsummert

Bare delvis. Googles AI-sammendrag gir riktig faktasvar i rundt 91 prosent av tilfellene, viser en fersk studie fra selskapet Oumi, men bare 39 prosent av sammendragene var fullt ut til å stole på. Og fordi Google behandler over fem billioner søk, blir selv en liten feilandel til titalls millioner feil svar hver time.


Et tall som er lettere å feiltolke enn du tror

91 prosent riktig høres ut som en god poengsum på en prøve. Problemet er at et søk ikke er en prøve. Du søker titalls ganger hver dag, og det gjør milliarder av andre mennesker også.

Oumi testet nøyaktigheten til Googles AI-oversikter direkte i en studie som ble publisert i april 2026. Forskerne brukte datasettet SimpleQA, som består av over 4 000 faktaspørsmål utviklet av OpenAI, og sammenlignet overskrifter generert av Gemini 2 med dem fra den mer avanserte Gemini 3. For Gemini 3 inneholdt 91 prosent av svarene riktig faktasvar. Studien er omtalt av blant annet New York Times, New York Post og Popular Science.

Oumi selv legger likevel vekt på et annet og strengere tall, som selskapet kaller “trustworthy”, altså til å stole på. Da telles et svar bare som trygt hvis det både har riktig svar og alle påstandene i teksten er dekket av kildene som er oppgitt. Med dette målet var bare 39 prosent av AI-oversiktene fullt ut til å stole på, selv om 91 prosent hadde riktig svar på selve spørsmålet. Selv når AI-oversikten svarer riktig på det du spurte om, inneholder den altså ofte andre påstander som kildene ikke dekker. Ifølge Oumi var bare 67 prosent av alle enkeltpåstandene i overskriftene støttet av de oppgitte kildene. Resten kaller Oumi hallusinert innhold.

New York Times og Popular Science har regnet på hva selv det snillere 90 prosent-tallet betyr i praksis. Google behandler over fem billioner søk i 2026, og da blir en feilrate på rundt 10 prosent til titalls millioner feilaktige svar hver eneste time, samlet for alle som søker akkurat da. Det gjør ikke 91 prosent til et dårlig tall i seg selv. Men når bare 39 prosent i tillegg er fullt ut til å stole på, ser du at “riktig svar på spørsmålet” er noe annet enn “trygt å stole blindt på hele teksten”. Det gjelder særlig når volumet er så enormt.

Mål Resultat (Oumi, Gemini 3)
Riktig faktasvar 91 prosent
Fullt ut til å stole på (“trustworthy”: riktig svar OG alle påstander kildedekket) 39 prosent
Enkeltpåstander faktisk støttet av oppgitte kilder 67 prosent

Hvorfor tar AI-sammendraget feil i utgangspunktet?

AI-oversikten leser raskt gjennom flere nettsider og setter sammen et sammendrag av det den finner, så du slipper å besøke og vurdere hver kilde selv. Men her møter den den samme utfordringen som gjør at KI-modeller av og til hallusinerer. Modellen kan nemlig formulere seg selvsikkert selv når den egentlig er usikker eller har tolket noe feil.

Fagfolk peker oftere på noen årsaker enn andre. For det første kan modellen forveksle satire eller humor med fakta hvis den ikke fanger opp den ironiske tonen i kilden. For det andre kan den blande sammen kilder med ulik troverdighet, og behandle en tilfeldig blogg og en etablert fagkilde som like gode hvis begge dukker opp i søket. For det tredje kan den presentere utdatert informasjon som om den fortsatt gjelder. Dette kalles gjerne “tidsforvirring”, og det skjer særlig når svaret på et spørsmål har endret seg nylig.

Et dokument med et løst hjørne avslører en gråtonet side under, symbol på utdatert informasjon presentert som aktuell


Dette er noe annet enn “hvordan påvirker det trafikken til nettsiden min”

Her på AIFokus finnes det allerede en forklaring av hva AI-oversikter er. Den er skrevet for deg som eier en nettside og lurer på hvordan funksjonen påvirker synlighet og trafikk. Denne artikkelen stiller et annet spørsmål: Skal du som søker stole på det du leser i boksen? Det er et forbrukerspørsmål og ikke et markedsføringsspørsmål, og det fortjener et eget, ærlig svar i stedet for å bli en bisetning i en artikkel for nettsideeiere.

Da vi researchet denne artikkelen, fant vi ingen norske kilder som tok for seg spørsmålet fra en vanlig søkers side. Alt norsk materiale om temaet var skrevet for markedsførere og SEO-bransjen. Det viser i seg selv at spørsmålet er reelt, men lite dekket for vanlige søkere.


Når bør du være ekstra skeptisk?

Vær først og fremst skeptisk ved helsespørsmål. KI-systemer har en dokumentert svakhet nettopp når de skal vurdere hvor alvorlig noe er, og om en situasjon er akutt. Det gjelder like mye for et AI-sammendrag i søket som for en chatbot du snakker direkte med. Vi går gjennom dette i detalj i artikkelen om KI som helserådgiver.

Det samme gjelder juridiske eller økonomiske spørsmål med konkrete konsekvenser. Frister, rettigheter og regelverk endrer seg ofte over tid, og da kan en KI presentere utdatert informasjon som om den fortsatt gjelder.

Vær også på vakt ved ferske hendelser. Når noe nettopp har skjedd, har modellen hatt minst tid til å “lære” hvordan ting henger sammen. Derfor er risikoen for både utdaterte og feilaktige sammendrag høyest da.

Til slutt bør du passe deg ved omstridte temaer. Er fagfolk eller offentligheten virkelig uenige om et spørsmål, er det en advarsel i seg selv hvis AI-sammendraget gir ett svar som om det var helt sikkert.

I alle disse situasjonene er den enkleste og sikreste vanen å klikke deg videre til kildene AI-sammendraget bygger på, i stedet for å stoppe ved boksen.

En grønn pil og et pekende håndikon leder blikket forbi sammendragskortet og ned til kildedokumentet


Vanlige spørsmål

Er AI-oversikten alltid feil på samme type spørsmål?

Nei. Feilraten varierer med typen spørsmål, og med hvor godt pålitelige kilder på nettet dekker temaet. Generelle faktaspørsmål med godt etablerte svar har som regel lavere feilrate enn ferske, omstridte eller svært spesifikke spørsmål.

Kan jeg melde fra hvis AI-sammendraget er feil?

Ja. I selve AI-oversikt-boksen har Google en funksjon der du kan markere et svar som unøyaktig. Det retter ikke nødvendigvis feilen med en gang for andre søkere, men det hjelper Google med å justere systemet over tid.

Er dette det samme problemet som hallusinasjon?

Det er nært beslektet, men ikke det samme. Hallusinasjon betyr generelt at en språkmodell dikter opp informasjon den ikke har grunnlag for. Feil i AI-oversikten handler oftere om at modellen tolker eller setter sammen ekte kilder feil. Den kan for eksempel ta satire bokstavelig, eller presentere utdatert informasjon som om den fortsatt gjelder.

Blir dette bedre etter hvert som modellene forbedres?

Delvis. Andelen svar med riktig faktasvar gikk klart opp fra Gemini 2 til dagens Gemini 3, som traff riktig i 91 prosent av tilfellene, ifølge Oumi. Men Oumi fant samtidig at andelen hallusinerte påstander også økte fra Gemini 2 til Gemini 3. Forskerne knytter det til at nyere, mer “tenkende” modeller hallusinerer mer i noen sammenhenger. En nyere modell er altså ikke automatisk bedre på begge målene samtidig.


Oppsummering og kilder

Det viktigste å huske:

  • Googles AI-oversikt gir riktig faktasvar i rundt 91 prosent av tilfellene, men bare 39 prosent av oversiktene er fullt ut til å stole på, ifølge en studie fra 2026
  • Gitt over fem billioner søk i året, betyr selv denne feilraten titalls millioner feilaktige svar hver time
  • Feilene skyldes ofte feiltolket satire, sammenblandede kilder eller utdatert informasjon
  • Vær ekstra skeptisk ved helse-, juss- og ferske nyhetsspørsmål: klikk deg videre til kildene

Kilder brukt i denne artikkelen:

Sist oppdatert: August 2026

Les også

En chatboble med spørsmålstegn og et personikon med hake viser at KI kan spørres, men fagperson bør bekrefte svaret
AI i hverdagen24. aug. 20267 min

Kan du stole på ChatGPT som helserådgiver?

Selv helseministeren har sagt at han vil ha nordmenn bort fra å bruke Google og ChatGPT når de får nye symptomer. Forskning viser at KI-chatboter har lav treffsikkerhet nettopp på å vurdere hvor alvorlig et symptom er. Her er hva du faktisk kan og ikke bør bruke KI til når det gjelder helsen din.

Les artikkelen →
En vifte av like dokumentkort viser at ett kort med grønn markering og pennemerke skiller seg fra resten.
AI i hverdagen24. aug. 20267 min

Kan rekruttereren se at du brukte KI i jobbsøknaden din?

NTNU har droppet søknadsbrev i deler av sin rekruttering, rett og slett fordi strømmen av KI-genererte søknader gjorde dem mindre nyttige. Spørsmålet er kanskje ikke om rekrutterere "avslører" KI-bruk teknisk, men at KI-språket ofte gjør søknaden mindre overbevisende. Her er hva som faktisk skjer, og hvordan du bruker KI uten at det går ut over deg.

Les artikkelen →
Et lite ikon med en grønn lydbølge sitter ved en tom plass ved møtebordet og viser KI-referenten som ekstra deltaker
AI i hverdagen24. aug. 20267 min

En KI lyttet med på møtet ditt: Hva skjer med alt som ble sagt?

KI-baserte møtereferenter som Otter, Fireflies og Teams Copilot er blitt vanlig på norske arbeidsplasser, ofte uten at alle deltakerne aktivt har samtykket. Otter er saksøkt for påstått bruk av møtedata til KI-trening. Her er hva som faktisk skjer med det som blir sagt, og hvordan du sjekker og endrer innstillingene selv.

Les artikkelen →
#ai-i-hverdagen#google#hallusinasjon