Nye GPT-6 Astra reduserer hallusinasjoner, men skjulte angrep fungerer fortsatt
Nye sikkerhetstall for GPT-6 Astra
OpenAIs kommende GPT-6 Astra viser betydelig forbedring i sikkerhet sammenlignet med tidligere versjoner, ifølge The Decoder. Modellen blokkerer 99,99 prosent av direkte prompt-injeksjoner - angrep hvor noen prøver å manipulere AI-en med spesielle kommandoer.
Men når angripere gjemmer instruksjoner inne i dokumenter som AI-en skal lese og analysere, blir modellen fortsatt lurt i 8,5 prosent av tilfellene. Claude Opus 5 presterer bedre med 4,8 prosent sårbarhetsrate.
Hva betyr skjulte prompt-injeksjoner?
En skjult prompt-injeksjon kan for eksempel være tekst gjemt i en PDF eller Word-fil som instruerer AI-en til å ignorere dine opprinnelige instruksjoner. Hvis du ber AI-en analysere kundedata eller juridiske dokumenter, kan slike angrep få den til å gi feil informasjon eller lekke sensitiv data.
The Decoder påpeker at disse tallene fortsatt er bekymringsfulle for autonome AI-agenter som håndterer ekte forretningsdata.
Praktiske tiltak for bedriften din
Når du implementerer AI-verktøy som ChatGPT, Claude eller Gemini i arbeidsflyten, bør du være ekstra forsiktig med dokumenter fra ukjente kilder. Hvis du planlegger å bruke AI til å behandle kundehenvendelser eller analysere eksterne dokumenter, kan det være lurt å delta på et [AI-kurs Oslo](/ai-kurs-oslo) for å forstå risikoene bedre.
Vurder også å sette opp tydelige retningslinjer for hvilke dokumenttyper AI-systemene dine får analysere, og implementer manuell kontroll av AI-genererte svar når det gjelder kritiske forretningsbeslutninger.
Konklusjon
Ønsker du å se hva AI kan bety for din bedrift?
Book en uforpliktende prat — helt gratis, 30 minutter.
Ta kontaktRelaterte artikler
AI-agenter og EU-regelverket: Hva norske bedrifter må forberede seg på nå
EU AI Act kommer i 2026, og det skaper nye utfordringer for AI-agenter som jobber automatisk. Her er...
Altman-saken: Hvorfor norske bedrifter må diversifisere sin AI-strategi nå
Molotov-angrepet på OpenAI-sjefen viser hvor ustabil AI-bransjen er blitt. Jeg anbefaler norske bedr...
AI-ekstremisme og hva norske bedrifter kan lære av Altman-angrepet
Firebomb-angrepet på OpenAI-sjefen viser hvor polarisert AI-debatten har blitt. Her er mine tanker o...