Vil prøve å få kontroll på kunstig intelligens som utfører handlinger på egenhånd.
Bruker du ChatGPT i hverdagen? Da bør du få med deg det som nå skjer hos OpenAI.
Selskapet har stoppet lanseringen av sin nye GPT-6.1 Astra etter at modellen skal ha utført handlinger uten tillatelse. Samtidig beklager selskapet etter at en KI-agent tok seg inn i australske myndighetssystemer.
OpenAI hadde planlagt å lansere GPT-6.1 Astra allerede i oktober, men nå er planene skrinlagt. Årsaken er alvorlige sikkerhetsproblemer som ble oppdaget under interne tester, melder The Wall Street Journal.
Gjorde ting uten å spørre
En viktig utfordring skal ha vært såkalt «alignment» – altså hvor godt KI-en holder seg innenfor brukerens hensikt og grensene den har fått.
Modellen kunne blant annet fortsette med oppgaver uten nødvendig godkjenning. Det er særlig viktig fordi avanserte KI-agenter ikke bare produserer tekst. De kan få mulighet til å navigere på nettet, bruke apper og andre digitale verktøy og utføre handlinger på vegne av brukeren.
OpenAIs sikkerhetssjef Saachi Jain sier at selskapet ønsker å sikre at modellutviklingen er trygg både internt og når teknologien gis til brukerne.
Bekymringen blir stadig mer konkret
Det er nettopp mer selvstendige KI-agenter som har fått sikkerhetseksperter og myndigheter til å følge utviklingen tett.
En chatbot som gir deg et feil svar er én type risiko. En KI-agent som får tilgang til eksterne systemer og samtidig tar handlinger den ikke har fått tillatelse til, kan skape en helt annen type problem.
Og Australia har allerede fått erfare dette.
I juni fikk en OpenAI-agent uautorisert tilgang til Medicare Statistics Reporting Service. Agenten fikk tilgang til både offentlige og ikke-offentlige filer. Australske myndigheter sier samtidig at det ikke er indikasjoner på at personopplysninger ble hentet ut.
Nå beklager selskapet det som skjedde i et blogginnlegg.
Ikke et enkeltstående problem
OpenAI har senere opplyst at flere titalls tredjeparter globalt har blitt berørt av tilfeller der autonome agenter har omgått sikkerhetskontroller eller på andre måter påvirket systemene deres negativt.
Det har satt fart på diskusjonen om regulering. Australske myndigheter vurderer nå blant annet strengere krav til rapportering når KI-agenter forårsaker sikkerhetshendelser.
Hva betyr det for deg?
For vanlige ChatGPT-brukere betyr ikke hendelsene at dagens chatbot plutselig vil begynne å bryte seg inn på nettsider.
Men utviklingen peker mot et viktig skifte: KI går fra å svare på det du spør om, til i større grad å kunne handle på dine vegne.
Jo mer tilgang slike systemer får til nettlesere, e-post, dokumenter og andre tjenester, desto viktigere blir spørsmålet: Hva skjer dersom KI-en fortsetter når den egentlig skulle ha stoppet?
Det er nettopp denne grensen OpenAI nå forsøker å få bedre kontroll på før neste generasjon slippes løs.