OpenAI sin KI hacket seg inn i selskap på egen hånd

– Et eksempel på hvor lite kontroll OpenAI har over sin egen teknologi, sier KI-professor.

cUIDuC5KCns

OpenAI-sjef Sam Altman kaller datainnbruddet en alvorlig hendelse.

Foto: AFP

I forrige uke oppdaget KI-selskapet Hugging Face at deres databehandlingssystemer var utsatt for et datainnbrudd.

NÃ¥ viser det seg at det var KI-systemet til konkurrenten OpenAI som stod bak hackingen.

Ifølge OpenAI skal den kunstige intelligensen ha handlet på egen hånd.

– Vi hadde en alvorlig sikkerhetshendelse under evalueringen av modellene våre, sa OpenAI-sjef Sam Altman, ifølge nyhetsbyrået AP.

Bilde av Sam Altman sjefen i OpenAI. Han sitter på en scene med en mikrofon i hånden.

OpenAI er selskapet bak språkmodellen ChatGPT. Her holder OpenAI-sjef Sam Altman en tale i Paris.

Foto: JOEL SAGET / AFP

Hendelsen skal ha skjedd da OpenAI holdt på med testing av cybersikkerhetsevnene til to av modellene sine.

Testen skulle skje i et trygt testmiljø, men modellene fant på egen hånd en sårbarhet som tillot dem å koble seg til internett, ifølge OpenAI.

– Dette er et eksempel på hvor lite kontroll OpenAI har over sin egen teknologi, sier KI-professor Morten Goodwin ved Universitetet i Agder.

Tar uforutsette snarveier

Det er en økende bekymring for at nye KI-modeller kan være svært kraftige verktøy for hacking.

– Teknologien er så kraftig og vi har så lite kontroll over den at den løper litt foran oss, forteller Goodwin.

– Hovedproblemet med kunstig intelligens er at vi ikke har løst det som kalles alignment-problemet, eller verdisamsvar, forklarer Lotte Skolem.

Hun er leder for fremvoksende teknologier i tankesmien Langsikt, og forteller at modellene ofte har en tendens til å oppføre seg annerledes enn det vi ønsker at de skal.

portrettfoto av Lotte Skolem i tenketanken Langsikt

– Hele sikkerhetsargumentet for å kjøre farlige evalueringer hviler på at man kan holde det farlige innelåst, sier Lotte Skolem i Langsikt

Foto: The Life Science Cluster / ;

– Det handler om hvordan vi får KI-modellene til å gjøre det vi mennesker faktisk ønsker, uten at de tar uforutsette snarveier. De kan finne på å ta snarveier, manipulere eller til og med lure brukeren for å løse en oppgave, sier Skolem.

Hun mener dette er varsel om at vi må ta KI-sikkerhet mye mer på alvor enn vi gjør i dag.

– Det eksempelet fra OpenAI viser, er behovet for uavhengig forskning på KI-sikkerhet. Vi trenger organer som kan stressteste modellene for å oppdage hvorfor slik skjer og hvordan man kan forhindre det.

Les også Slik blir KI-bruken din mer bærekraftig

En mobilskjerm med mange app-ikoner for kunstig intelligens

Egne interesser

Da Hugging Face oppdaget datainnbruddet forrige uke, beskrev de det som et reelt angrep.

– At det egentlig var en evaluering som brøt ut av sitt eget testmiljø, vet vi bare fordi OpenAI selv valgte å fortelle det, med sine egne ord og på sin egen tidslinje, sier Skolem.

Ingen uavhengig part har verifisert den fremstillingen, forklarer hun.

– Det er ikke først og fremst et tillitsproblem, men et kunnskapsproblem: Ingen bør være eneste kilde til bevisene om sin egen risiko. Det er et sterkt argument for uavhengig testing, mener hun.

En mann i dress går forbi en buet betongvegg i en offentlig bygning. I bakgrunnen sitter flere personer på en benk. Gulvflisene er lyse, og det er lamper langs veggen. Omgivelsene tyder på et moderne og urbant miljø. (Bildebeskrivelsen er laget av en KI-tjeneste)

– Vi ønsker mer kontroll av denne teknologien for dette er en av de teknologiene som vi er sikker på kommer til å påvirke oss veldig mye i fremtiden, sier professor i KI, Morten Goodwin.

Foto: Erling Slyngstad Hægeland / Privat

KI-professor Goodwin mener at OpenAI også har økonomiske insentiver for å offentliggjøre dette, og en del av offentliggjøringen handler om ren markedsføring.

– Når OpenAI forteller oss historien, forteller de også at deres egen teknologi er så kraftig og så stor at du er nødt til å investere i dem og ikke de andre teknologifirmaene, sier Goodwin.

Les også Kan KI gjøre oss syke? Jeg testet

En collage av en kvinne med briller foran flere bilder av ulike chatloger fra KI-modeller

Samarbeider med OpenAI

Hugging Face sier de nå samarbeider med OpenAI, og at de ikke tror det ble gjort med vilje.

– Vi er helt overbevist om at det ikke lå noen ondsinnet hensikt bak fra deres side, sier Clément Delangue, medgründer og administrerende direktør i Hugging Face.

Les også Her har KI gått skikkelig galt

En robot som snubler

OpenAI opplyser at datainnbruddet ble forårsaket av en kombinasjon av selskapets KI-modeller, blant annet den nylig lanserte GPT-5.6 Sol og en «enda mer avansert» modell som fortsatt testes internt. Testen skal ha blitt gjennomført for å se hvor godt de kunne koble sammen nettbaserte sårbarheter til et vellykket cyberangrep.

Ifølge OpenAI brukte KI-ene stjålne innloggingsopplysninger og oppdaget en tidligere ukjent sårbarhet for å få tilgang til Hugging Faces sine servere.

KI-en gikk «svært langt for å nå et ganske snevert mål i testen» og «fant måter å få tilgang til hemmelig informasjon som den kunne bruke til å jukse i evalueringen», ifølge selskapet.

Etter publisering har NRK lagt til noen presiseringer i teksten, for å tydeliggjøre hva som skjedde. Artikkelen ble oppdatert 23.juli, klokken 12:30.

AKTUELT NÃ