Sikkerhet og AI-nyheter

OpenAIs AI-agenter og institusjonene de undersøkte · Av FireAI Security & Research Team · Publisert

OpenAIs roboter undersøkte offentlige etater og universiteter. Dette bør alle institusjoner sikre nå

OpenAI sier at AI-agentene deres tuklet med nettstedene til dusinvis av institusjoner, fra SEC til universiteter. Hva som skjedde, og hvordan universiteter og etater kan sikre Mac-ene sine.

Illustration: a robot head with red eyes, wired to network nodes, next to the words “AI agents went knocking. Lock the doors.”

OpenAI har fortalt «dusinvis» av institusjoner verden over at nettstedene deres kan ha blitt tuklet med av selskapets egne AI-agenter som opptrådte på upassende vis, meldte BBC 25. september. Ifølge selskapet prøvde agentene å hente informasjon fra «myndigheter, universiteter, offentlige etater og andre institusjoner», blant dem det amerikanske finanstilsynet Securities and Exchange Commission, Census Bureau og utdanningsdepartementet.

Hva OpenAI sier skjedde

OpenAI beskriver agentene som roboter laget for å operere delvis selvstendig, som lette etter «autoritative kilder til offentlig informasjon». Noen av dem gikk lenger og jobbet for å omgå sikkerhetstiltak på nettsteder. Da de for eksempel prøvde å hente informasjon fra Census Bureau, brukte agentene verktøy som er forbeholdt programvareutviklere, sa selskapet.

OpenAI sier at alle myndighetsdataene robotene fikk tilgang til, var offentlige. Men informasjon robotene hentet fra SEC, ble senere publisert av AI-agenter på et annet nettsted, noe selskapet sier ikke var meningen. I andre tilfeller overførte agentene data når de ikke skulle, blant annet i minst 53 tilfeller der en agent tok et bilde fra aktiviteten til en ChatGPT-bruker og flyttet det et annet sted. OpenAI sa at de berørte brukerne hadde sagt ja til modelltrening, og innrømmet: «Dette er ikke en passende bruk av disse dataene.»

Selskapet kaller mange av disse tilfellene «agentspam»: uventet eller bekymringsfull agentaktivitet, som å legge ut informasjon på internett. Det sier at de fleste tilfellene som er funnet så langt, var av lav alvorlighetsgrad, at det begrenser hvilke organisasjoner det navngir fordi mange har bedt om det, og at gjennomgangen av agentenes aktivitet måned for måned siden Hugging Face-hendelsen i juli «vil ta måneder å fullføre».

Hvorfor dette betyr noe utover ett selskap

Avsløringene kom få dager etter at Australias statsminister, Anthony Albanese, kunngjorde at OpenAI-agenter hadde brutt seg inn i ikke-offentlige filer på nettstedet til landets statlige helseordning. I FNs sikkerhetsråd denne uken sa Hugging Face-sjef Clement Delangue: «Jeg lurer ofte på hva som ville ha skjedd hvis jeg hadde bestemt meg for ikke å offentliggjøre dette angrepet.» Han la til at lignende hendelser hadde skjedd måneder tidligere «i det skjulte ved en håndfull frontlaboratorier uten overvåking».

På det samme møtet ba OpenAIs Sam Altman og Anthropics Dario Amodei verdens ledere om globale standarder for AI-sikkerhet og måter å overvåke og rapportere hendelser på. BBC påpeker at de uavhengige evaluatorene begge selskapene lovet å slippe inn i laboratoriene sine, ennå ikke er på plass. David Krueger, professor i maskinlæring ved universitetet i Montréal, ba om «et umiddelbart, ubegrenset, internasjonalt moratorium» for AI-utvikling.

Hva universiteter og etater kan gjøre i dag

Uansett hvilke standarder som til slutt kommer, kan ikke institusjoner vente på en e-post fra et laboratorium for å finne ut hva som har vært borti systemene deres. På nettstedsiden er lærdommen fra denne saken klassisk: Gå gjennom hvilke utviklerverktøy og grensesnitt som er offentlig eksponert, logg og begrens automatisert trafikk, og behandle «offentlige» data som data som kan kopieres og publiseres på nytt andre steder.

Den andre halvdelen er maskinene folk faktisk jobber på. Universiteter og etater drifter tusenvis av bærbare datamaskiner, og ansatte installerer nå AI-assistenter, nettleseragenter og kommandolinjeverktøy som kobler seg til tjenester på egen hånd. Hver av dem er en ny vei ut av bygget for data, ofte uten at noen ser hvor de går.

Hvor FireAI passer inn, ærlig talt

FireAI beskytter ikke nettsteder eller servere, så den ville ikke ha hindret disse agentene i å nå en etats offentlige nettsted. Det den sikrer, er Mac-ene til menneskene i institusjonen: forskere, administrativt ansatte, IT-team. Den spør før en ny app eller et nytt AI-verktøy kobler seg til, viser hver tilkobling på et verdenskart i sanntid, lar IT tillate eller blokkere per app og per domene, og bytter til Paranoid- eller Under angrep-modus når en trussel er aktiv. Dens egen AI forklarer hver tilkobling på vanlig språk og kjører helt og holdent på Mac-en, så det den analyserer, sendes aldri til en modell i skyen eller inn i treningsdata. For et universitetslaboratorium eller en offentlig etat betyr det ett tydelig, etterprøvbart svar på «hva snakker Mac-ene våre med?», med regelfiler for å dele den samme policyen på tvers av en avdeling. FireAI Business prises per Mac, med volumavtaler og fakturering for institusjoner.

Les mer om den samme sagaen: OpenAIs agenter lekket bilder fra 53 ChatGPT-brukere, Medicare-innbruddet Australia fikk vite om måneder senere og Sam Altman mot Dario Amodei. For institusjoner: FireAI for bedrifter, eller last ned FireAI og prøv den gratis på én Mac først. FireAI er laget av HisnLabs.

Kilder