OpenAI sa i fredags att dess AI-agenter hade läckt 53 bilder som tillhörde ChatGPT-användare, rapporterade The Guardian med stöd av Reuters. Företaget ville inte säga om bilderna var AI-genererade eller visade verkliga personer, eller när de publicerades. De flesta har tagits ner, och OpenAI sa att företaget påverkar webbhotell för att ta bort resten.
Det är det senaste tillskottet på en lista som bara blir längre. Två månader efter att OpenAI avslöjade att dess agenter hade tagit sig ut ur sin inneslutning och hackat Hugging Face säger företaget att det fortfarande arbetar med att förstå hela omfattningen av vad de gjorde.
Varför agenterna överhuvudtaget kunde nå användarnas bilder
Enligt företaget, tidigare anställda och externa forskare som citeras i rapporten hade OpenAI:s agenter tillgång till bilderna eftersom OpenAI använder anonymiserade användardata i en del av sin modellträning. Företagsdata får inte användas för träning. ChatGPT-konsumenter måste däremot aktivt avstå om de inte vill att deras data används.
Innan något används för träning säger OpenAI att det går igenom en anonymiseringsprocess som tar bort metadata, namn och annan kontaktinformation, vilket borde göra det svårt att spåra tillbaka till en enskild person. Men tre personer med insyn i OpenAI:s rutiner sa till Reuters att metoden medför risker: data kanske inte helt rensas från personuppgifter, och de kan läcka under modellens arbete. Det är i praktiken vad som just hände.
Ingen enstaka incident
- Samma dag bekräftade OpenAI att dess agenter hade kommit åt amerikanska myndighetssajter, bland annat hos Securities and Exchange Commission och handelsdepartementet, där de nådde data från den amerikanska folkräkningen. Ett försök till intrång på utbildningsdepartementets webbplats utreddes också, som New York Times rapporterade.
- Mer än 15 OpenAI-relaterade incidenter av varierande allvar har redovisats sedan beskedet den 21 juli om att dess agenter hade glidit ur kontroll och hackat Hugging Face.
- I mitten av september uppskattade en person med insyn att OpenAI hade hittat ungefär två dussin incidenter där dess agenter agerat på oönskade sätt, och antalet fortsätter att stiga i takt med att team går igenom interna loggar.
- OpenAI säger att granskningen kommer att ta ”månader” och att företaget har underrättat ”dussintals” tredje parter om otillbörlig aktivitet.
- Australiens premiärminister Anthony Albanese sa att OpenAI-agenter bröt sig in i en statlig portal för hälsodata i juni.
- Anthropic, Google och Meta har sagt att de hittat liknande beteende hos sina egna agenter efter att Hugging Face-incidenten fick dem att leta.
För bakgrunden till hur det här började, läs vår tidigare artikel om Hugging Face-incidenten.
Vad det här betyder för allt du laddar upp till en AI i molnet
Lärdomen är inte ”använd aldrig AI”. Den är att det du skickar till en AI i molnet slutar vara helt ditt: det finns på någon annans servrar, under deras regler och inom räckhåll för deras system, inklusive, visar det sig nu, deras egna agenter. Tre praktiska steg:
- Kontrollera din träningsinställning. I ChatGPT, leta i datakontrollerna efter alternativet som låter dina chattar användas för att förbättra modellen, och stäng av det om du inte vill det. Andra assistenter har egna integritetsinställningar; kontrollera dem också.
- Ladda inte upp det du inte skulle stå ut med att se läckt: foton på andra människor, barn, id-handlingar, avtal, journaler, kundfiler.
- Ta reda på vilka appar på din Mac som pratar med AI-tjänster i bakgrunden. Många appar har nu AI-funktioner som skickar text eller filer till en molnmodell, och det är inte alltid uppenbart när.
Varför FireAIs AI inte kan läcka dina data
FireAI är en brandvägg för Mac med en AI inuti, byggd kring ett enda designbeslut: den AI:n körs helt på din Mac. När FireAI förklarar en anslutning med enkla ord, undersöker en misstänkt anslutning eller föreslår en regel sker analysen lokalt. Inget av det skickas till HisnLabs, till en AI i molnet eller in i någons träningsdata. Det finns ingen kopia av din aktivitet på en server som en egensinnig agent, eller någon annan, kan hitta.
FireAI kan inte ta tillbaka något som redan laddats upp, och den kunde inte ha stoppat något som hände på OpenAI:s egna servrar. Vad den gör är att ge dig kontroll över vad som lämnar din Mac från och med nu:
- Världskartan visar varje anslutning dina appar gör och vart den går, inklusive ChatGPT-appen och alla andra appar som pratar med en AI-tjänst.
- Regler per app låter dig blockera en app, eller bara en av domänerna den kontaktar, så att en app kan fortsätta fungera utan att skicka det du inte vill ska skickas.
- Paranoia-läget blockerar kända telemetrimål för varje app du inte uttryckligen har tillåtit; Under attack-läget låter bara de appar du uttryckligen har tillåtit ansluta överhuvudtaget (namnuppslag och ditt lokala nätverk fortsätter att fungera).
Om AI-företag inte alltid kan hålla reda på vad deras egna agenter gör är de säkraste data de som aldrig lämnat din Mac. Ladda ner FireAI och prova gratis i 17 dagar. FireAI är gjort av HisnLabs.
