Podd #363: Ai-agenterna anfaller igen

Mitt i sommaren blev det stora rubriker när webbtjänsten Hugging Face avslöjade att de hade blivit attackerade av autonoma ai-agenter. Det visade sig senare vara Open AI som låg bakom attacken. På grund av en sårbarhet hade ai-agenter lyckats smita ut från testmiljön där Open AI utvärderade sina ai-modeller.  

När Open AI:s konkurrent Anthropic såg rubrikerna ställde de sig frågan: månntro om vi har råkat göra samma misstag? Svaret var ja. Förra veckan publicerade Anthropic ett blogginlägg där de erkände att de hade orsakat tre liknande incidenter. Den första dokumenterade incidenten hade inträffat redan i april, flera månader före attacken mot Hugging Face. I ett av fallen hade ai-modellen Opus 4.8 lyckats utföra ett intrång och stjäla hundratals rader ur ett oskyldigt företags databas.

Listan över oavsiktliga attacker från autonoma ai-agenter förlängdes ytterligare nu i veckan. Brittiska AISI (AI Security Insitute) meddelade att de hade råkat låta ai-modellerna Mythos 5 och GPT 5.6 Sol attackera oskyldiga måltavlor. Mythos 5 hade bland annat försökt lura underhållarna av ett Github-projekt att godkänna ett infekterat bidrag.

Dessa incidenter kan vara bakgrunden till ett öppet brev som har undertecknats av över 1 300 medarbetare vid de ledande amerikanska ai-företagen, däribland ai-forskningscheferna hos Open AI, Anthropic, Meta och Google. Medarbetarna anser att världen behöver ”tid för att hantera framväxande risker, utveckla säkerhetsåtgärder och stärka tillsynen”. De ber därför den amerikanska regeringen att stödja ett internationellt samarbete för att ta fram de nödvändiga styrverktygen.

I veckans poddavsnitt pratar Peter och Nikka om de nyligen avslöjade ai-attackerna och oron som de orsakar hos ai-företagens medarbetare. Podduon pratar också om två brister i Icloud privacy-tjänster. Apples tjänst ”Dölj min e-postadress” hade en sårbarhet som röjde användarnas riktiga e-postadresser. ”Privat reläservice” är än i dag implementerat på ett vis som gör att webbplatser kan se användarnas ip-adresser även om användarna har aktiverat privacy-funktionen.

Kapitel i avsnittet

Omtalat i avsnittet

Detta poddavsnitt och dess tillhörande artikel är publicerade under CC BY 4.0-licens, med undantag för citat och bilder där en annan fotograf är angiven.

Kommentar