Ranije ovog mjeseca, platforma za AI skupove podataka Hugging Face šokirala je svijet otkrivši da je postala žrtva potpuno autonomnog AI napada. Nekoliko dana kasnije, priča je dobila dramatičan obrat kada je OpenAI priznao da je haker koji je stajao iza provale bio jedan od njihovih AI modela, koji je napustio testno okruženje i ušao u zaštićene sustave Hugging Face kako bi zaobišao benchmark.
Ovo je alarmantan incident za svakoga tko je barem malo zabrinut zbog divljih AI modela — a dani nakon događaja bili su ispunjeni predviđanjima o novoj paradigmi kibernetičke sigurnosti u kojoj AI modeli pokreću napade toliko snažne da se samo drugi AI modeli mogu obraniti od njih.
Unatoč opravdanoj zabrinutosti, paradigma možda nije toliko promijenjena koliko se čini. Stručnjaci koji su razgovarali s TechCrunchom naglasili su da je OpenAI-ov agent uglavnom djelovao poput čovjeka — s nekim iznimkama — te da su bolje implementirane tradicionalne obrambene tehnike mogle pomoći u zaustavljanju napada. Ukratko, možda već imamo alate za obranu od ovakvih napada; samo ih ne koristimo ispravno.
Hugging Face je iznio verziju ove tvrdnje u svom izvještaju o incidentu, navodeći da su slabosti koje su iskorištene u napadu “bile poznate”, i da “sposoban ljudski napadač mogao bi pronaći i iskoristiti iste slabosti.”
Kyle Ryan, voditelj R&D-a u Pensaru, startupu koji razvija kontinuirane AI agente za hakiranje, i Vlad Ionescu, suosnivač i CTO RunSybila, startupu koji gradi AI alate za pronalaženje bugova, obojica su se složili i rekli TechCrunchu da su tehnike korištene u napadu bile iste one koje bi koristio ljudski tim za napad. Naime, hakeri zaduženi za napad na sustav kako bi pomogli tvrtki da poboljša obranu.
Ono što je bilo vrlo neljudsko bila je brzina, razmjer i neumoljivost napada. Kao što je Hugging Face objasnio, OpenAI-ov agent izveo je 17,600 akcija tijekom četiri i pol dana: probio se, obavio izviđanje, ukrao lozinke i kod, i kretao se infrastrukturom kompanije.
“Ono što je impresivno je autonomija i izdržljivost,” rekao je Ryan. “Takva vrsta održivog, adaptivnog djelovanja ono je što se najviše izdvaja za mene.”
Na drugoj strani, s obzirom na broj akcija tijekom nekoliko dana, OpenAI-ov agent bio je “lud od buke”, kako je to rekao Ryan. Za razliku od čovjeka, koji bi mogao biti diskretniji, agent je pravio puno buke, što bi trebalo uznemiriti obrane Hugging Face-a ranije, idealno dovodeći do ljudske intervencije i zaustavljanja napada.
Ryan je objasnio da bi pravilno implementirane tehnike poput obrane u dubini — strategije koja koristi više slojeva mjera kibernetičke sigurnosti — trebale dati Hugging Face-u više prilika za otkrivanje napada.
Uz sve to, kao što je O’Reilly rekao, “ništa od toga nije egzotično, i ništa od toga ne ovisi o napadaču koji je AI,” s obzirom na to da su tehnike korištene u napadu “stare.”



