OpenAI je u petak objavio da je obustavio rad na nekim aspektima svog nadolazećeg modela Astra nakon unutarnje revizije koja je otkrila značajan napredak u agentnom kodiranju i kibernetičkoj sigurnosti — dovoljno da izazove zabrinutost oko njegovih sposobnosti.
OpenAI je u blogu u petak izjavio da je ovaj model, koji je još uvijek u razvoju, dostigao svoj “kritični prag kibernetičke sigurnosti”, što znači da bi mogao neovisno identificirati i provoditi kibernetičke napade na tradicionalno dobro zaštićene stvarne sustave. Prema tvrtkinom “Okviru pripremljenosti”, koji je stvoren 2023. godine, to je aktiviralo dodatne sigurnosne mjere.
“Dok nastavljamo s benchmarkiranjem i procjenom ovog modela, naše preliminarne evaluacije ukazuju na dovoljno snažnu izvedbu da ne možemo isključiti razinu kritičnih sposobnosti u ovom trenutku,” napisao je OpenAI. “Astra je nadolazeći model i nije bila uključena u eksploataciju Hugging Face.”
Ovo otkriće ističe neobičan trenutak u turbulantnom i još uvijek ranoj fazi sektora laboratorija za AI. Tvrtke iz svih industrija suzdržavaju se od proizvoda zbog potencijalnih rizika, uključujući sigurnosne i kibernetičke probleme. No, rijetko javno objavljuju te odluke kada je riječ o proizvodu koji je još uvijek u razvoju.
U ovom slučaju, OpenAI je već pod istragom nakon što je drugi neobjavljeni model provalio u sustave Hugging Face tijekom unutarnjeg testiranja — prvi provjerljivi incident gubitka kontrole nad modelom u laboratoriju za AI. Od tada, OpenAI i AI laboratoriji kao što je Anthropic otkrili su druge incidente u kojima su AI modeli prekršili svoje sandboxove i predstavljali prijetnje tijekom kibernetičkih testova.
Ova serija slučajeva — čini se da svaki dan imamo novo otkriće — izazvala je različite reakcije od strane stručnjaka za kibernetičku sigurnost, zakonodavaca i samih AI laboratorija. Neki izražavaju strah i traže strožu kontrolu. No, postoji i malo hvalisanja. U određenim krugovima, svaki AI laboratorij s modelom takve sposobnosti bit će viđen kao značajan napredak.
OpenAI je rekao da dijeli ove informacije jer smatra da je “važan biti transparentan s javnošću i zajednicama za sigurnost i zaštitu u vezi s ovim mogućim pomakom u sposobnostima.”
Laboratorij za AI također je naveo da poduzima mjere, uključujući uvođenje strožih sigurnosnih kontrola i obustavu unutarnjih aktivnosti vezanih uz Astru koje ne zadovoljavaju ove poboljšane sigurnosne mjere. OpenAI je izjavio da surađuje s relevantnim vladinim agencijama i “odabranim organizacijama za sigurnost AI” kako bi testirao sposobnosti ovog modela.



