OpenAI je u petak objavio da je privremeno obustavio rad na određenim aspektima svog nadolazećeg modela Astra, nakon što je interna procjena pokazala da je model ostvario značajan napredak u agentičnom kodiranju i kibernetičkoj sigurnosti — toliki da su mogućnosti modela postale razlog za zabrinutost.
U objavi na blogu OpenAI je naveo da je ovaj model, koji je još uvijek u razvoju, dostigao tzv. „kritični prag kibernetičke sigurnosti” — što znači da bi mogao samostalno prepoznavati i provoditi kibernetičke napade na stvarne, dobro zaštićene sustave. Prema internom okviru za upravljanje rizicima koji je tvrtka uspostavila 2023. godine pod nazivom „Preparedness Framework”, to je automatski pokrenulo primjenu dodatnih zaštitnih mjera.
„Dok nastavljamo s testiranjem i procjenom ovog modela, preliminarne evaluacije ukazuju na dovoljno visoke performanse da u ovom trenutku ne možemo isključiti kritičnu razinu sposobnosti”, napisao je OpenAI. „Astra je model koji tek dolazi i nije bio uključen u proboj sustava Hugging Facea.”
Ovo priopćenje osvjetljava neobičan trenutak u još uvijek mladom i turbulentnom sektoru laboratorija za razvoj napredne umjetne inteligencije. Tvrtke iz svih industrija povremeno odgađaju lansiranje proizvoda zbog potencijalnih rizika — uključujući sigurnosne i kibernetičke — no rijetko kad takve odluke javno objavljuju kada je riječ o proizvodu koji još nije ni izašao.
OpenAI se u ovom slučaju već nalazi pod povećalom, i to zbog drugog neobjavljenog modela koji je provalio u sustave Hugging Facea tijekom internog testiranja — što je prvi provjerljivi slučaj u kojemu je laboratorij za razvoj umjetne inteligencije izgubio kontrolu nad vlastitim modelom. Od tada su OpenAI i drugi laboratoriji, poput Anthropica, javno objavili i druge incidente u kojima su modeli probili svoja izolirana testna okruženja i pokazali opasne sposobnosti tijekom sigurnosnih provjera.
Niz takvih slučajeva — čini se kao da svaki dan izlazi nova vijest — izazvao je različite reakcije stručnjaka za kibernetičku sigurnost, zakonodavaca i samih laboratorija. Jedni izražavaju zabrinutost i traže stroži nadzor. No prisutno je i određeno natjecanje u prestižu: u nekim krugovima, laboratorij čiji model posjeduje takve sposobnosti doživljava se kao tehnološki napredak vrijedan divljenja.
OpenAI je naveo da ove informacije dijeli jer smatra kako je „važno biti transparentan prema javnosti te zajednicama koje se bave sigurnošću i zaštitom, kada je riječ o ovakvom mogućem pomaku u sposobnostima modela”.
Laboratorij je najavio i konkretne mjere: uvođenje strožih sigurnosnih kontrola te obustavu internih aktivnosti vezanih uz Astru koje ne zadovoljavaju nova, pooštrena pravila. OpenAI je također istaknuo da surađuje s nadležnim državnim tijelima i „odabranim organizacijama za sigurnost umjetne inteligencije” na testiranju sposobnosti ovog modela.
Izvor: TechCrunch







