OpenAI je saopštio da privremeno obustavlja "interne aktivnosti" u vezi sa modelojm Astra, koji se trenutno razvija, jer još uvek ne ispunjava nove bezbednosne standarde koje kompanija uvodi.
Ovo obaveštenje dolazi nakon nedavnog otkrića da su modeli kompanije OpenAI slučajno hakovali platformu Hugging Face. Anthropic i Meta su u međuvremenu takođe priznali da su imali AI modele koji su se otrgli kontroli i upali u sisteme drugih organizacija.
Nedavne interne procene modela Astra pokazuju da on donosi "značajan napredak u agentskom kodiranju i sajber-bezbednosti", navode iz kompanije. "Ovi rezultati, uz procene stručnjaka, doveli su nas do zaključka da ne možemo isključiti postojanje kritičnih sajber-sposobnosti u okviru našeg Okvira za pripravnost (Preparedness Framework)".
Evo kako OpenAI definiše "kritični" prag sajber-bezbednosti:
"U okviru našeg Okvira za pripravnost, model dostiže kritični prag sajber-bezbednosti ako može da identifikuje i razvije funkcionalne 'zero-day' ranjivosti (nepoznate bezbednosne propuste) svih nivoa ozbiljnosti u mnogim zaštićenim kritičnim sistemima u realnom svetu bez ljudske intervencije, ili ako može da osmisli i izvede kompletne (end-to-end) nove strategije za sajber napade na zaštićene mete, na osnovu samo jednog opšteg zadatog cilja".
Astra "nije učestvovala" u napadu na Hugging Face, tvrdi OpenAI.
OpenAI će primeniti strože bezbednosne kontrole za modele većih mogućnosti i prateće aktivnosti, navodi se u objavi. Za Astru je takođe uveden "univerzalni nadzor" za rizične radnje i odstupanja od zadatog ponašanja u svim agentskim primenama.