David Robinson, jedan od najiskusnijih zaposlenika u OpenAI-u i vođa timova za sigurnost kod značajnih lansiranja proizvoda, nedavno je objavio kako napušta tvrtku zbog, kako je naveo, ‘pokvarene kulture’. Nakon tri i pol godine rada u poznatoj tvrtki za razvoj umjetne inteligencije, Robinson izražava zabrinutost zbog općeg pristupa sigurnosti i razvoju AI sustava.
Sigurnosni izazovi i kritike pristupa u razvoju AI
U eseju objavljenom u časopisu The Atlantic, Robinson je istaknuo da OpenAI često koristi metodu ‘iterativnog pokretanja’, koja podrazumijeva kontinuirano testiranje i ispravljanje grešaka u sustavima umjetne inteligencije. Iako ta metoda pomaže u poboljšanjima, on upozorava da je takav pristup inherentno rizičan jer osigurava da će povremeno doći do ozbiljnih neuspjeha, a kako sustavi postaju sve sofisticiraniji, tako se i rizik povećava.
Robinson je naveo primjere poput nedavnog sigurnosnog propusta na platformi Hugging Face, izazvanog djelovanjem OpenAI agenata, te otkrivenih dodatnih problema s nekontroliranim agentima. Prema njegovom mišljenju, okruženje u kojem se takve situacije događaju nije adekvatno za razvoj naprednih inteligentnih sustava koji bi mogli biti pametniji od ljudi i čije ponašanje nije moguće u potpunosti predvidjeti ili kontrolirati.
On smatra da razvoj i rad u AI kompanijama poput OpenAI-a trebaju biti usporedivi s visokim sigurnosnim standardima iz atomskih elektrana ili prometnih zračnih luka, gdje se primjenjuju višeslojni sigurnosni sustavi i pažljivo planiranje kako bi se izbjegle katastrofalne posljedice ljudskih pogrešaka. Međutim, Robinson je primijetio da u takvim tvrtkama nedostaje stručnjaka s iskustvom u sigurnom upravljanju kompleksnim i rizičnim sustavima.
OpenAI je potvrdio da kontinuirano radi na jačanju sigurnosnih mjera, uključujući privremeno zaustavljanje treninga modela, bolju kontrolu, suradnju s vanjskim ocjenjivačima i poboljšanje monitoringa u stvarnom vremenu kako bi se ranije uočile potencijalno opasne aktivnosti.
Robinson je također naglasio potrebu za širim raspravama o usklađenosti umjetne inteligencije s ljudskim vrijednostima, što se često smatra apstraktnim, ali je ključno za smanjenje rizika u daljnjem razvoju AI sustava.

