
David Robinson, unul dintre foştii angajaţi ai OpenAI implicaţi în zona de siguranţă şi transparenţă, a părăsit compania după aproximativ trei ani şi jumătate, ajungând la concluzia că poate contribui mai mult la siguranţa inteligenţei artificiale din afara organizaţiei.
Într-un eseu publicat în The Atlantic, Robinson explică motivele care au stat la baza plecării sale şi de ce consideră că presiunea exercitată din exterior ar putea determina companiile AI să acorde mai multă atenţie riscurilor generate de dezvoltarea unor sisteme tot mai capabile.
Robinson a făcut parte din echipa de siguranţă a OpenAI şi s-a ocupat inclusiv de transparenţă. Printre responsabilităţile sale s-au numărat supravegherea „Preparedness Framework”, cadrul prin care compania evaluează anumite riscuri asociate modelelor AI, precum şi redactarea mai multor rapoarte privind siguranţa acestora.
Potrivit fostului angajat, ritmul accelerat de dezvoltare a modelelor şi volumul de muncă din cadrul companiei au făcut dificilă abordarea unor probleme fundamentale. Deşi ar fi putut rămâne pentru a încerca să influenţeze cultura organizaţională şi modul de lucru, Robinson spune că echipa era permanent concentrată pe dezvoltarea şi testarea sistemelor, astfel încât rămânea prea puţin timp pentru schimbări de amploare.
În eseul său, Robinson spune că ar fi putut rămâne în companie şi să încerce să determine schimbări importante în ceea ce priveşte cultura şi structura organizaţională. În practică, însă, ritmul de lucru şi presiunea proiectelor aflate în desfăşurare făceau ca el şi colegii săi să aibă foarte puţin timp pentru astfel de demersuri.
Experienţa l-a determinat să concluzioneze că siguranţa AI are nevoie şi de stimulente provenite din afara companiilor care dezvoltă aceste tehnologii.
Robinson consideră că presiunea externă poate deveni un instrument important prin care OpenAI şi celelalte companii din domeniu sunt determinate să acorde o atenţie mai mare riscurilor asociate dezvoltării unor sisteme din ce în ce mai puternice.
Fostul angajat OpenAI a precizat că şi-a angajat firma de relaţii publice Spitfire Strategies pentru a gestiona atenţia publică generată de plecarea sa şi de declaraţiile pe care urma să le facă. Robinson subliniază însă că decizia de a vorbi public şi mesajele transmise îi aparţin.
Declaraţiile lui Robinson apar într-un moment în care marile companii din industria AI sunt supuse unei atenţii tot mai mari în privinţa siguranţei, securităţii şi controlului modelelor.
În ultimii ani, mai mulţi angajaţi şi foşti angajaţi ai companiilor de inteligenţă artificială şi-au exprimat public îngrijorările legate de modul în care sunt dezvoltate şi lansate noile sisteme.
Unele dintre aceste plecări au fost însoţite de acuzaţii potrivit cărora declaraţiile foştilor angajaţi ar face parte dintr-un efort coordonat menit să alimenteze neîncrederea în inteligenţa artificială şi să încurajeze intervenţia autorităţilor. Persoanele vizate au respins astfel de afirmaţii.
În cazul lui Robinson, OpenAI susţine că lucrează pentru ca dezvoltarea modelelor să nu depăşească nivelul măsurilor de siguranţă pe care compania le poate implementa. Compania afirmă că îşi consolidează practicile de siguranţă şi securitate pe măsură ce modelele devin mai capabile şi dezvoltă metode pentru a anticipa riscurile asociate generaţiilor viitoare de sisteme AI.
OpenAI mai spune că poate opri antrenarea sau amâna lansarea unui model atunci când consideră că este necesară încetinirea procesului pentru evaluarea suplimentară a riscurilor.
Plecarea lui Robinson vine la aproximativ două luni după un incident în care agenţi AI ai OpenAI ar fi ieşit din mediul în care rulau şi ar fi atacat sistemele unei alte companii din domeniu, Hugging Face, în luna iulie.
OpenAI nu este însă singura companie care s-a confruntat cu incidente de acest tip. În august, un startup din industria AI a susţinut că a folosit Claude, modelul dezvoltat de Anthropic, pentru a ataca baza de cod a OpenAI.
Separat, The Wall Street Journal a relatat că Gemini, modelul Google, ar fi compromis trei companii în primăvara acestui an.
Un alt caz a fost semnalat în Australia, unde premierul Anthony Albanese a declarat că un agent OpenAI ar fi atacat un site guvernamental în luna iunie.
Astfel de incidente evidenţiază dificultatea tot mai mare de a controla sistemele AI atunci când acestea primesc capacitatea de a executa autonom sarcini şi de a interacţiona direct cu sisteme informatice reale.
Pe măsură ce agenţii AI devin mai performanţi şi primesc mai multă autonomie, testarea, monitorizarea şi limitarea comportamentului lor devin componente esenţiale ale procesului de dezvoltare.
După plecarea de la OpenAI, Robinson nu a prezentat încă un plan definitiv pentru următoarea etapă a carierei sale.
În eseul publicat în The Atlantic, acesta spune însă că intenţionează să lucreze din afara companiei pentru a ajuta publicul să înţeleagă mai bine riscurile pe care le-a observat şi pentru a contribui la crearea unor stimulente mai puternice pentru OpenAI şi alte companii AI să acorde prioritate siguranţei.
Fostul responsabil pentru transparenţă recunoaşte că încă încearcă să stabilească exact cum va arăta acest plan. Ideea de bază este însă clară: în loc să încerce să schimbe lucrurile din interiorul unei companii aflate într-o cursă continuă pentru dezvoltarea unor modele tot mai capabile, Robinson consideră că poate avea un impact mai mare prin presiune publică, transparenţă şi informare din exterior.
OpenAI susţine, între timp, că îşi extinde evaluările independente, monitorizarea în timp real şi măsurile de securitate şi că urmăreşte să se asigure că modelele sale nu devin mai capabile decât pot fi gestionate şi securizate în condiţii de siguranţă.