Anthropic predlaže sporiji tempo razvoja napredne veštačke inteligencije

Anthropic se jednostrano obavezao da u svoj rad uključi nezavisne „ugrađene evaluatore“, dok je izvršni direktor Dario Amodei predložio sporiji tempo unapređivanja sposobnosti najnaprednijih AI modela. Kao moguće partnere naveo je organizacije poput METR-a, a pristup evaluatora trebalo bi uglavnom da bude uporediv sa pristupom internih timova za procenu rizika.
Amodei je poziv opisao kao potrebu da se „uspori granica“ razvoja, bez tvrdnje da tehnološki napredak treba zaustaviti. Po njegovom stavu, razvoj će i dalje izgledati brzo, ali dodatno vreme mora biti iskorišćeno promišljeno.
Nezavisna provera bezbednosnih obaveza
Predloženi evaluatori ne bi bili samo spoljašnji revizori sa ograničenim uvidom. Anthropic bi im obezbedio službene propusnice, radne stolove i prenosive računare, uz pristup koji je u najvećoj meri sličan onome koji imaju interni timovi za procenu rizika. Izuzeci bi važili kada ih nalažu zakon ili ugovorne obaveze.
Njihov zadatak bio bi da potvrde da kompanija zaista sprovodi preuzete mere usporavanja i bezbednosti, kao i da se bezbednosni incidenti prijavljuju. Amodei je takav model uporedio sa regulatorima koji rade uz zaposlene u bankama i pozvao vlade da od drugih kompanija na granici razvoja zahtevaju sličan pristup.
Koordinacija industrije, vlada i međunarodnih aktera
Drugi deo predloga odnosi se na dogovor vodećih AI kompanija u demokratskim državama o zajedničkim bezbednosnim standardima i ograničenjima nekontrolisanog ubrzavanja razvoja. Amodei smatra da bi američka vlada trebalo da posreduje ili makar omogući te razgovore kroz usko antimonopolsko izuzeće za određene bezbednosne teme.
Govoreći o konkurenciji sa Kinom, naveo je da bi SAD i tehnološke kompanije mogle da uspore kineski napredak odbijanjem prodaje moćnih čipova i opreme za proizvodnju poluprovodnika kineskim kompanijama, kao i suzbijanjem destilacije modela. Njegova procena je da bi to moglo značajno da proširi američku prednost tokom naredne tri do pet godina.
Treći pravac je globalna koordinacija sa autoritarnim vladama, u meri u kojoj je ona moguća. Amodei je kao ograničen, ali potencijalno dostižan cilj naveo zabranu uskih i očigledno opasnih primena, poput korišćenja AI za proizvodnju biološkog oružja ili omogućavanja korisnicima da to čine.
Šta plan znači za kompanije koje uvode AI
Predlog stiže u trenutku snažnije debate o rizicima, regulaciji i poverenju u tehnološke kompanije i vlasti. Amodei istovremeno tvrdi da AI može znatno da unapredi kvalitet života, ali da koristi zavise od načina na koji se tehnologija gradi i nadzire.
Za organizacije koje uvode AI praktičan zaključak je da se bezbednost ne svodi na završnu proveru proizvoda. Kroz nastupe Anthropic-a i OpenAI-ja na AI Stage-u može se sagledati i širi poslovni kontekst u kojem transparentne kontrole, nezavisna procena rizika i evidentiranje incidenata postaju važni elementi upravljanja AI sistemima.

