Accenture postaje prvi ugrađeni evaluator Anthropicovih AI modela

Anthropic će u svoje okruženje uključiti stručnjake kompanije Accenture kao prve ugrađene spoljne evaluatore bezbednosti AI modela, a dve kompanije očekuju ulaganje od najmanje milijardu dolara tokom narednih pet godina. Posao će obavljati Faculty, kompanija koju je Accenture kupio u januaru da bi činila njegovu AI diviziju.
Faculty će proveravati i pokušavati da zaobiđe zaštite modela, sprovoditi procene usklađenosti i testirati bezbednosne mere. Anthropic navodi da će evaluatori posmatrati i modele i rad zaposlenih, što ovaj aranžman razlikuje od uobičajenih spoljašnjih provera vezanih za pojedinačno lansiranje velikih jezičkih modela.
Ugrađena provera kao deo bezbednosnog procesa
Ideja o evaluatorima koji rade unutar AI laboratorija nastavlja plan Darija Amodeija da se nezavisna provera približi razvoju sistema. U raspravi o takvom pristupu često se pominju istraživačke organizacije METR, Redwood Research i Apollo Research, naročito zbog njihovog rada na bezbednosti i usklađivanju AI sistema.
Anthropic je saopštio da će narednih nedelja objaviti još evaluatora. Kompanija istovremeno razgovara sa METR-om i drugim neprofitnim organizacijama o pilotiranju delova ugrađene evaluacije uz njihovo sopstveno finansiranje.
Zašto je izabran Accenture
Izbor Accenturea iznenadio je deo AI zajednice, koja ga ne vezuje prvenstveno za najnaprednija istraživanja dubokog učenja. Tržište je reagovalo rastom akcija konsultantske kompanije od 8% u trgovanju nakon zatvaranja berze.
Anthropic kao prednost ističe praktično iskustvo Accenturea u primeni AI rešenja kod velikih kompanija i državnih institucija. Kao velika javna kompanija nastala pre sadašnjeg AI talasa, Accenture je i funkcionalno nezavisniji od složenog ekosistema koji okružuje AI laboratoriju.
Odgovornost ostaje kod proizvođača modela
Anthropic priznaje da još ne postoje standardi koji određuju pristup evaluatorima ili način njihove komunikacije sa laboratorijama, pa očekuje da se pristup menja vremenom. Potreba za takvim proverama dobija na težini nakon slučajeva u kojima su AI agenti OpenAI-ja i Anthropica pristupali spoljnim sajtovima bez upozorenja unutar samih laboratorija.
Debata se ne završava samim prisustvom spoljnog tima: nezavisnost evaluatora bezbednosti AI pokazuje da se pitanje nezavisnosti evaluatora postavlja i šire, dok Anthropic naglašava da bezbednost modela ostaje njegova odgovornost. Za poslovne korisnike to znači da eksterna procena može učiniti kontrolne postupke proverljivijim, ali ne može zameniti jasnu odgovornost dobavljača i sopstvene procese upravljanja rizikom.

