VMTech
Razgovarajmo

OpenAI definiše okvir za nezavisne procene bezbednosti AI

OpenAI definiše okvir za nezavisne procene bezbednosti AI

OpenAI je 22. septembra 2026. predstavio predlog za efikasnije nezavisne procene bezbednosti naprednih AI sistema, sa četiri prioritetne oblasti: proverom bezbednosnih slučajeva, ključnih zaštitnih mera, evaluacija sposobnosti i istragama incidenata neusklađenosti. Kompanija navodi da procene mogu trajati od nekoliko nedelja do više meseci i da nisu nužno vezane za pojedinačno lansiranje modela.

Predlog je usmeren na privatne i neprofitne organizacije koje sprovode tehničke procene bezbednosti. OpenAI navodi da proceniteljima želi da omogući dubok pristup procesima obuke, evaluacije i primene, ali u granicama pravnih, bezbednosnih i ograničenja intelektualne svojine.

Četiri oblasti nezavisne provere

Prva oblast je procena bezbednosnog slučaja, odnosno strukturisanog obrazloženja potkrepljenog dokazima da su rizici modela primereno upravljani za obuku, evaluaciju ili primenu. Takav slučaj povezuje pojedinačne bezbednosne tvrdnje sa dokazima, pretpostavkama, neizvesnostima i preostalim rizicima.

Druga oblast obuhvata zaštitne mere u internim i spoljnim primenama. OpenAI navodi zaštite na nivou modela, sprovođenja pravila i bezbednosti, kao i monitore neusklađenosti. Nezavisni timovi bi trebalo da ispituju otpornost tih mera na protivničko testiranje, ponašanje agenata uz kontrole pristupa, izolovana okruženja, detekciju i odgovor na incidente.

Treći prioritet odnosi se na evaluacije sposobnosti iz kategorija Preparedness Framework-a: hemijske i biološke rizike, sajber bezbednost i samousavršavanje AI. Poseban akcenat je na tome da se testovi obnavljaju kada modeli redovno dostižu najviše rezultate, kako bi i dalje merili naprednije sposobnosti i rizike ozbiljne neusklađenosti.

Četvrta oblast su nezavisne istrage kritičnih incidenata neusklađenosti, uključujući situacije u kojima model radi bez odobrenja ili izbegava nadzor. Za takve istrage OpenAI ističe potrebu za ekspertizom iz sajber forenzike, usklađivanja modela i analize velikog obima lanca zaključivanja, uz pravovremene resurse i zaštitu osetljivih podataka.

Principi za kredibilne procene

OpenAI predlaže da se pre početka rada jasno usaglase obim i bezbednosne tvrdnje koje se proveravaju. Metodologija, kriterijumi i neizvesnosti treba da budu objašnjeni, a izveštaji da razlikuju neposredne nalaze od tumačenja i jasno navedu šta nije obuhvaćeno procenom.

Nezavisnost procenitelja podrazumeva odgovarajuću stručnost, otkrivanje i rešavanje sukoba interesa, uključujući finansijske podsticaje i raniji rad na predmetu procene. Kompanija takođe traži zaštitu poverljivosti i informacione bezbednosti srazmernu osetljivosti podataka, dok pristup u upravljanom okruženju može biti opravdan kada procenitelj ne može da ispuni potrebne zahteve.

Nalazi treba da budu dovoljno konkretni da laboratorije mogu da otklone uočene nedostatke, uz razuman period za sanaciju pre objave kada je to primereno. Javna objava treba da bude što otvorenija, ali bez izlaganja osetljivih podataka; kada to nije moguće, poverljivo izveštavanje nadležnim upravljačkim telima može podržati odgovornost.

Poslovni značaj

OpenAI očekuje paralelne procene različitih delova bezbednosnih slučajeva, jer nijedna organizacija ne može sama obuhvatiti sva hitna pitanja bezbednosti naprednih sistema. Za kompanije koje razvijaju ili uvode AI, praktičan zaključak je da tvrdnje o zaštiti, nadzoru i ograničenjima sistema treba unapred povezati sa dokazima, merilima procene, jasnim pristupnim pravilima i odgovornostima za otklanjanje nalaza.

#aisafety#aigovernance#riskmanagement#openai
Otvorena analitika
Na sajtu 1 pregleda
min čitanja 4 22.09.2026
Instagram

OpenAI definiše okvir za nezavisne procene bezbednosti AI

Otvorite objavu na Instagramu ↗