Baseten, Hugging Face i Goodfire pokreću okvir za bezbednost otvorenih AI modela

Baseten je preko svog istraživačkog ogranka Base Labs pokrenuo partnerstvo sa kompanijama Hugging Face i Goodfire AI radi razvoja infrastrukture za procenu bezbednosti i nadzor open-weight AI modela. Povod je rastući broj modela koji su prošli abliteration postupak: Hugging Face trenutno navodi više od 6.000 takvih modela, kod kojih su uklonjene postojeće zaštitne ograde.
Partneri žele da objavljuju metode za obuku i praćenje otvorenih modela, a budući rad predstavljaju kao transparentni standard. Namera je da kontrole bezbednosti budu sastavni deo načina na koji se modeli obučavaju i primenjuju, umesto naknadno dodatog sloja.
Bezbednost kao deo životnog ciklusa modela
Open-weight modeli omogućavaju korisnicima pristup parametrima modela i dalju prilagodbu. Ista otvorenost, međutim, otvara prostor da se uklone mehanizmi koji ograničavaju neželjeno ponašanje. Abliteration je tehnika koja se u ovom kontekstu koristi upravo za uklanjanje takvih zaštita.
Baseten tvrdi da otvorenost može biti prednost za AI bezbednost zato što pruža veću vidljivost ponašanja modela i više mogućnosti da se istraživanja bezbednosti pretvore u transparentne, primenljive kontrole. Kompanija je pozvala širi razvojni ekosistem da doprinese okviru.
Uloge partnera još nisu tehnički razjašnjene
Detalji o tehničkoj podeli posla nisu objavljeni. Goodfire AI opisuje cilj kao bezbednost koja treba da bude ugrađena u otvorene modele i dostupna kroz organizacije koje ih isporučuju. Goodfire razvija platformu za interpretabilnost modela, odnosno za objašnjavanje načina na koji AI sistemi donose odluke.
Baseten posluje kao pružalac AI inferencije, dok Hugging Face hostuje otvorene AI modele. Baseten je u junu prikupio 1,5 milijardi dolara u rundi Serije F, čime je njegova vrednost procenjena na 13 milijardi dolara. Goodfire AI je ranije ove godine prikupio 150 miliona dolara u rundi Serije B koju je predvodio B Capital.
Šta kompanije treba da izdvoje kao prioritet
Najava ne donosi gotov tehnički standard niti precizira kako će se alati primenjivati u produkciji. Ipak, jasno usmerava pažnju na proveru zaštita, nadzor ponašanja i transparentnost kroz ceo životni ciklus open-weight modela.
Za poslovne timove koji biraju ili hostuju otvorene modele, praktičan zaključak je da bezbednosnu procenu ne treba svesti na inicijalno testiranje. Potrebno je planirati proveru izmena modela i kontinuirani nadzor nakon uvođenja u radno okruženje.

