VMTech
Razgovarajmo

MIT je pokazao kako da se opasni AI modeli provere bez generisanja štetnog sadržaja

MIT je pokazao kako da se opasni AI modeli provere bez generisanja štetnog sadržaja

Prijatelji, želim da podelim važnu vest iz sveta veštačke inteligencije.

Istraživači MIT-a, zajedno sa organizacijom Thorn, razvili su novi način revizije generativnih modela. On omogućava proveru da li je model naknadno dorađen za kreiranje nezakonitog sadržaja, uključujući CSAM, bez pokretanja opasne generacije.

Metod analizira unutrašnje reprezentacije modela i njegove adaptacije posle fine-tuninga. U testovima je precizno identifikovao rizične varijante, a pritom ostaje skalabilan za platforme na kojima se objavljuju hiljade modela.

Zašto je ovo važno: revizori dobijaju bezbedan alat za rano prepoznavanje rizika i brzo blokiranje opasnih modela.

Šta Vi mislite, da li ovakve metode treba da postanu obavezne za open-source AI?

#VeštačkaInteligencija #MIT #KibernetičkaBezbednost #AIetika

Otvorena analitika
Na sajtu 0 pregleda
min čitanja 1 13.07.2026
Na Instagramu 3 pregleda
Na Instagramu 1 doseg
Instagram

MIT je pokazao kako da se opasni AI modeli provere bez generisanja štetnog sadržaja

Otvorite objavu na Instagramu ↗