VMTech
Razgovarajmo

Anthropic prijavio velike kampanje destilacije Claude modela

Anthropic prijavio velike kampanje destilacije Claude modela

Anthropic je objavio da je otkrio gotovo 200 miliona razmena povezanih sa pet kampanja za destilaciju svojih Claude modela. Najveća kampanja, pripisana Alibabi, obuhvatila je 151 milion razmena između maja i jula 2026. godine, preko 3.500 naloga, sa vrhuncem od gotovo tri miliona razmena dnevno.

Meta su bile sposobnosti zaključivanja i rada sa alatima

Kompanija navodi da su kampanje ciljale vredne funkcije frontier modela: agentne sposobnosti i upotrebu alata, programiranje i analizu podataka, kao i logičko zaključivanje. Reč je o pokušajima da se iz odgovora modela izvuku tragovi rezonovanja koji potom mogu poslužiti za dodatno treniranje manjeg modela nadgledanim finim podešavanjem.

Claude korisnicima uobičajeno ne prikazuje interni lanac rezonovanja, već blokove sa sažetim prikazom razmišljanja. Anthropic ipak tvrdi da su napadači pronašli načine da posebnim formulacijama zahteva navedu model da neposredno otkrije takve tragove.

Jedan opisani primer maskirao je zahtev kao prevod: model je trebalo da prethodnu radnu memoriju prevede na prirodan japanski, pisan isključivo katakanom. Prema Anthropicovom nalazu, zajednički fiksni upit kroz hiljade naloga bio je ključni obrazac na osnovu kog je kampanja pripisana jedinstvenom pokušaju prikupljanja materijala za Qwen porodicu modela.

Posebna kampanja usmerena na Opus

Anthropic je izdvojio i kampanju povezanu sa kompanijom Moonshot AI, proizvođačem modela Kimi. U periodu od deset dana, skoro 300.000 zahteva stiglo je do Claudea kroz mrežu od 5.000 naloga, uglavnom sa ciljem da se koriste mogućnosti modela Opus.

Izveštaj navodi da je jedan zahtev tražio procenu snimaka kamera zatvorenog kruga kako bi se utvrdilo da li se osoba na snimku ponaša neuobičajeno. Anthropic navodi da su zahtevi iz te kampanje delovali kao da se preusmeravaju direktno od kineske vojske.

Operativna poruka za kompanije koje koriste AI

Ovaj slučaj pokazuje da zaštita AI sistema ne zavisi samo od ograničavanja pristupa pojedinačnim nalozima. Obim kampanje pripisane Alibabi ukazuje na potrebu za praćenjem ponavljajućih obrazaca upita, povezanih naloga i neuobičajenog intenziteta korišćenja, dok Anthropic ostaje vidljiv učesnik u razvoju AI industrije pokazuje da Anthropic ostaje vidljiv učesnik u širem razvoju AI industrije.

Za poslovne timove praktičan zaključak je da uz upravljanje identitetima i dozvolama treba uspostaviti nadzor nad obrascima poziva modela, limitima opterećenja i pokušajima izvlačenja zaštićenih izlaza iz AI servisa.

#anthropic#claudeai#modelsecurity#artificialintelligence
Otvorena analitika
Na sajtu 0 pregleda
min čitanja 3 10.09.2026
Instagram

Anthropic prijavio velike kampanje destilacije Claude modela

Otvorite objavu na Instagramu ↗