Anthropic pojašnjava vodene žigove u odgovorima Claudea

Anthropic je objavio dodatne tehničke detalje o vodenim žigovima za tekst koji generiše Claude, meru koju uvodi radi usklađivanja sa Kodeksom prakse za transparentnost iz EU AI Act-a. Kompanija će primeniti pristup SynthID-Text, koji je tim Google DeepMind predstavio 2024. godine, i planira objavljivanje API-ja za detekciju vodenog žiga.
Claude će obrazac ugrađivati pri izboru između podjednako prihvatljivih formulacija, poput različitih reči za opis vremena. Anthropic navodi da je taj obrazac nevidljiv čitaocu, ali proverljiv onome ko poseduje ključ kojim je kodiran. Prema kompaniji, vodeni žig ne utiče na kvalitet izlaza, pa se odgovor sa žigom ne razlikuje od odgovora bez njega pri običnom čitanju.
Kako se žig ugrađuje i proverava
Ovaj pristup nije isto što i alati koji iz stila pisanja pokušavaju da zaključe da li je korišćena veštačka inteligencija. Anthropic kao primer takvih pristupa navodi Pangram, čiji sistemi traže karakteristične jezičke obrasce. Provera ugrađenog žiga zasniva se na drugačijem principu: traži se obrazac koji je model namerno uneo prilikom generisanja teksta.
Kompanija priznaje da je moguće ukloniti žig izmenama sadržaja. Lakše uređivanje, međutim, verovatno ga neće potpuno ukloniti, dok bi potpuno prepisivanje u kojem se zameni svaka reč to učinilo. Anthropic dodaje da se u takvom slučaju može postaviti pitanje da li se tekst više uopšte može opisati kao sadržaj generisan veštačkom inteligencijom.
Šta to znači za uređivanje i programski kod
Kada Claude samo lektoriše ili uređuje ljudski tekst, mogućnost detekcije zavisi od dužine sadržaja i obima njegovih intervencija. Ako je izmena blaga, gotovo sve reči ostaju delo ljudskog autora, pa postoji malo ili nimalo materijala za koji bi se žig vezao. U kontekstu kontekstu vodenih žigova za Claude tekstove dodatno se precizira da sama prisutnost AI alata ne znači nužno i pouzdan detektabilan trag u svakoj verziji dokumenta.
Za programski kod Anthropic očekuje manju zastupljenost žiga nego u običnom tekstu. Model mora da proizvede kod koji funkcioniše, zbog čega nema jednaku slobodu izbora formulacija. Žig može biti primenjen tamo gde postoji proizvoljan izbor reči ili termina, na primer u komentarima, ali kompanija kaže da će njegov efekat na stvarni generisani kod po definiciji biti zanemarljiv.
Operativni zaključak za organizacije
Anthropic navodi da Claude neće biti jedini četbot sa ovom vrstom obeležavanja: i drugi veliki razvijači modela potpisali su isti Kodeks prakse i uvodiće sopstvene vodene žigove. Za poslovne timove je zato važno da odvoje proveru ugrađenog žiga od procene autorstva po stilu, kao i da jasno odrede kada se AI izlaz sme koristiti, uređivati i označavati u internim dokumentima i isporukama.

