Kompanija Anthropic počela je da uvodi novu tehnologiju koja bi mogla značajno da promijeni način na koji se prepoznaje sadržaj nastao uz pomoć vještačke inteligencije. Budući modeli Claude trebalo bi da u generisane tekstove ugrađuju nevidljivi digitalni vodeni žig, koji bi omogućio da se naknadno procijeni da li je u stvaranju ili uređivanju određenog sadržaja učestvovala AI.
Kako pišu Nezavisne novine, ova promjena dolazi u trenutku kada nova pravila Evropske unije o transparentnosti AI sadržaja počinju da se primjenjuju, uključujući obaveze koje se odnose na označavanje sadržaja generisanog vještačkom inteligencijom.
Kako funkcioniše nevidljivi vodeni žig?
Za razliku od klasičnih oznaka koje bi korisnik mogao odmah da primijeti, sistem se oslanja na statistički obrazac u izboru riječi. Tokom generisanja odgovora model pravi veliki broj sitnih jezičkih izbora, a tehnologija ih povezuje sa kriptografskim ključem i prethodnim dijelom teksta.
Rezultat je svojevrsni digitalni trag koji je neprimjetan čitaocu, ali bi mogao da bude prepoznat odgovarajućim sistemom za provjeru.
Drugim riječima, tekst bi na prvi pogled izgledao potpuno uobičajeno, dok bi specijalizovani alat mogao da procijeni da li postoji obrazac karakterističan za sadržaj koji je generisao Claude.
Ne bi trebalo da utiče na kvalitet odgovora
Iz Anthropica navode da interna testiranja za sada nisu pokazala mjerljivu razliku između označenih i neoznačenih odgovora kada je riječ o kreativnosti, tačnosti i čitljivosti.
Tehnologija, prema dostupnim informacijama, ne bi trebalo da zahtijeva ni dodatne tokene. To znači da njeno korištenje ne bi trebalo da dovede do sporijeg rada Claudea niti do povećanja troškova korištenja modela.
Ipak, postoji jedna važna slabost
Novi sistem nije jednako pouzdan za sve vrste sadržaja. Detekcija je otežana kod veoma kratkih tekstova, matematičkih odgovora, programskog koda i preciznih činjeničnih formulacija.
Razlog je jednostavan – u takvim slučajevima model često nema dovoljno prostora ili slobode da pravi veliki broj različitih izbora riječi.
Kako navodi Mashable, dodatni problem predstavlja i naknadno uređivanje teksta. Ozbiljnije prepravljanje sadržaja koji je generisala AI može oslabiti statistički obrazac, pa čak i potpuno ukloniti trag koji bi sistem trebalo da prepozna.
Žig neće otkrivati ko je koristio Claude
Važno je i ono što ova tehnologija neće moći da pokaže. Vodeni žig ne bi trebalo da otkriva identitet korisnika, njegov nalog niti konkretan razgovor iz kojeg je tekst potekao.
Umjesto toga, sistem bi mogao samo da procijeni vjerovatnoću da je Claude učestvovao u generisanju ili uređivanju sadržaja.
Anthropic planira i poseban API za provjeru prisustva digitalnog žiga, što bi drugim servisima omogućilo da automatski provjeravaju tekstove.
Sve se dešava zbog novih pravila EU
Uvođenje ove tehnologije posebno je zanimljivo zbog novih evropskih pravila. Član 50 Akta Evropske unije o vještačkoj inteligenciji predviđa obaveze povezane sa transparentnošću AI sadržaja, uključujući mašinski čitljivo označavanje i mogućnost detekcije sadržaja koji je generisan ili izmijenjen pomoću vještačke inteligencije.
Evropska komisija usvojila je i dobrovoljni Kodeks prakse, koji kompanijama daje okvir za ispunjavanje pojedinih obaveza.
Za korisnika to znači da bi u budućnosti moglo biti sve teže da se sadržaj koji je napravila AI potpuno odvoji od onog koji je napisao čovjek – ali i da će postojati sve više načina da se utvrdi da li je vještačka inteligencija imala ulogu u njegovom nastanku.