Anthropic je u petak objavio blog post u kojem nastoji odgovoriti na neka osnovna pitanja o tome kako će označavati tekst generiran svojim chatbotom Claude. Kako će vodene oznake zapravo funkcionirati? Mogu li se sakriti uređivanjem? I kako to utječe na kod?
Korisnici Claudea raspravljaju o ovom potezu otkako je tvrtka ranije ovog tjedna objavila da će provoditi ovo označavanje kako bi se uskladila s Kodom transparentnosti EU AI Zakona, koji zahtijeva od AI kompanija da koriste sustave koji omogućuju identifikaciju sadržaja generiranog AI-jem.
Na Redditu, jedan korisnik je to okarakterizirao kao zavjeru protiv nevinih korisnika Claudea, dok je drugi tvrdio: “Jedini razlog zašto ne bi željeli ovo je da lažete ljude.” Business Insider izvještava da je “desetak” korisnika na platformi X tvrdilo da su otkazali svoje pretplate na Claude zbog ovog poteza.
Novost od Anthropic-a započinje općim pregledom koncepta vodene oznake, objašnjavajući da kada donosi “odluke s niskim ulogama” — poput odabira između riječi “oblačno” i “sivo” za opisivanje vremena — Claude može stvoriti uzorak u svojim odgovorima koji je “neprimjetan čitatelju, ali je primjetan svima koji imaju ključ koji ga kodira.”
“Vodene oznake ne utječu na kvalitetu Claudeovih izlaza,” izjavila je tvrtka. “Za čitatelja, odgovor s vodenom oznakom je neodvojiv od onog bez vodene oznake.”
Specifičnije, Anthropic je rekao da će koristiti pristup SynthID-Text koji je tim Google DeepMind-a izložio 2024., te da planira objaviti API za otkrivanje vodene oznake. Također su napomenuli da je označavanje različito od pristupa otkrivanju AI-a koje nude tvrtke poput Pangrama koje traže “znakove” u pisanju (poput konstrukcije “njegovo nije [X], to je [Y]”) kako bi otkrile korištenje AI-a: “Uočavanje ovih uzoraka je temeljno različito od provjere vodene oznake.”
Može li netko jednostavno prepisati tekst kako bi sakrio vodenu oznaku? Anthropic je rekao da je to moguće, ali “lagano uređivanje vjerojatno neće potpuno ukloniti vodenu oznaku,” dok “kompletno prepisivanje gdje je svaka riječ zamijenjena hoće.”
“U potonjem slučaju, naravno, može se raspravljati o tome može li se tekst više opisivati kao generiran AI-jem,” rekla je tvrtka.
Što se tiče toga hoće li se vodena oznaka moći otkriti u tekstu koji je samo lektorirao ili uređivao Claude, Anthropic je rekao da će to ovisiti o “duljini teksta i koliko je Claude intenzivno uređivao.” Ako je samo lagano uređeno, “gotovo sve riječi” će biti napisane od strane ljudskog autora i “ima vrlo malo (ako uopće) za što se vodena oznaka može vezati.”
Kod, s druge strane, trebao bi imati manje vodene oznake od ostalog teksta, jer će model trebati stvoriti radni kod i neće imati slobodu biranja između raznih jednako valjanih opcija. “Imajući to na umu, u područjima gdje postoji proizvoljan izbor između određenih riječi ili izraza unutar koda, vodena oznaka se može koristiti, kao komentari unutar koda,” rekao je Anthropic. “Ali po definiciji, imat će zanemariv učinak na stvarni proizvedeni kod.”
Anthropic također je rekao da Claude neće biti jedini AI chatbot koji generira označen tekst, jer su “drugi veliki razvijači modela potpisali isti Kodeks prakse i implementirat će vlastite vodene oznake.”


