
Link: https://www.ictbusiness.info / vijesti / claude-dobiva-nevidljivi-vodeni-zig
Claude dobiva nevidljivi vodeni žig
Anthropic će u buduće modele Claudea ugraditi tekstni vodeni žig kako bi ispunio obvezu označavanja sadržaja iz europskog Akta o umjetnoj inteligenciji. Žig neće biti vidljiv čitatelju niti će tekstu dodavati skrivene znakove, a Anthropic ga namjerava primjenjivati globalno jer zasad nema pouzdan način da istu tehniku ograniči samo na korisnike u Europskoj uniji.
Kompanija priprema detekcijski API, ali još nije objavila datum dostupnosti, uvjete pristupa ni cijenu. Stariji modeli lansirani prije 2. kolovoza 2026. obuhvaćeni su prijelaznim razdobljem; Anthropic kaže da će i njima dodati označavanje tijekom sljedećih mjeseci. To znači da se mogućnost provjere neće pojaviti istodobno u svim izvedbama Claudea.
Metoda ne skriva poruku u interpunkciji ili Unicode znakovima. Jezični model pri svakom koraku bira sljedeću riječ među kandidatima koji odgovaraju prethodnom tekstu. Kada više riječi nosi gotovo isto značenje, sustav umjesto običnog generatora slučajnih brojeva koristi tajni ključ i nekoliko prethodnih riječi. Niz odabira tako ostavlja statistički obrazac koji čitatelj ne primjećuje, ali ga vlasnik ključa može izmjeriti.
Anthropic koristi inačicu pristupa SynthID-Text, koji je Google DeepMind opisao u časopisu Nature 2024. godine. Kompanija navodi da interna ispitivanja nisu pokazala pad kreativnosti, čitljivosti ili sadržajne kvalitete. U ranijem DeepMindovu pokusu korisničke ocjene odgovora s vodenim žigom nisu se statistički razlikovale od odgovora bez njega, no isti rezultat ne jamči jednak učinak na svaki jezik, stil ili stručnu domenu.
Žig ne radi jednako dobro u svim tekstovima. Na kratkom uzorku nema dovoljno odluka o riječima za pouzdanu procjenu. Signal je rjeđi i u činjeničnim rečenicama, kodu i lekturi, gdje je broj ispravnih nastavaka ograničen. Dulji kreativni tekst daje više prostora za uzorak, dok nekoliko rečenica tehničke dokumentacije može ostati ispod praga pouzdanosti.
Ni pozitivan rezultat ne dokazuje autorstvo. Detektor može procijeniti da je Claude vjerojatno sudjelovao, ali ne razlikuje je li napisao cijeli tekst ili ga je samo opsežno uredio. Ne može potvrditi ni da je tekst s negativnim rezultatom napisao čovjek jer sadržaj može potjecati od drugog modela ili biti dovoljno promijenjen. Potpuno prepisivanje svake rečenice može ukloniti obrazac; blaga redaktura vjerojatno će ga samo oslabiti.
Za prijevode vrijedi strože pravilo jer model bira gotovo svaku riječ u ciljnom jeziku, pa će i prevedeni tekst nositi žig. To je važno izdavačima, prevoditeljskim servisima i korisničkoj podršci: automatizirani prijevod može biti označen i kada su izvorne ideje ljudske. Žig prema Anthropicovu tumačenju ne mijenja vlasništvo, autorska prava ni ugovornu odgovornost korisnika.
Datoteke poput PNG-a, JPEG-a i SVG-a dobit će drukčiju oznaku. Claude će u podržanu datoteku dodati kriptografski potpisanu C2PA vjerodajnicu u metapodatke. Takav zapis ne mijenja piksele, ali se može ukloniti pri ponovnom spremanju ili snimanju zaslona. Tekstni obrazac i C2PA zato rješavaju srodne probleme različitim mehanizmima i ne smiju se predstavljati kao jednako otporni dokaz.
Poslovni korisnici morat će odrediti tko smije slati dokumente u detekcijski API i smiju li povjerljivi materijali napustiti organizaciju. Anthropic nije objavio hoće li provjera čuvati tekst, koliko će dugo trajati ni kakve će pragove vraćati. Bez tih podataka banke, javna uprava i izdavači ne mogu završiti procjenu privatnosti niti odlučiti može li rezultat služiti samo kao signal za pregled ili i kao dokaz u postupku.
Obveza proizlazi iz Kodeksa prakse o transparentnosti AI-generiranog sadržaja koji je u srpnju potpisalo oko 190 sudionika. Više proizvođača može koristiti različite ključeve i tehnike, pa zajedničko označavanje ne znači zajednički detektor. Tržišna vrijednost sustava ovisit će o interoperabilnosti, stopi pogrešnih nalaza i pravilima pristupa, a ne samo o postojanju obrasca.
