Anthropic začal od augusta do textov vytvorených modelmi Claude vkladať neviditeľný vodoznak. Nejde však o skryté znaky, metadáta ani tajný identifikátor používateľa. Takáto značka vzniká priamo pri výbere slov a odhaliť ju dokáže až štatistická analýza s príslušným kľúčom.

Keď sa teda povie vodoznak, väčšina ľudí si asi predstaví priesvitné logo cez fotografiu ako y fotobanky alebo značku ukrytú v bankovke. V texte od Claude však nič podobné neuvidíte. Anthropic oznámil, že budúce modely Claude budú svoje výstupy označovať štatistickým vodoznakom založeným na technológii SynthID-Text od Google DeepMind.

Cieľom označovania nie je s absolútnou istotou určiť autora. Detektor má vedieť odhadnúť, aká je pravdepodobnosť, že sa Claude podieľal na vzniku alebo výraznej úprave textu.

Vodoznak nie je ukrytý znak

Anthropic výslovne uvádza, že do textu nepridáva neviditeľné Unicode znaky, medzery ani metadáta, ako by sa možno na prvý pohľad alo očakávať. Vodoznak preto nezmizne jeho jednoduchým kopírovaním do Wordu, e-mailu alebo CMS. Nejde o samostatnú informácia prilepenú k textu. "Mágia" je v spôsobe, akým model vyberá ďalšie slová.

Jazykový model tvorí odpoveď postupne (po tokenoch) a teda po slovách alebo ich častiach. Pri každom kroku vypočíta, ktoré pokračovania dávajú v danom kontexte zmysel. Niekedy existuje iba jedna rozumná možnosť, inokedy je rovnako dobrých možností viac.

Príklad - predstavme si vetu: „Dnes bolo chladno a…“ model môže pokračovať slovom „zamračené“, „sychravo“ alebo iným očakávaným výrazom. Význam sa zásadne nezmení. Práve takéto rozhodnutia s nízkym rizikom môže systém využiť na vytvorenie vzoru.

Rozhoduje kľúč a predchádzajúci kontext

Pri bežnom generovaní textu ovplyvňuje konečný výber tokenu zdroj náhodnosti. Pri označovaní textu vodoznakom sa táto náhodnosť odvodzuje od tajného kľúča a niekoľkých predchádzajúcich tokenov. Model stále vyberá iba medzi vhodnými pokračovaniami, no séria jeho rozhodnutí začne zodpovedať vzoru, ktorý dokáže neskôr overiť držiteľ kľúča.

Jedno slovo nič neprezradí. V dlhšom texte sa však nazbiera množstvo malých rozhodnutí. Detektor ich porovná s rozhodnutiami očakávanými pri použití kľúča a vypočíta pravdepodobnosť, že text vytvoril alebo spracoval Claude.

Claude používa verziu metódy SynthID-Text, ktorú Google DeepMind opísal v časopise Nature v roku 2024. Technológia upravuje iba proces výberu ďalšieho tokenu, nie tréning modelu. Podľa publikovaných testov má zanedbateľný vplyv na rýchlosť a nezhoršuje kvalitu textu. V experimente na približne 20 miliónoch odpovedí Gemini sa rozdiely v hodnoteniach označených a neoznačených odpovedí ukázali ako štatisticky nevýznamné.

Kedy je značka silná a kedy slabá

Spoľahlivosť detekcie rastie s dĺžkou textu. Čím viac slov Claude vyberie, tým viac stôp môže vodoznak zanechať. Krátka odpoveď poskytuje detektoru málo údajov a výsledok bude menej istý.

Slabšia značka vzniká aj v pasážach, kde model nemá veľkú voľnosť. Po texte „2 + 2 =“ je správnym pokračovaním číslo 4. Podobne sa nedá svojvoľne meniť názov Newtonovho diela Principia Mathematica. Systém nemá dôvod uprednostniť iný token iba kvôli vodoznaku, ak by tým poškodil faktickú správnosť.

Rovnaké obmedzenie platí pri tvorebe kódu, resp. pri programovaní. Syntax a názvy musia byť často presné, takže v samotnom kóde je menej priestoru na označovanie. Viac voľnosti môže byť napríklad v komentároch, esejách a pod.

Čo ak Claude text iba opraví alebo preloží?

Vodoznak sa vzťahuje iba na slová, ktoré vytvoril Claude. Ak mu človek pošle vlastný text a požiada len o opravu gramatiky a interpunkcie, väčšina slov zostane pôvodná. Značka môže vzniknúť v niekoľkých zmenách, no signál bude pravdepodobne príliš slabý na spoľahlivé rozpoznanie.

Pri výraznom preformulovaní už Claude robí viac rozhodnutí a pravdepodobnosť detekcie rastie. Ešte jednoznačnejší je preklad: hoci myšlienky a pôvodný text patria človeku, každé slovo výslednej jazykovej verzie vyberá model. Preklad vytvorený Claude preto vodoznak obsahuje.

To môže byť citlivé napríklad pri tlačových správach, marketingových textoch, novinárskych materiáloch či dokumentoch pre klientov. Detektor totiž nerozlíši, či Claude vytvoril obsah od nuly, preložil ho alebo iba zásadne prepracoval. Oznámi len pravdepodobnosť, že sa model na výstupe podieľal.

Dá sa vodoznak odstrániť?

Ľahké úpravy či kopírovanie by ho nemali úplne odstrániť. Výrazné preformulovanie ho však môže oslabiť a kompletné prepísanie, pri ktorom sa zmení prakticky celý text, ho môže zničiť. Vodoznak preto nie je nezničiteľný dôkaz pôvodu.

Nie je to ani univerzálny detektor umelej inteligencie. Anthropic dokáže odpovedať iba na otázku, či sa na texte pravdepodobne podieľal Claude. Nevie potvrdiť, že text napísal človek, ani spoľahlivo identifikovať výstup iného modelu. Nedokáže tiež rozlíšiť, či Claude text vytvoril od nuly alebo ho výrazne upravil.

Vodoznak nemení autorstvo ani vlastníctvo

Prítomnosť značky sama osebe neurčuje, komu text patrí a kto je jeho autorom. Podľa Anthropic nemení práva používateľa k výstupu ani právnu zodpovednosť za publikovaný obsah. „Claude bol pravdepodobne do procesu zapojený“ preto nemožno automaticky preložiť ako „tento text celý napísala AI“.

Je to dôležité aj pri zmluvách alebo používani v AI na školách. Ak zakazujú či obmedzujú používanie AI, mali by presne povedať, či sa zákaz týka generovania, prekladu, korektúry alebo ľubovoľnej asistencie. Samotný detektor kontext a rozsah použitia AI nedodá a jeho výsledok by nemal byť jediným podkladom pre sankciu.

Žiadne údaje o používateľovi

Podľa Anthropic vodoznak neobsahuje identitu používateľa, názov firmy, účet ani odkaz na konkrétnu konverzáciu. Nejde teda o sledovací identifikátor. Označuje iba pravdepodobné zapojenie modelu.

Vodoznak nepridáva ďalšie tokeny, takže nemá zvýšiť cenu používania. Jeho vplyv na rýchlosť má byť zanedbateľný.

Časť používateľov novinku odmieta

Oznámenie vyvolalo kritiku najmä medzi ľuďmi, ktorí Claude používajú na profesionálne preklady, kontrolu kódu alebo úpravy vlastných textov. CzechCrunch s odvolaním na Business Insider opísal aj niekoľko používateľov, ktorí pre obavy z reakcií klientov alebo zo zmluvných dôsledkov zrušili platené predplatné.

Anthropic pre Business Insider uviedol, že po oznámení nezaznamenal zvýšenú mieru rušenia predplatného. Spor tak zatiaľ ukazuje skôr rozdielne pohľady an transparentnosť: jedni považujú označenie zapojenia AI za užitočné, iní sa obávajú, že pravdepodobnostný výsledok bude verejnosť alebo klient interpretovať ako dôkaz úplného AI autorstva.

Súbory dostanú iný typ označenia

Pri súboroch napríklad PNG, JPG alebo SVG, použije Claude odlišný mechanizmus. Do metadát vloží kryptograficky podpísané potvrdenie podľa otvoreného štandardu C2PA. To oznámi, že Claude súbor vytvoril alebo spracoval.

Na rozdiel od textového vodoznaku ide o samostatnú informáciu v metadátach súboru. Nástroje podporujúce C2PA ju dokážu prečítať, ale samotný vizuálny obsah sa nemení.

Prečo sa to deje práve teraz

Dôvodom je európsky AI Act. Povinnosti transparentnosti podľa článku 50 sa uplatňujú od 2. augusta 2026. Poskytovatelia majú tam, kde je to technicky možné, zabezpečiť strojové rozpoznanie textu, zvuku, obrazu alebo videa vytvoreného či upraveného AI.

Nové modely Claude preto dostanú textový vodoznak globálne, nielen v Európskej únii. Anthropic vysvetľuje globálne nasadenie tým, že zatiaľ nemá trvácny spôsob, ako funkciu spoľahlivo obmedziť iba podľa regiónu. Pre systémy uvedené na trh pred 2. augustom 2026 platí prechodné obdobie do 2. decembra 2026. Anthropic chce vodoznak do starších modelov pridávať postupne.

Vodoznak zdaleka nevyrieši všetky spory o pôvode textu. Je však technicky zaujímavejší než terajšie klasické „AI detektory“, ktoré hľadajú typické frázy a štýlové návyky modelov.