Granica między słowem pisanym ludzką ręką a frazą wygenerowaną przez algorytmy zaciera się każdego dnia. W erze, w której modele językowe tworzą bezbłędne eseje, raporty i posty w ułamku sekundy, pojawia się fundamentalne wyzwanie: jak zachować transparentność cyfrowego świata? Odpowiedź na to pytanie postanowiła przedstawić firma Anthropic, twórca popularnego modelu Claude. Zamiast czekać na zewnętrzne narzędzia weryfikujące, inżynierowie postanowili wbudować w generowane treści niewidzialny dla oka, lecz czytelny dla algorytmów podpis. Krok ten wpisuje się w unijny Kodeks Praktyki oraz wytyczne europejskiego AI Act, które kładą silny nacisk na jawność materiałów syntetycznych.
Nowy system znakowania objął swoim zasięgiem niemal cały ekosystem Claude’a. Oznacza to, że cichy ślad pojawia się nie tylko w bezpośredniej rozmowie na czacie, ale również w narzędziach programistycznych i biznesowych pokroju Claude Platform, Claude Code, Claude Cowork czy Claude Tag. Co więcej, mechanizm działa również w środowiskach chmurowych gigantów technologicznych, takich jak AWS, Google Cloud oraz Microsoft Foundry.
Jak ukryć znak wodny między literami?
Tradycyjny znak wodny kojarzy się z półprzezroczystym symbolem nałożonym na zdjęcie lub tłoczeniem w papierze firmowym. W przypadku tekstu sprawa jest znacznie bardziej subtelna. Twórcy Claude’a sięgnęli po wyrafinowane podejście matematyczne, opierające się na mechanizmie znanym w świecie nauki jako metoda KGW.
Matematyczna gra prawdopodobieństw
Podczas gdy model układa kolejne zdania, nieustannie wybiera następne słowa, zwane w żargonie AI tokenami. W klasycznym procesie algorytm bierze pod uwagę logiczny kontekst i prawdopodobieństwo wystąpienia danego wyrazu. W nowym wariancie do akcji wkracza jednak tajny klucz kryptograficzny, który dzieli potencjalne słowa na dwie grupy, po czym delikatnie faworyzuje jedną z nich. Czytelnik pochłonięty lekturą nie zauważy absolutnie żadnej zmiany w tonie, stylu czy poprawności gramatycznej tekstu. Jednak wyspecjalizowany detektor, uzbrojony w ten sam klucz, bez trudu dostrzeże statystyczną anomalię i nienaturalnie częstą obecność słów z wybranej puli.
Znak wodny w tekście to zresztą tylko połowa strategii. Jeśli Claude generuje pliki graficzne, dołącza do nich cyfrowy certyfikat pochodzenia oparty na otwartym standardzie C2PA. Pozwala on prześledzić historię pliku i sprawdzić, czy obraz nie został poddany późniejszym modyfikacjom.
Technologia obiecująca, lecz nie wszechmogąca
Choć wizja bezbłędnej identyfikacji maszynowych treści brzmi uspokajająco, sami twórcy oraz niezależni analitycy studzą nadmierny entuzjazm. Niewidzialny znak wodny nie jest magicznym rozwiązaniem każdego problemu z rozpoznawaniem AI, lecz raczej statystyczną wskazówką o określonych ograniczeniach.
Ślad pozostawiony przez algorytm można bowiem stosunkowo łatwo zniekształcić lub całkowicie zatrzeć. Wystarczy solidna redakcja językowa, gruntowna zmiana szyku zdań, przetłumaczenie fragmentu na inny język czy wplecenie dużej ilości własnych akapitów. Trudności pojawiają się także przy bardzo krótkich formach wypowiedzi, gdzie przestrzeń do wyboru alternatywnych słów jest zbyt mała, by ukryć statystyczny wzorzec. Dodatkowo obecność znaku nie musi świadczyć o tym, że tekst od zera stworzyła maszyna – wystarczy, że człowiek poprosił Claude’a o korektę interpunkcji lub skrócenie własnego tekstu, by model pozostawił w nim swój podpis.
Wprowadzenie znakowania przez Anthropic to ważny krok w stronę odpowiedzialnego rozwoju technologii. Pokazuje, że przyszłość sztucznej inteligencji będzie zależeć nie tylko od jej kreatywności i sprawności językowej, ale przede wszystkim od budowania narzędzi wzajemnego zaufania w cyfrowym świecie.