OpenAI oficjalnie wprowadza niewidzialne znaki wodne do tekstów generowanych przez ChatGPT i narzędzie programistyczne Codex na terenie Unii Europejskiej. Krok ten, wymuszony unijnym Aktem o sztucznej inteligencji (AI Act), ma ułatwić odróżnianie twórczości maszynowej od ludzkiej. W praktyce technologiczne realia okazują się jednak znacznie bardziej złożone: sam stempel łatwo zatrzeć, a jego obecność wywołuje spór o definicję współczesnego autorstwa.
Zmiana, o której poinformował TechCrunch, dotyczy wszystkich planów abonamentowych dla użytkowników w Unii Europejskiej. W przypadku interfejsu programistycznego (API) twórcy oprogramowania otrzymają opcję włączenia znaku wodnego (opt-in), lecz domyślnie pozostanie ona wyłączona. Ruch ten następuje dwa miesiące po tym, jak konkurencyjny koncern Anthropic zdecydował się na znakowanie tekstów generowanych przez model Claude. Podczas gdy Anthropic wdrożył to rozwiązanie globalnie, OpenAI ogranicza debiut wyłącznie do jurysdykcji unijnej.
Jak działa cyfrowy „tatuaż” na słowach?
Tradycyjny znak wodny kojarzy się z pieczęcią na banknocie lub półprzezroczystym logo na zdjęciu. W przypadku czystego tekstu ASCII taki mechanizm nie wchodzi jednak w grę — formatowanie czy ukryte metadane znikają przy najprostszym skopiowaniu i wklejeniu do notatnika. Opracowany przez OpenAI system pod nazwą textGrain operuje na poziomie prawdopodobieństwa wyboru słów (tokenów).
Każdy duży model językowy (LLM), generując zdanie, oblicza szanse wystąpienia kolejnego wyrazu. System znakowania wprowadza do tego procesu matematyczną regułę:
-
podczas doboru kolejnego tokena algorytm dzieli potencjalną pulę słów na dwie grupy (umownie: „zieloną” i „czerwoną”), bazując na tajnym kluczu kryptograficznym oraz poprzedzającym fragmencie tekstu;
-
zamiast wybrać słowo o bezwzględnie najwyższym prawdopodobieństwie, model sztucznie faworyzuje słowo z puli uprzywilejowanej, o ile nie zniekształca to sensu ani płynności wypowiedzi;
-
dla ludzkiego oka tekst brzmi w pełni naturalnie. Jednak dedykowany detektor wyposażony w ten sam klucz matematyczny od razu widzi anomalię: statystyczne nagromadzenie słów z jednej grupy przekracza przypadkowy rozkład, potwierdzając ingerencję algorytmu.
Sitko zamiast tarczy
OpenAI nie ukrywa ograniczeń technologicznych. Sam brak znaku nie jest dowodem na to, że treść napisał człowiek. Znak wodny staje się niewykrywalny w kilku scenariuszach:
-
zbyt krótki fragment: aby statystyka dała pewny wynik, algorytm potrzebuje odpowiednio długiej próby. Kilka zdań czy pojedynczy akapit nie wystarczą do weryfikacji.
-
parafraza i redakcja: wystarczy, że człowiek przeredaguje wygenerowaną treść, zmieni szyk zdań lub podmieni część synonimów — wówczas starannie ułożona sekwencja prawdopodobieństw ulega zatarciu.
-
przepuszczenie przez inny model: przeklejenie odpowiedzi z ChatGPT do nielicencjonowanego modelu open-source z prośbą o „streszczenie” lub „przepisanie własnymi słowami” bezpowrotnie niszczy ukryty wzorzec.
Świadomość tych wad sprawiła, że OpenAI wstrzymuje się z udostępnieniem publicznego detektora. „Ograniczenia te wpłynęły na naszą decyzję o udostępnieniu wstępnego dostępu do detektora wyłącznie zatwierdzonym badaczom i organizacjom eksperckim, które pomogą nam ocenić jego niezawodność i odpowiedzialne zastosowania” — poinformowało OpenAI w oficjalnym komunikacie.
Firma obawia się m.in. fałszywych oskarżeń w edukacji czy urzędach, a także sytuacji, w której zbyt powszechny dostęp do narzędzia analitycznego ułatwiłby opracowanie automatycznych skryptów do usuwania sygnatury (spoofing).
Brukselski bat i dylemat współautorstwa
Decyzja OpenAI to bezpośredni skutek wejścia w życie przepisów unijnego Aktu o sztucznej inteligencji (EU AI Act), którego artykuł 50 nakłada na dostawców systemów AI obowiązek oznaczania syntetycznych treści w sposób czytelny maszynowo. Regulacja zderza się jednak z realiami codziennej pracy użytkowników. Znakowanie tekstu budzi opór twórców, analityków i programistów. Kiedy Anthropic wdrożył podobne rozwiązanie w modelu Claude, przez fora branżowe przetoczyła się fala krytyki. Użytkownicy podnosili, że to oni dostarczają unikalny kontekst, strukturę, decyzje merytoryczne i prompt, podczas gdy model jest wyłącznie narzędziem wykonawczym — analogicznie do edytora tekstu czy kalkulatora.
Przedstawiciele OpenAI sami przyznają, że stempel jest narzędziem tępym i nie rozróżnia ról w procesie twórczym: „[Znaki wodne] mogą wskazywać, że system OpenAI wygenerował lub przetworzył część fragmentu tekstu, ale nie to, jak wiele ludzkiego osądu, redakcji czy kreatywności w niego włożono” — podkreśla firma.
Oznacza to, że jeśli pisarz lub naukowiec użyje asystenta AI jedynie do wygładzenia stylu własnego eseju albo przetłumaczenia go na język obcy, tekst może zostać oznaczony jako „pochodzący z OpenAI”, redukując rolę człowieka do zera w oczach algorytmicznych weryfikatorów.
Nowy obowiązek pokazuje rozdźwięk między ambicjami unijnych regulatorów a fizyką modeli językowych. O ile w grafice czy wideo standardy pochodzenia treści (np. metadane C2PA) dają względnie stabilny grunt, o tyle w przypadku tekstu granica między dziełem człowieka a kompilacją maszyny pozostaje płynna — i żaden niewidzialny algorytm na razie tego nie zmieni.