W odpowiedzi na unijne regulacje AI Act, firma OpenAI rozpoczęła na początku października 2026 roku wdrażanie technologii textGrain, czyli niewidzialnego „znaku wodnego” w tekstach generowanych przez ChatGPT. Rozwiązanie, obejmujące użytkowników we wszystkich planach subskrypcyjnych w Unii Europejskiej, ma na celu identyfikację treści tworzonych przez AI, jednak jego skuteczność można łatwo zneutralizować przez proste modyfikacje tekstu.
Technologia nazwana textGrain nie jest tradycyjnym znakiem wodnym, który osadza się w pliku. To zaawansowany system kodujący statystyczny sygnał bezpośrednio w doborze słów podczas generowania odpowiedzi. W praktyce oznacza to, że model AI w subtelny, niezauważalny dla człowieka sposób preferuje określone tokeny (słowa lub ich części), tworząc unikalny wzorzec, który może być później wykryty przez specjalne narzędzie.
Nowe zabezpieczenie zostało wdrożone w ChatGPT oraz w modelu programistycznym Codex. OpenAI zaznacza, że w testach wewnętrznych obecność mechanizmu textGrain nie wpłynęła negatywnie na wydajność modeli. Deweloperzy korzystający z komercyjnego interfejsu API (API) na całym świecie również zyskali możliwość włączenia tej funkcji, jednak globalnie pozostaje ona domyślnie wyłączona.
Decyzja o obligatoryjnym wdrożeniu textGrain wyłącznie na terenie Unii Europejskiej jest bezpośrednią reakcją na przepisy AI Act, które nakładają na twórców AI obowiązek zapewnienia identyfikowalności treści generowanych maszynowo. W tym kontekście Europa stała się swoistym poligonem doświadczalnym dla rozwiązań mających zwiększyć przejrzystość w dobie generatywnej sztucznej inteligencji. Na pozostałych rynkach OpenAI nie zdecydowało się na narzucenie tego rozwiązania, pozostawiając je jako w pełni opcjonalne.
Mimo innowacyjności, skuteczność wykrywania znaków wodnych textGrain jest ograniczona i silnie zależna od tematyki oraz długości tekstu. Przy założonym poziomie fałszywych alarmów na poziomie 1%, detektor radzi sobie z różną efektywnością:
Największą słabością systemu jest jednak jego podatność na proste modyfikacje. Nawet niewielka ingerencja w wygenerowany tekst może niemal całkowicie zniweczyć możliwość jego identyfikacji jako dzieła AI.
Zastąpienie zaledwie 10% słów synonimami obniża wykrywalność z około 92% do 66%, a zmiana jednej czwartej wyrazów w tekście redukuje skuteczność wykrywania do zaledwie 17%.
Oznacza to, że każda osoba chcąca ukryć pochodzenie tekstu może to zrobić w kilka minut, korzystając z podstawowych narzędzi do edycji lub parafrazy. Dla wydawców i weryfikatorów informacji stanowi to poważne wyzwanie, pokazując, że obecna technologia znakowania jest krokiem w dobrym kierunku, ale dalekim od niezawodności.
ChatGPT z niewidzialnym „znakiem wodnym”. Będzie wiadomo, który tekst wygenerowała AI, Cyfrowa Rzeczpospolita, 2026. https://cyfrowa.rp.pl/ai/art45257991-chatgpt-oznakuje-tresci-bedzie-wiadomo-ze-tekst-generowala-ai-a-nie-czlowiek
OpenAI Begins Phased Text Watermarking Under EU AI Act Rules, Unite.AI, 2026. https://www.unite.ai/pl/openai-begins-phased-text-watermarking-under-eu-ai-act-rules/
OpenAI, textGrain: il watermarking arriva in UE, ma è già obsoleto?, pasqualepillitteri.it, 2026. https://pasqualepillitteri.it/pl/news/20972/openai-textgrain-znak-wodny-ue
OpenAI wprowadza niewidzialne znaki wodne w UE w odpowiedzi na AI Act, aisight.pl, 2026. https://aisight.pl/technologia/generatywna-ai/openai-niewidzialne-znaki-wodn-w-ue/
Wyjaśnienie znakowania wodnego AI: OpenAI, Google i Claude, Proofreaderpro.ai, 2026. https://proofreaderpro.ai/pl/blog/ai-watermarking-explained-openai-google-claude
