OpenAI ogłosiło plany dodania mechanizmu znakowania wodnego tekstu generowanego przez ChatGPT oraz Codex. Rozwiązanie ma ułatwić wykrywanie treści stworzonych przez sztuczną inteligencję i stanowi odpowiedź na rosnące wymagania regulacyjne.
Mechanizm znakowania tekstu od OpenAI
Firma OpenAI pracuje nad systemem, który pozwoli na dodawanie niewidocznych dla człowieka znaczników do tekstów generowanych przez modele językowe. Znakowanie wodne tekstu AI ma być wbudowane bezpośrednio w proces generowania odpowiedzi. Technika ta nie zmienia czytelności treści, ale umożliwia późniejsze wykrycie pochodzenia z konkretnego modelu.
Wdrożenie takiego rozwiązania wynika z potrzeby zwiększenia przejrzystości w obszarze generatywnej sztucznej inteligencji. Użytkownicy oraz platformy będą mogli łatwiej rozróżniać treści stworzone przez człowieka od tych wygenerowanych automatycznie. W praktyce oznacza to nowe możliwości weryfikacji autentyczności materiałów publikowanych online.
Zgodność z unijnym aktem o sztucznej inteligencji
Unijne przepisy nakładają na dostawców zaawansowanych modeli obowiązek oznaczania treści generowanych przez AI. Akt o sztucznej inteligencji (EU AI Act) wymaga przejrzystości w przypadku systemów wysokiego ryzyka. Znakowanie wodne stanowi jedno z narzędzi, które może pomóc spełnić te wymogi.
OpenAI musi dostosować swoje produkty do nadchodzących regulacji, które wejdą w życie w najbliższych latach. Mechanizm znakowania pozwala na automatyczne oznaczanie tekstów bez ingerencji użytkownika. Dzięki temu platformy i instytucje zyskują prostszy sposób na monitorowanie treści.
Wpływ na użytkowników i twórców treści
Wprowadzenie znakowania wodnego zmienia sposób, w jaki użytkownicy mogą korzystać z generowanych tekstów w kontekście publikacji. Osoby publikujące materiały będą musiały brać pod uwagę, że ich pochodzenie będzie możliwe do ustalenia. Identyfikacja treści AI staje się prostsza dla redakcji i platform społecznościowych.
Z drugiej strony rozwiązanie może ograniczyć nadużycia związane z masowym generowaniem fałszywych informacji. Twórcy zyskują narzędzie do weryfikacji, czy dany tekst pochodzi z modelu OpenAI. W dłuższej perspektywie może to wpłynąć na zaufanie do treści publikowanych w internecie.
Techniczne aspekty implementacji
Znakowanie wodne działa poprzez modyfikację statystycznego rozkładu tokenów w procesie generowania tekstu. Zmiany są subtelne i nie wpływają na spójność językową odpowiedzi. Model zachowuje jakość generowanych treści przy jednoczesnym dodaniu sygnatury.
OpenAI planuje wdrożenie mechanizmu zarówno w ChatGPT, jak i w interfejsie Codex. Testy mają potwierdzić skuteczność wykrywania nawet po drobnych modyfikacjach tekstu przez użytkownika. Rozwiązanie ma być odporne na proste próby usunięcia znaczników.
Porównanie z innymi podejściami branży
Inne firmy rozwijające modele językowe również eksperymentują z podobnymi technikami identyfikacji. Niektóre rozwiązania opierają się na metadanych, inne na analizie statystycznej. Znakowanie wodne OpenAI wyróżnia się integracją na poziomie samego modelu.
Porównanie różnych metod pokazuje, że żadna technika nie jest w pełni odporna na zaawansowane próby obejścia zabezpieczeń. OpenAI podkreśla jednak, że ich podejście ma być trudne do ominięcia przy zachowaniu pełnej użyteczności tekstu. Branża z uwagą obserwuje rozwój tych rozwiązań.
Konsekwencje dla prywatności i etyki
Wprowadzenie znakowania rodzi pytania o zakres gromadzenia informacji o generowanych treściach. Użytkownicy mogą obawiać się, że każdy wygenerowany tekst będzie śledzony przez firmę. Śledzenie treści AI wymaga jasnych zasad dotyczących przechowywania danych.
Z etycznego punktu widzenia znakowanie wodne może ograniczyć anonimowe wykorzystanie AI do nieetycznych celów. Jednocześnie pojawia się ryzyko nadużyć ze strony instytucji monitorujących treści. OpenAI musi znaleźć równowagę między przejrzystością a ochroną prywatności użytkowników.
Źródła:
The Verge, https://www.theverge.com/ai-artificial-intelligence/1004880/openai-chatgpt-text-watermarks-eu-ai-act