ChatGPT wprowadza ważną zmianę w UE. Teksty z AI dostaną ukryty ślad
OpenAI zacznie oznaczać teksty wygenerowane przez ChatGPT i Codex specjalnym niewidocznym dla człowieka znakiem wodnym. Nowa technologia ma pozwolić wykrywać treści stworzone przez sztuczną inteligencję i jest odpowiedzią na wymogi unijnego AI Act.
- OpenAI zacznie w najbliższych tygodniach znakować teksty generowane przez ChatGPT i Codex w Unii Europejskiej.
- Niewidoczny dla użytkownika watermark będzie zapisany bezpośrednio w tekście poprzez odpowiedni dobór słów i ma umożliwiać jego wykrycie przez specjalny system.
- Rozwiązanie jest związane z wymogami unijnego AI Act.
- OpenAI przyznaje, że zastąpienie 10% słów synonimami może obniżyć skuteczność wykrywania z około 92 do 66%.
ChatGPT doda niewidoczny znak
OpenAI poinformowało, że w najbliższych tygodniach zacznie wdrażać system znakowania tekstów generowanych przez ChatGPT i Codex.
Na początku rozwiązanie obejmie użytkowników w Unii Europejskiej, niezależnie od posiadanego planu.
Nie chodzi jednak o klasyczny znak wodny widoczny na ekranie.
OpenAI opracowało mechanizm, który delikatnie modyfikuje dobór słów przez model, tworząc charakterystyczny wzorzec możliwy do wykrycia przez specjalny detektor.
Co ważne, watermark jest zapisany bezpośrednio w tekście. Oznacza to, że powinien pozostać w nim również po skopiowaniu i wklejeniu treści do innego dokumentu.
OpenAI podkreśla jednocześnie, że taki znak nie pozwoli ustalić tożsamości użytkownika.
Wszystko przez unijne przepisy dotyczące AI
Wprowadzenie watermarku jest związane z unijnym AI Act.
Przepisy dotyczące przejrzystości zaczęły obowiązywać 2 sierpnia i wymagają, aby treści wygenerowane przez systemy sztucznej inteligencji można było odpowiednio oznaczać i identyfikować przez inne systemy.
OpenAI twierdzi, że podczas testów „watermarkowanie” nie powodowało istotnego pogorszenia działania modeli.
Firma opublikowała również dokument techniczny dotyczący rozwiązania nazwanego textGrain.
System wykorzystuje specjalny klucz i odpowiednio modyfikuje prawdopodobieństwo wyboru kolejnych słów.
Pojedyncza zmiana jest praktycznie niewidoczna, ale po zastosowaniu takich modyfikacji w całym tekście powstaje wzorzec, który może zostać rozpoznany przez detektor.
Watermark można jednak oszukać
Technologia OpenAI ma istotne ograniczenia. Firma sama przyznaje, że nie jest to niezawodny sposób na wykrywanie tekstów AI.
W jednym z testów zastąpienie zaledwie 10% słów ich synonimami obniżyło skuteczność wykrywania z około 92 do 66%. Jeszcze większym problemem mogą być bardzo krótkie teksty, odpowiedzi matematyczne oraz tłumaczenia.
Podkreślmy również, że brak watermarku nie oznacza automatycznie, że tekst napisał człowiek. Treść mogła być zbyt krótka, mocno przeredagowana albo wygenerowana przez konkurencyjny model AI.
Firma nie zamierza więc na razie udostępniać swojego detektora wszystkim.
Dostęp otrzymają początkowo wybrani badacze i wyspecjalizowane organizacje, które mają pomóc ocenić skuteczność oraz odpowiedzialne zastosowania technologii.
OpenAI wcześniej bało się wprowadzić watermark
To nie jest pierwszy raz, gdy OpenAI pracuje nad znakowaniem tekstów generowanych przez AI.
Firma stworzyła podobną technologię już wcześniej, ale ostatecznie nie zdecydowała się na jej publiczne udostępnienie.
Jedną z obaw było ryzyko, że użytkownicy zaczną korzystać z konkurencyjnych usług, w ramach których nie oznacza się treści AI.
Śledź CrypS. w Google News. Czytaj najważniejsze wiadomości bezpośrednio w Google! Obserwuj ->
Zajrzyj na nasz telegram i dołącz do Crypto. Society. Dołącz ->