Wiadomości branżowe

Dlaczego nowy cyfrowy znak wodny OpenAI nie uchroni Cię przed manipulacją

OpenAI wprowadza znakowanie wodne textGrain dla ChatGPT w UE, aby dostosować się do nowych przepisów. Dowiedz się, dlaczego tę ukrytą technologię jest zaskakująco łatwo ominąć.
Dlaczego nowy cyfrowy znak wodny OpenAI nie uchroni Cię przed manipulacją

Podczas gdy świat domaga się jasności co do tego, co jest dziełem człowieka, a co maszyny, OpenAI właśnie wprowadziło narzędzie, które obiecuje przejrzystość, ale dostarcza coś znacznie bardziej kruchego. Firma ogłosiła niedawno, że ChatGPT będzie teraz domyślnie znakować wodnie swoje teksty wyjściowe dla użytkowników w Unii Europejskiej. Zmiana ta wynika z wymogów aktu o sztucznej inteligencji (EU AI Act), który nakazuje, aby treści generowane przez AI były wykrywalne. Jednak rzeczywistość kryjąca się „pod maską” sugeruje, że ta nowa cyfrowa pieczęć przypomina nie tyle trwałe piętno, co lekki ślad ołówka, który dziecko mogłoby zmazać jednym ruchem.

OpenAI nazywa swoją nową metodę textGrain. Mówiąc prościej, jest to autorski system, który osadza wzorce statystyczne w słowach wybieranych przez AI. Dla przeciętnego użytkownika tekst wygląda identycznie jak każda inna odpowiedź. Gramatyka jest poprawna, ton spójny, a informacje takie same. Jednak dla wyspecjalizowanego narzędzia detekcyjnego te wybory słowne działają jak odcisk palca. System ten operuje niczym niestrudzony stażysta, któremu polecono używać określonego zestawu synonimów za każdym razem, gdy pisze notatkę. Jeśli znasz wzorzec, możesz zidentyfikować stażystę. Jeśli go nie znasz, notatka wygląda na całkowicie standardową.

Kruchość niewidzialnych wzorców

Patrząc na szerszy obraz, skuteczność textGrain zależy całkowicie od tego, czy tekst pozostanie nienaruszony. Własne dane OpenAI ujawniają zaskakującą słabość, którą większość korporacyjnych komunikatów prasowych wolałaby pominąć. W idealnych warunkach narzędzie ma 92-procentową skuteczność w identyfikowaniu własnego pisma. Brzmi to imponująco, dopóki nie zastosuje się najmniejszego nakładu ludzkiej pracy.

Zmiana zaledwie 10 procent wygenerowanego tekstu powoduje spadek wykrywalności o prawie 30 procent. Jeśli użytkownik podmieni 20 procent słów — na przykład zmieniając kilka przymiotników lub przeredagowując parę zdań — wskaźnik sukcesu spada o blisko 75 procent. W praktyce każdy, kto ma podstawowe pojęcie o korzystaniu ze słownika synonimów, może obejść ten system w kilka sekund. To sprawia, że znak wodny jest raczej narzędziem zgodności dla regulatorów niż niezawodną siatką bezpieczeństwa dla społeczeństwa. Spełnia on literę prawa w UE, nie rozwiązując faktycznie nadrzędnego problemu oszustw z wykorzystaniem AI.

Opowieść o dwóch strategiach korporacyjnych

Na rynku kontrast między OpenAI a jego głównym konkurentem, firmą Anthropic, jest wyraźny. Anthropic wprowadził własny system znakowania wodnego na początku tego roku, ale zdecydował się włączyć go dla wszystkich użytkowników na całym świecie. OpenAI obrało bardziej selektywną ścieżkę, włączając tę funkcję domyślnie tylko tam, gdzie wymaga tego prawo. Użytkownicy w Stanach Zjednoczonych, Azji i innych regionach nadal będą otrzymywać „czyste” wyniki, chyba że oni sami lub ich organizacje ręcznie włączą tę opcję za pośrednictwem API.

Ten regionalny podział tworzy pofragmentowane środowisko cyfrowe. Student w Berlinie otrzyma domyślnie eseje ze znakiem wodnym, podczas gdy student w Nowym Jorku już nie. Z punktu widzenia konsumenta sugeruje to, że OpenAI postrzega znakowanie wodne jako przeszkodę regulacyjną do pokonania, a nie jako fundamentalną cechę godnego zaufania produktu. Firma robi absolutne minimum, aby pozostać w zgodzie z prawem w UE, utrzymując jednocześnie swój produkt tak przystępnym, jak to tylko możliwe w innych miejscach.

Cecha OpenAI textGrain Anthropic Watermarking
Region domyślny Tylko UE Globalny
Skuteczność wykrywania 92% (Idealna) Wysoka (Autorska)
Wrażliwość na edycję Wysoka (20% zmian niszczy znak) Umiarkowana do wysokiej
Dostęp Ograniczony dla badaczy Publiczny/API
Standard Autorski Autorski/C2PA

Techniczna przeszkoda: tekst kontra obrazy

Od strony technicznej znakowanie wodne tekstu jest znacznie trudniejsze niż znakowanie obrazów czy wideo. Gdy system taki jak DALL-E lub Midjourney tworzy obraz, może ukryć metadane w pikselach lub dostosować wzorce szumów w sposób niewidoczny dla oka, ale oczywisty dla komputera. Piksele są gęste i oferują tysiące miejsc do ukrycia sygnału.

Tekst jest inny, ponieważ jest rzadki. Zdanie ma tylko określoną liczbę słów, a każde słowo ma ograniczoną liczbę synonimów, które mają sens w danym kontekście. Jeśli AI wymusza konkretny wybór słów, aby utrzymać znak wodny, ryzykuje, że tekst będzie brzmiał topornie lub powtarzalnie. OpenAI twierdzi, że textGrain nie obniża jakości, ale statystyczny kompromis jest zawsze obecny. Aby znak wodny był wykrywalny, AI musi poświęcić niewielką część swojej kreatywnej losowości. Właśnie dlatego wskaźnik wykrywalności jest jeszcze niższy w przypadku krótkich wiadomości lub tekstów tłumaczonych. W e-mailu składającym się z trzech zdań po prostu nie ma wystarczającej ilości danych, aby ukryć złożony matematyczny odcisk palca.

Co to oznacza dla Twojego cyfrowego życia

Dla codziennego użytkownika pojawienie się textGrain powinno spotkać się ze zdrowym sceptycyzmem. Jeśli jesteś nauczycielem, redaktorem lub menedżerem ds. rekrutacji, nie możesz polegać na tych detektorach jako na ostatecznej odpowiedzi. System jest zbyt łatwy do oszukania. Użytkownik może wziąć tekst z ChatGPT, przepuścić go przez inną, nieoznakowaną sztuczną inteligencję w celu szybkiego przeredagowania, a oryginalny znak wodny zniknie.

Ostatecznie jest to systemowa zmiana w sposobie, w jaki postrzegamy dowody cyfrowe. Odchodzimy od świata, w którym możemy ufać temu, co widzimy, w stronę świata, w którym potrzebujemy „klucza” do weryfikacji autentyczności. OpenAI obecnie trzyma ten klucz za aksamitnym sznurem, przyznając dostęp tylko ograniczonej liczbie badaczy i organizacji. Ta nieprzejrzystość tworzy nowy rodzaj nierównowagi sił. Firma, która tworzy treści, jest jednocześnie jedyną, która może je wiarygodnie wykryć, a nawet wtedy może to zrobić tylko wtedy, gdy użytkownik jest leniwy.

Nawigowanie w świecie ze znakami wodnymi

W praktyce wdrożenie textGrain w UE jest testem beta przyszłości, w której każda praca cyfrowa jest oznaczona. Służy to jako przypomnienie, że narzędzia, których używamy, w coraz większym stopniu podlegają niewidzialnemu kręgosłupowi prawa międzynarodowego. Choć unijny akt o sztucznej inteligencji ma na celu ochronę obywateli przed wprowadzaniem w błąd przez deepfake'i i zautomatyzowaną propagandę, dostępne narzędzia techniczne nie są jeszcze wystarczająco odporne, by zrealizować ten cel.

Konsumenci powinni obserwować własne nawyki w miarę wdrażania tych funkcji. Można zauważyć subtelne zmiany w sposobie, w jaki ChatGPT formułuje odpowiedzi, gdy model stara się utrzymać swój statystyczny odcisk palca. Można również spodziewać się wzrostu liczby narzędzi typu „AI-cleaner” — prostych programów zaprojektowanych specjalnie do przeredagowywania tekstu na tyle, by usunąć te znaczniki. Gra w kotka i myszkę między laboratoriami AI a użytkownikami wchodzi w nową, bardziej lokalną fazę.

Idąc naprzód, przestańmy szukać plakietki lub pieczątki z napisem „Wykonano przez AI”. Znaczniki te stają się częścią cyfrowej ropy naftowej zasilającej nasze aplikacje, ukrytą głęboko w matematyce czytanych przez nas zdań. Sedno sprawy polega na tym, że żaden znak wodny nie zastąpi krytycznego myślenia. Niezależnie od tego, czy akapit posiada ukryte statystyczne ziarno, czy nie, odpowiedzialność za weryfikację faktów i intencji nadal spoczywa na czytelniku. Cyfrowy stażysta taguje teraz swoją pracę, ale to wciąż do szefa należy sprawdzenie, czy praca jest faktycznie poprawna.

Źródła:

  • OpenAI Technical Paper on textGrain and Statistical Watermarking
  • European Commission: EU AI Act Regulatory Framework
  • Anthropic Official Blog: Global Deployment of AI Content Marking
  • C2PA (Coalition for Content Provenance and Authenticity) Standard Documentation
bg
bg
bg

Do zobaczenia po drugiej stronie.

Nasze kompleksowe, szyfrowane rozwiązanie do poczty e-mail i przechowywania danych w chmurze zapewnia najpotężniejsze środki bezpiecznej wymiany danych, zapewniając bezpieczeństwo i prywatność danych.

/ Utwórz bezpłatne konto