Kol pasaulis reikalauja aiškumo, kas yra žmogaus, o kas – mašinos kūrinys, „OpenAI“ ką tik pristatė įrankį, kuris žada skaidrumą, tačiau pateikia kažką kur kas trapesnio. Bendrovė neseniai paskelbė, kad „ChatGPT“ nuo šiol pagal numatytuosius nustatymus žymės savo tekstus vandenženkliais vartotojams Europos Sąjungoje. Šis pakeitimas atitinka ES DI akto reikalavimus, nurodančius, kad dirbtinio intelekto (DI) sukurtas turinys turi būti atpažįstamas. Tačiau realybė „po variklio dangčiu“ rodo, kad šis naujas skaitmeninis antspaudas labiau primena ne neištrinamą prekės ženklą, o lengvą pieštuko žymę, kurią vaikas galėtų nuvalyti vienu brūkštelėjimu.
„OpenAI“ savo naująjį metodą vadina „textGrain“. Paprastai tariant, tai patentuota sistema, kuri į DI pasirenkamus žodžius įterpia statistinius dėsningumus. Vidutiniam vartotojui tekstas atrodo identiškas bet kuriam kitam atsakymui. Gramatika taisyklinga, tonas nuoseklus, o informacija tokia pati. Tačiau specializuotam aptikimo įrankiui šie žodžių pasirinkimai veikia kaip pirštų atspaudai. Ši sistema veikia tarsi nepavargstantis praktikantas, kuriam buvo liepta rašant atmintines naudoti specifinį sinonimų rinkinį. Jei žinote dėsningumą, galite atpažinti praktikantą. Jei dėsningumo nežinote, atmintinė atrodo visiškai standartinė.
Žvelgiant į platesnį vaizdą, „textGrain“ efektyvumas visiškai priklauso nuo to, ar tekstas lieka nepakeistas. Pačios „OpenAI“ duomenys atskleidžia stulbinantį pažeidžiamumą, kurį dauguma korporatyvinių pranešimų spaudai mieliau nutylėtų. Idealiomis sąlygomis įrankio sėkmės rodiklis atpažįstant savo raštą siekia 92 proc. Tai skamba įspūdingai, kol neįdedama bent šiek tiek žmogaus pastangų.
Pakeitus vos 10 proc. sugeneruoto teksto, aptikimo rodiklis nukrenta beveik 30 proc. Jei vartotojas pakeičia 20 proc. žodžių – galbūt pakeisdamas kelis būdvardžius ar perfrazuodamas porą sakinių – sėkmės rodiklis sumažėja beveik 75 proc. Praktiškai kalbant, bet kas, turintis pagrindinių žinių apie sinonimų žodyną, gali apeiti šią sistemą per kelias sekundes. Dėl to vandenženklis tampa labiau atitikties įrankiu reguliuotojams, o ne patikimu saugos tinklu visuomenei. Jis tenkina ES įstatymo raidę, tačiau iš tikrųjų neišsprendžia esminės DI apgaulės problemos.
Rinkos pusėje kontrastas tarp „OpenAI“ ir pagrindinio jos konkurento „Anthropic“ yra akivaizdus. „Anthropic“ savo vandenženklių sistemą pristatė anksčiau šiais metais, tačiau nusprendė ją įjungti visiems vartotojams visame pasaulyje. „OpenAI“ pasirinko selektyvesnį kelią, įjungdama šią funkciją automatiškai tik ten, kur to reikalauja įstatymai. Vartotojai JAV, Azijoje ir kituose regionuose vis tiek gaus „švarius“ rezultatus, nebent jie patys ar jų organizacijos rankiniu būdu pasirinks šią funkciją per API.
Šis regioninis pasidalijimas sukuria fragmentuotą skaitmeninę aplinką. Studentas Berlyne pagal numatytuosius nustatymus gaus vandenženkliais pažymėtus rašinius, o studentas Niujorke – ne. Vartotojo požiūriu tai rodo, kad „OpenAI“ vandenženklių naudojimą vertina kaip reguliavimo kliūtį, kurią reikia įveikti, o ne kaip pagrindinę patikimo produkto savybę. Bendrovė daro minimumą, kad išliktų legali ES, kartu išlaikydama savo produktą kuo paprastesnį naudoti kitur.
| Savybė | OpenAI textGrain | Anthropic Watermarking |
|---|---|---|
| Numatytasis regionas | Tik ES | Pasaulinis |
| Aptikimo rodiklis | 92% (Idealus) | Aukštas (Patentuotas) |
| Jautrumas redagavimui | Aukštas (20% pakeitimas sugadina) | Vidutinis/Aukštas |
| Prieiga | Ribota tyrėjams | Vieša/API |
| Standartas | Patentuotas | Patentuotas/C2PA |
Žvelgiant techniškai, žymėti tekstą vandenženkliais yra gerokai sunkiau nei vaizdus ar vaizdo įrašus. Kai tokia sistema kaip „DALL-E“ ar „Midjourney“ sukuria vaizdą, ji gali paslėpti metaduomenis pikseliuose arba pakoreguoti triukšmo dėsningumus taip, kad jie būtų nematomi akiai, bet akivaizdūs kompiuteriui. Šie pikseliai yra tankūs ir suteikia tūkstančius vietų signalui paslėpti.
Tekstas yra kitoks, nes jis yra retas. Sakinyje yra tik tam tikras kiekis žodžių, o kiekvienas žodis turi ribotą skaičių sinonimų, kurie turi prasmę kontekste. Jei DI priverstinai renkasi konkretų žodį, kad išlaikytų vandenženklį, kyla rizika, kad tekstas skambės gremėzdiškai ar pasikartojančiai. „OpenAI“ teigia, kad „textGrain“ nemažina kokybės, tačiau statistinis kompromisas visada egzistuoja. Kad vandenženklis būtų atpažįstamas, DI turi paaukoti dalį savo kūrybinio atsitiktinumo. Štai kodėl aptikimo rodiklis yra dar mažesnis trumpoms žinutėms ar išverstam tekstui. Trijų sakinių el. laiške tiesiog nepakanka duomenų, kad būtų galima paslėpti sudėtingą matematinį pirštų atspaudą.
Kasdieniam vartotojui „textGrain“ atsiradimas turėtų sukelti sveiką skepticizmą. Jei esate mokytojas, redaktorius ar samdymo vadybininkas, negalite pasikliauti šiais detektoriais kaip galutiniu atsakymu. Sistemą per lengva pergudrauti. Vartotojas gali paimti „ChatGPT“ rezultatą, perleisti jį per kitą, vandenženklių neturintį DI greitam perrašymui, ir originalus vandenženklis išnyks.
Galų gale, tai sisteminis pokytis tame, kaip mes vertiname skaitmeninius įrodymus. Mes tolstame nuo pasaulio, kuriame galime pasitikėti tuo, ką matome, ir judame link pasaulio, kuriame mums reikia „rakto“ autentiškumui patvirtinti. „OpenAI“ šiuo metu tą raktą laiko už aksominės virvės, suteikdama prieigą tik ribotam skaičiui tyrėjų ir organizacijų. Šis neskaidrumas sukuria naują galios disbalansą. Bendrovė, kuri kuria turinį, taip pat yra vienintelė, kuri gali jį patikimai atpažinti, ir net tada ji gali tai padaryti tik tuo atveju, jei vartotojas yra tingus.
Praktiškai kalbant, „textGrain“ diegimas ES yra beta testas ateičiai, kurioje visas skaitmeninis darbas bus žymimas. Tai priminimas, kad įrankiai, kuriais naudojamės, vis dažniau priklauso nuo nevidomo tarptautinės teisės stuburo. Nors ES DI aktas siekia apsaugoti piliečius nuo klaidinimo giliosiomis klastotėmis (deepfakes) ir automatizuota propaganda, turimi techniniai įrankiai dar nėra pakankamai atsparūs, kad pasiektų šį tikslą.
Vartotojai turėtų stebėti savo įpročius, kai šios funkcijos bus įdiegtos. Galite pastebėti subtilius „ChatGPT“ atsakymų formuluočių pokyčius, modeliui bandant išlaikyti savo statistinį pirštų atspaudą. Taip pat galite išvysti „DI valymo“ įrankių augimą – paprastų programų, skirtų būtent tam, kad perrašytų tekstą tiek, kiek reikia šiems žymenims pašalinti. Katės ir pelės žaidimas tarp DI laboratorijų ir vartotojų žengia į naują, labiau lokalizuotą etapą.
Eidami į priekį, nustokite ieškoti ženkliuko ar antspaudo su užrašu „Sukurta DI“. Šie žymenys tampa dalimi skaitmeninės „žalios naftos“, kuri maitina mūsų programėles, paslėpti giliai skaitomų sakinių matematikoje. Esmė ta, kad joks vandenženklis negali pakeisti kritinio mąstymo. Nesvarbu, ar pastraipa turi paslėptą statistinį grūdėtumą, ar ne, atsakomybė tikrinti faktus ir ketinimus vis tiek tenka skaitytojui. Skaitmeninis praktikantas dabar žymi savo darbą, tačiau viršininkas vis tiek turi patikrinti, ar darbas atliktas teisingai.
Šaltiniai:



Pašto ir debesies saugojimo sprendimas suteikia galingiausias saugaus keitimosi duomenimis priemones, užtikrinančias jūsų duomenų saugumą ir privatumą.
/ Sukurti nemokamą paskyrą