Tööstusuudised

Miks OpenAI uus digitaalne vesimärk ei takista teie petmist

OpenAI käivitab EL-is ChatGPT jaoks textGrain vesimärgistuse, et täita uusi seadusi. Lugege, miks sellest peidetud tehnoloogiast on üllatavalt lihtne mööda hiilida.
Miks OpenAI uus digitaalne vesimärk ei takista teie petmist

Kuigi maailm nõuab selgust selles, mis on inimlik ja mis masinlik, käivitas OpenAI äsja tööriista, mis lubab läbipaistvust, kuid pakub midagi palju hapramat. Ettevõte teatas hiljuti, et ChatGPT hakkab nüüd Euroopa Liidu kasutajate jaoks oma tekstiväljundeid vaikimisi vesimärgistama. See muudatus järgib EL-i tehisintellekti määruse (EU AI Act) nõudeid, mis sätestavad, et tehisintellekti loodud sisu peab olema tuvastatav. Kuid tegelikkus kapoti all viitab sellele, et see uus digitaalne pitser sarnaneb vähem püsivale märgistusele ja rohkem kergele pliiatsijoontele, mille laps saaks ühe tõmbega kustutada.

OpenAI kutsub oma uut meetodit nimega textGrain. Lihtsamalt öeldes on see patenteeritud süsteem, mis põimib tehisintellekti valitud sõnadesse statistilisi mustreid. Tavakasutaja jaoks näeb tekst välja identne mis tahes muu vastusega. Grammatika on korrektne, toon on ühtlane ja teave on sama. Kuid spetsiaalse detektortööriista jaoks toimivad need sõnavalikud sõrmejäljena. See süsteem töötab nagu väsimatu praktikant, kellel on kästud memode kirjutamisel kasutada kindlat sünonüümide komplekti. Kui teate mustrit, saate praktikandi tuvastada. Kui te mustrit ei tea, näeb memo välja täiesti tavaline.

Nähtamatute mustrite habras olek

Suurt pilti vaadates sõltub textGraini tõhusus täielikult sellest, kas tekst jääb muutmata kujule. OpenAI enda andmed paljastavad ehmatava haavatavuse, millest enamik korporatiivseid pressiteateid eelistaks vaikides mööda minna. Ideaalsetes tingimustes on tööriista edukuse määr oma kirjutise tuvastamisel 92 protsenti. See kõlab muljetavaldavalt, kuni rakendate vähimalgi määral inimlikku pingutust.

Vaid 10 protsendi genereeritud teksti muutmine põhjustab tuvastamismäära languse peaaegu 30 protsendi võrra. Kui kasutaja vahetab välja 20 protsenti sõnadest — võib-olla muutes mõnda omadussõna või sõnastades ümber paar lauset — langeb edukuse määr peaaegu 75 protsenti. Praktikas tähendab see, et igaüks, kellel on algteadmised sünonüümisõnastikust, saab sellest süsteemist sekunditega mööda minna. See muudab vesimärgi pigem regulaatorite jaoks mõeldud vastavuskontrolli tööriistaks kui usaldusväärseks turvavõrguks avalikkuse jaoks. See täidab EL-i seaduse tähte, lahendamata tegelikult tehisintellekti pettuste laiemat probleemi.

Lugu kahest korporatiivsest strateegiast

Turu poolel on kontrast OpenAI ja selle peamise konkurendi Anthropicu vahel terav. Anthropic tutvustas oma vesimärgistussüsteemi selle aasta alguses, kuid otsustas selle lubada kõigile kasutajatele üle maailma. OpenAI on valinud selektiivsema tee, lülitades funktsiooni vaikimisi sisse ainult seal, kus seadus seda nõuab. Kasutajad Ameerika Ühendriikides, Aasias ja teistes piirkondades saavad endiselt "puhast" väljundit, välja arvatud juhul, kui nad ise või nende organisatsioonid seda API kaudu käsitsi ei aktiveeri.

See regionaalne lõhe loob killustatud digitaalse keskkonna. Berliini üliõpilane saab vaikimisi vesimärgistatud esseesid, samas kui New Yorgi üliõpilane mitte. Tarbija seisukohast viitab see sellele, et OpenAI peab vesimärgistamist pigem ületatavaks regulatiivseks takistuseks kui usaldusväärse toote alusfunktsiooniks. Ettevõte teeb EL-is seaduslikkuse säilitamiseks minimaalse vajaliku, hoides samal ajal oma toodet mujal võimalikult hõõrdevabana.

Funktsioon OpenAI textGrain Anthropic Watermarking
Vaikimisi piirkond Ainult EL Globaalne
Tuvastamismäär 92% (Ideaalne) Kõrge (Patenteeritud)
Tundlikkus muutmisele Kõrge (20% muutus lõhub selle) Mõõdukas kuni kõrge
Juurdepääs Piiratud teadlastele Avalik/API
Standard Patenteeritud Patenteeritud/C2PA

Teksti ja piltide tehniline erinevus

Kapoti all on teksti vesimärgistamine oluliselt keerulisem kui piltide või videote märgistamine. Kui süsteem nagu DALL-E või Midjourney loob pildi, saab see peita metaandmed pikslitesse või kohandada müramustreid viisil, mis jääb silmale nähtamatuks, kuid on arvutile ilmne. Need pikslid on tihedad ja pakuvad tuhandeid kohti signaali peitmiseks.

Tekst on teistsugune, sest see on hõre. Lauses on vaid teatud arv sõnu ja igal sõnal on piiratud arv sünonüüme, mis kontekstis tähendust omavad. Kui tehisintellekt sunnib vesimärgi säilitamiseks tegema konkreetse sõnavaliiku, riskib see teksti kohmakaks või korduvaks muutmisega. OpenAI väidab, et textGrain ei alanda kvaliteeti, kuid statistiline kompromiss on alati olemas. Vesimärgi tuvastatavuse säilitamiseks peab tehisintellekt ohverdama väikese osa oma loomingulisest juhuslikkusest. Seetõttu on tuvastamismäär veelgi madalam lühisõnumite või tõlgitud teksti puhul. Kolmelauselises e-kirjas pole lihtsalt piisavalt andmeid keerulise matemaatilise sõrmejälje peitmiseks.

Mida see tähendab teie digitaalse elu jaoks

Tavakäutaja jaoks tuleks textGraini saabumisse suhtuda terve skeptitsismiga. Kui olete õpetaja, toimetaja või värbamisjuht, ei saa te loota, et need detektorid annavad lõpliku vastuse. Süsteemi on liiga lihtne üle kavaladada. Kasutaja võib võtta ChatGPT väljundi, lasta selle läbi teise, vesimärgistamata tehisintellekti kiireks ümberkirjutamiseks ja algne vesimärk kaob.

Lõppkokkuvõttes on see süsteemne nihe selles, kuidas me vaatame digitaalseid tõendeid. Me liigume eemale maailmast, kus saame usaldada seda, mida näeme, maailma poole, kus vajame ehtsuse kontrollimiseks "võtit". OpenAI hoiab seda võtit praegu sametnööri taga, andes juurdepääsu vaid piiratud arvule teadlastele ja organisatsioonidele. See läbipaistmatus loob uut tüüpi jõudude tasakaalustamatuse. Ettevõte, mis loob sisu, on ka ainus, kes suudab seda usaldusväärselt tuvastada, ja isegi siis saavad nad seda teha vaid juhul, kui kasutaja on laisk.

Navigeerimine vesimärgistatud maailmas

Praktiliselt võttes on textGraini kasutuselevõtt EL-is tuleviku beetatest, kus kogu digitaalne töö on märgistatud. See tuletab meelde, et meie kasutatavad tööriistad alluvad üha enam rahvusvahelise õiguse nähtamatule selgroole. Kuigi EL-i tehisintellekti määruse eesmärk on kaitsta kodanikke süvavõltsingute ja automatiseeritud propaganda poolt eksitamise eest, ei ole kättesaadavad tehnilised vahendid veel piisavalt vastupidavad selle eesmärgi täitmiseks.

Tarbijad peaksid nende funktsioonide lisandumisel jälgima oma harjumusi. Võite märgate peeneid nihkeid selles, kuidas ChatGPT oma vastuseid sõnastab, kui mudel püüab säilitada oma statistilist sõrmejälge. Samuti võite näha "AI-puhastaja" tööriistade kasvu — lihtsad programmid, mis on loodud spetsiaalselt teksti ümberkirjutamiseks just nii palju, et need märgised eemaldada. Kassi-hiire mäng tehisintellekti laborite ja kasutajate vahel on sisenemas uude, lokaliseeritumasse faasi.

Edasi liikudes lõpetage märgi või templi otsimine, mis ütleb "Valmistatud tehisintellekti poolt". Need märgised on muutumas osaks digitaalsest toornaftast, mis toidab meie rakendusi, peidetuna sügavale loetavate lausete matemaatikasse. Oluline on see, et ükski vesimärk ei asenda kriitilist mõtlemist. Olenemata sellest, kas lõigul on peidetud statistiline muster või mitte, jääb vastutus faktide ja kavatsuste kontrollimise eest ikkagi lugejale. Digitaalne praktikant märgistab nüüd oma tööd, kuid ülemuse ülesanne on endiselt kontrollida, kas töö on tegelikult õige.

Allikad:

  • OpenAI Technical Paper on textGrain and Statistical Watermarking
  • European Commission: EU AI Act Regulatory Framework
  • Anthropic Official Blog: Global Deployment of AI Content Marking
  • C2PA (Coalition for Content Provenance and Authenticity) Standard Documentation
bg
bg
bg

Kohtumiseni teisel poolel.

Meie läbivalt krüpteeritud e-posti ja pilvesalvestuse lahendus pakub kõige võimsamaid vahendeid turvaliseks andmevahetuseks, tagades teie andmete turvalisuse ja privaatsuse.

/ Tasuta konto loomin