Dirbtinis intelektas

Ar tikrai patikėsite savo DI praktikantui savo kompiuterio raktus?

„Anthropic“ nuo rugpjūčio 14 d. įjungia numatytąjį automatinį režimą „Claude Code“. Sužinokite, kaip šis autonominio DI pokytis veikia saugumą ir programuotojų produktyvumą.
Ar tikrai patikėsite savo DI praktikantui savo kompiuterio raktus?

Kiek kartų šiandien spustelėjote žymimąjį langelį neperskaitę šalia esančio teksto? Dauguma iš mūsų paslaugų teikimo sąlygas ir leidimų užklausas vertiname kaip skaitmenines muses, kurias reikia nuvyti. Mes norime rezultato, bet turime mažai kantrybės procesui. Būtent dėl šio įpročio „Anthropic“ keičia esminį kūrėjų ir jų DI įrankių santykį. Nuo rugpjūčio 14 d. bendrovė „Claude Code“ vartotojams, turintiems „Pro“, „Max“ ir „Team“ paskyras, pagal numatytuosius nustatymus įjungs automatinį režimą.

Šis pokytis paverčia „Claude Code“ iš įrankio, kuris prašo leidimo, į įrankį, kuris prašo atleidimo. Mėnesių mėnesius vartotojai turėjo patvirtinti kiekvieną DI atliekamą veiksmą – nuo failo skaitymo iki naujos kodo eilutės rašymo. „Anthropic“ dabar tiki, kad DI yra pasirengęs dirbti be nuolatinės priežiūros. Bendrovė tai pristato kaip būdą suderinti greitį ir kontrolę, tačiau tai taip pat atspindi gilesnį supratimą apie tai, kaip žmonės sąveikauja su mašinomis. Kai įrankis per dažnai prašo leidimo, žmogaus smegenys nustoja vertinti riziką ir pradeda veikti refleksiškai.

Leidimų užklausų eros pabaiga

Kai „Anthropic“ kovo mėnesį pirmą kartą pristatė bandomąją automatinio režimo versiją, tai buvo pasirenkama funkcija nuotykių ieškotojams. Ji leido DI sujungti kelias užduotis į grandinę nesustojant ties kiekvienu žingsniu klausti „taip“ arba „ne“. Dabar ši autonomija tampa standartu. Jei esate aukštesnio lygio „Claude“ planų prenumeratorius, jūsų DI asistentas netrukus tęs savo užduotis, nebent nustatys, kad veiksmas yra negrįžtamas arba naikinantis.

Įsivaizduokite „Claude Code“ kaip nenuilstantį praktikantą, sėdintį prie jūsų stalo. Anksčiau šis praktikantas turėjo kas penkias sekundes tapšnoti jums per petį ir klausti, ar gali atidaryti aplanką arba perkelti failą. Dabar praktikantas turi biuro raktus. Jis pažadins jus tik tada, jei ketins sunaikinti pagrindinę sutartį arba išeiti iš pastato. Šiuo pakeitimu siekiama pašalinti kliūtis, kurios lėtina programinės įrangos kūrimą, tačiau kartu sistemai suteikiamas didžiulis pasitikėjimas jos gebėjimu atpažinti savo ribas.

Kodėl žmonės yra silpniausia programinės įrangos saugumo grandis

Vienas iš labiausiai stebinančių duomenų „Anthropic“ pranešime yra susijęs su 1 053 mokamų testuotojų tyrimu. Rezultatai buvo netikėti. „Anthropic“ nustatė, kad automatinis režimas užfiksavo 89 % kenksmingų veiksmų, o žmonės vertintojai – tik 13,6 %. Skaičiai stulbinantys. DI beveik septynis kartus veiksmingiau pastebėjo savo potencialias klaidas ar kenkėjiškas užklausas nei žmonės, kurie turėjo jį prižiūrėti.

Šis neatitikimas atsiranda todėl, kad rankinė peržiūra tampa įpročiu. „Anthropic“ pastebėjo, kad vartotojai patvirtina 97 % leidimų užklausų „Claude Code“ aplinkoje. Kai vartotojas per dieną pamato šimtą užklausų, 101-oji užklausa atrodo kaip formalumas, o ne saugumo patikra. Mes tampame akli detalėms, nes didžiulis informacijos kiekis sukuria mūsų dėmesio kliūtį. Panaikindama šių nuolatinių patvirtinimų poreikį, „Anthropic“ ne tik pagreitina darbą. Ji pripažįsta, kad žmonės dažnai yra mažiausiai patikima saugumo grandinės dalis, kai užduotys yra pasikartojančios ir didelės apimties.

Numatytųjų nustatymų psichologija

Numatytieji nustatymai yra viena galingiausių jėgų technologijų pramonėje. Dauguma vartotojų niekada nekeičia pradinės savo programinės įrangos konfigūracijos, o tai suteikia gamintojui didžiulę įtaką tam, kaip produktas naudojamas. Padarydama automatinį režimą numatytuoju, „Anthropic“ signalizuoja apie pokytį pramonės rizikos tolerancijoje. Borisas Cherny, „Claude Code“ vadovas, platformoje „X“ paminėjo, kad jo komanda mėnesius naudojosi išskirtinai tik automatiniu režimu ir nebegali įsivaizduoti grįžimo prie leidimų užklausų.

Žvelgiant iš rinkos pozicijų, šis žingsnis paverčia „Claude“ efektyvesniu konkurentu kitiems DI kodavimo asistentams. Jei vienam įrankiui užduočiai atlikti reikia keliolikos spustelėjimų, o kitas ją atlieka vienu, rinka beveik visada linksta prie mažiausio pasipriešinimo kelio. Tačiau šis patogumas ateina su sisteminiu atsakomybės pokyčiu. Vartotojas nebėra aktyvus kiekvieno mažo pakeitimo sargas. Vietoj to, vartotojas tampa aukšto lygio vadovu, kuris įsikiša tik tada, kai sistema praneša apie svarbų įvykį.

Skaitmeninių apsaugų kūrimas autonominiam kodui

Siekdama valdyti šios autonomijos rizikas, „Anthropic“ diegia naujus saugumo sluoksnius. Vienas iš tokių sluoksnių yra užklausų injekcijų (angl. prompt injection) patikra. DI pasaulyje užklausos injekcija yra tarsi skaitmeninis rankų miklumas, kai piktavalis bando apgauti DI, kad šis ignoruotų savo pradines instrukcijas. Jei DI rašo kodą remdamasis išoriniais duomenimis, tuose duomenyse gali būti paslėptų komandų, nurodančių DI nutekinti informaciją arba ištrinti failus.

Kitas sluoksnis apima pritaikomas griežto draudimo taisykles. Šios taisyklės veikia kaip skaitmeninė tvora. Net jei DI veikia automatiniu režimu, jis negali peržengti šių ribų. Pavyzdžiui, įmonė galėtų nustatyti taisyklę, neleidžiančią DI siųsti duomenų į išorinį serverį. Tai sprendžia duomenų eksfiltracijos baimę, kuri iš esmės yra slaptas informacijos išnešimas pro galines įmonės saugios aplinkos duris. Šios apsaugos yra pamatinės, nes jos suteikia saugumo tinklą, nepriklausantį nuo žmogaus dėmesio trukmės.

Ką tai reiškia jūsų kasdieniam darbui

Vidutiniam programuotojui ar komandos vadovui perėjimas prie automatinio režimo iš pradžių gali pasirodyti trikdantis. Pastebėsite, kad DI sudėtingas užduotis atlieka per kelias sekundes, o ne minutes. Mažiau laiko praleisite spausdami „Leisti“ ir daugiau laiko skirsite galutinio produkto peržiūrai. Tačiau reikia apsvarstyti praktinį kompromisą. Kadangi DI juda greičiau, klaidą, kurią jis visgi padaro, gali būti sunkiau atsekti per ilgą autonominių veiksmų grandinę.

Praktiškai kalbant, šis pokytis reikalauja, kad vartotojai geriau apibrėžtų aplinką. Jei norite, kad DI liktų tam tikroje „smėlio dėžėje“, turite aiškiai nurodyti tas ribas. Įrankis nebėra tik skaičiuotuvas; tai agentas. Agentui reikia aiškios misijos ir aiškių apribojimų. Jei pateiksite neaiškią instrukciją, autonominis DI gali pasirinkti logišką, bet nepageidaujamą kelią tikslui pasiekti. Esmė ta, kad laiką, kurį sutaupote rankiniams patvirtinimams, reikėtų reinvestuoti į aukštesnio lygio architektūrinę peržiūrą.

Pasiruošimas pokyčiams rugpjūčio 14 d.

Jei turite „Pro“, „Max“ ar „Team“ paskyrą, turėtumėte pasiruošti šiam perėjimui peržiūrėdami savo dabartinius projektus. „Anthropic“ pareiškė, kad DI sustos, jei veiksmas bus pripažintas negrįžtamu, tačiau „negrįžtamumo“ apibrėžimas skirtingose kodavimo aplinkose gali būti subjektyvus. Verta patikrinti, ar jūsų vietinėje aplinkoje veikia atsarginės kopijos arba versijų kontrolės sistemos. Tai suteikia papildomą saugumo tinklą tuo atveju, jei DI priimtų techniškai saugų, bet funkciškai neteisingą sprendimą jūsų specifiniams poreikiams.

Žvelgiant plačiau, šis „Anthropic“ žingsnis yra užuomina apie tai, kaip tikriausiai evoliucionuos visa DI programinė įranga. Mes tolstame nuo įrankių, kurie veikia kaip mūsų rankų pratęsimas, ir judame link įrankių, kurie veikia kaip mūsų ketinimų pratęsimas. Mygtuko „Ar tikrai?“ trintis nyksta. Jo vietoje atsiranda naujos rūšies skaitmeninis pasitikėjimas, pagrįstas statistiniais modeliais, o ne žmogaus priežiūra. Žengiant į šį autonominį etapą, mūsų, kaip žmonių, vertė greičiausiai bus randama ne mygtukų spaudyme, o tikslų kėlime.

Šaltiniai:

  • Oficialus „Anthropic“ pranešimas, 2026 m. rugpjūtis.
  • Boris Cherny, „Claude Code“ vadovas, vieši pareiškimai per X.
  • Vidinis 1 053 mokamų testuotojų saugos tyrimas, „Anthropic Research“.
bg
bg
bg

Iki pasimatymo kitoje pusėje.

Pašto ir debesies saugojimo sprendimas suteikia galingiausias saugaus keitimosi duomenimis priemones, užtikrinančias jūsų duomenų saugumą ir privatumą.

/ Sukurti nemokamą paskyrą