Nors technologijų pasaulis paprastai tikisi, kad naujesni dirbtinio intelekto modeliai bus didesni, efektingesni ir brangesni, „Anthropic“ ką tik nutraukė šį ciklą. Antradienį išleistas „Opus 5.5“ modelis signalizuoja apie pasitraukimą iš tradicinių ginklavimosi varžybų dėl grynosios skaičiavimo galios. Dauguma kūrėjų tikėjosi masyvaus, daug išteklių reikalaujančio liepą išleisto „Opus 5“ modelio įpėdinio. Vietoj to, realybė yra sistema, kuri yra liesesnė, prieinamesnė ir sąmoningai santūresnė. „Anthropic“ lažinasi, kad vartotojai teikia pirmenybę įrankiui, kuris veikia efektyviai, o ne tokiam, kuris tiesiog vejasi kuo didesnius parametrus.
Šis leidimas yra pirmasis svarbus žingsnis po to, kai generalinis direktorius Dario Amodei viešai įsipareigojo „reguliuoti pažangos tempą“. Ši filosofija apima sąmoningą DI galimybių tobulinimo lėtinimą, siekiant užtikrinti, kad saugos protokolai neatsiliktų nuo technologijų. Pramonėje, kurioje greitis dažnai yra vienintelis svarbus rodiklis, „Anthropic“ bando įrodyti, kad branda yra vertingesnė už pagreitį. Vidutiniam vartotojui tai reiškia, kad programinė įranga, kuria jie pasitiki, tampa labiau nuspėjama, net jei jos galimybės auga.
Verslui ir kūrėjams akivaizdžiausias pokytis yra kaina. Skaitmeninis intelektas dažnai matuojamas tokenais (leksemomis), kurie iš esmės yra maži teksto fragmentai. Milijonas tokenų apytiksliai atitinka 750 000 žodžių arba maždaug septynis vidutinės trukmės romanus. Pagal senąją „Opus 5“ kainodarą tokio kiekio teksto generavimas kainavo 25 USD. Su „Opus 5.5“ ši kaina nukrito iki 20 USD. Nors penkių dolerių skirtumas atskirai atrodo nedidelis, jis tampa reikšmingas įmonėms, kurios kasdien apdoroja milijonus dokumentų.
Šis kainos kritimas yra tiesioginis efektyvumo rezultatas. „Anthropic“ pavyko sumažinti skaičiavimo galią, reikalingą modeliui paleisti. Kai modeliui užklausai apdoroti reikia mažiau energijos ir techninės įrangos, teikėjas gali perleisti šį sutaupymą klientui. Dėl to aukščiausios klasės DI tampa labiau prieinamas mažesniems startuoliams, kuriems anksčiau „Opus“ lygis buvo per brangus. Istoriškai pajėgiausi modeliai likdavo išskirtine didžiųjų korporacijų žaidimų aikštele, tačiau dabartinis poslinkis rodo, kad elitinis našumas tampa masinio vartojimo preke.
„Opus 5.5“ lenkia didesnį „Fable“ modelį pagal kelis pagrindinius etalonus, ypač programavimo ir sudėtingo žinių reikalaujančio darbo srityse. Įdomu tai, kad jis tai pasiekia būdamas mažiau linkęs į gėlėtą, žargono kupiną kalbą, kuri vargino ankstesnes versijas. „Anthropic“ pakeitė modelio bendravimo būdą, priversdama jį svarbiausią informaciją pateikti atsakymų pradžioje. Šis pakeitimas sprendžia dažną vartotojų nepasitenkinimą, kai tekdavo skaityti ištisas įžanginio užpildo pastraipas, norint rasti tikrąjį atsakymą į klausimą.
Įsivaizduokite „Opus 5.5“ kaip nepavargstantį praktikantą, kuris pagaliau suprato, kad viršininkas pirmiausia nori esmės. Ankstesni modeliai dažnai bandydavo skambėti protingai, naudodami techninę terminiją ir sudėtingas sakinių struktūras. Naujoji versija teikia pirmenybę aiškumui. Programuotojui, prašančiam ištaisyti klaidą, tai reiškia, kad jis iškart gauna kodo bloką, o ne paskaitą apie programinės įrangos architektūrą. Šis poslinkis link glaustumo sumažina laiką, kurį vartotojai praleidžia filtruodami DI generuojamą triukšmą, o tai yra praktinis laimėjimas produktyvumui.
„Anthropic“ išlaiko trijų lygių sistemą, skirtą skirtingiems poreikiams tenkinti. „Opus“ yra viršūnėje kaip sunkiaatletis sudėtingoms užduotims. „Sonnet“ veikia kaip subalansuotas vidurys, o „Haiku“ pateikia beveik momentinius atsakymus į paprastas užklausas. Veiklos atotrūkis tarp šių lygių keičiasi diegiant 5.5 kartą.
| Modelio lygis | Pagrindinis naudojimo atvejis | Būsena | Kaina (už 1 mln. išvesties tokenų) |
|---|---|---|---|
| Opus 5.5 | Pažangus programavimas, tyrimai, strategija | Prieinama dabar | 20,00 $ |
| Sonnet 5.5 | Kasdienės užduotys, turinio moderavimas | Pasirodys drįz | Bus paskelbta |
| Haiku 5.5 | Pokalbių robotai, duomenų kategorizavimas | Pasirodys drįz | Bus paskelbta |
Tai, kad „Opus 5.5“ sėkmingai atliko neformalias užduotis, kurių didesnis „Fable“ modelis nesugebėjo įveikti, yra svarbus dabartinės rinkos krypties rodiklis. Tai rodo, kad pramonė pasiekia ribą, kai masyvių modelių grąža mažėja. Daugiau duomenų ne visada lemia geresnius rezultatus. Vietoj to, mokymo kokybė ir vidinė modelio architektūros logika tampa pagrindiniais sėkmės veiksniais.
Dario Amodei teigė, kad norint visiškai suvaldyti DI rizikas, reikia daugiau apdairumo. Tokia pozicija yra reta sektoriuje, kurį skatina rizikos kapitalas ir spaudimas greitai išleisti naujas funkcijas. Reguliuodama pažangos tempą, „Anthropic“ bando išvengti scenarijaus, kai DI modelis įgyja gebėjimą aptikti pavojingus biologinius pažeidžiamumus ar kibernetines spragas anksčiau, nei įmonė turės įrankius tokiam elgesiui stebėti. „Opus 5.5“ turi tas pačias saugos priemones kaip ir „Fable“ modelis, konkrečiai ribojančias jo galimybes padėti vartotojams kurti biologinius ginklus arba rasti spragas sukompiliuotose kompiuterių programose.
Šios apsaugos priemonės apima išorinį vertinimą, kurį atlieka tokios organizacijos kaip METR ir „Frontier Design“. Šios grupės veikia kaip skaitmeninė saugos patikros komanda, tikrinanti modelio pavojingas galimybes prieš jam pasiekiant viešumą. Nors kai kurie kritikai teigia, kad šie apribojimai trukdo inovacijoms, „Anthropic“ juos laiko pamatine infrastruktūra. DI tampant vis labiau sistemine šiuolaikinio gyvenimo dalimi, bendrovė teigia, kad viešoji politika ir saugumo stebėsena turi vystytis kartu su kodu.
Jei naudojate DI profesionalioms užduotims, „Opus 5.5“ išleidimas keičia sąnaudų ir naudos analizę renkantis modelį. Anksčiau daugelis vartotojų likdavo prie vidutinio lygio „Sonnet“ modelio, nes „Opus“ kainą buvo sunku pateisinti kasdieniam darbui. 20 % kainos sumažinimas kartu su didesniu apdorojimo greičiu daro aukščiausios klasės lygį perspektyvesniu variantu įprastoms užduotims. Mažiau tikėtina, kad modelis gaišins jūsų laiką nereikalingais paaiškinimais, todėl jis tampa efektyvesniu partneriu techniniams projektams.
Žvelgiant į bendrą vaizdą, šis leidimas rodo, kad DI pramonė žengia į tobulinimo etapą. Pradinis šokas dėl to, ką gali DI, blėsta, o vartotojai dabar reikalauja patikimumo, mažesnių sąnaudų ir geresnių vartotojo sąsajų. Skaitmeninė XXI amžiaus nafta — skaičiavimo galia — naudojama efektyviau, o tai stabilizuoja rinką ir daro technologiją atsparesnę kainų šuoliams.
Vartotojo požiūriu svarbiausia išvada yra ta, kad DI tampa panašesnis į komunalinę paslaugą ir mažiau į laboratorinį eksperimentą. Per ateinančias kelias savaites turėtumėte stebėti, kaip reaguoja jūsų skaitmeniniai įrankiai. Jei pastebėsite, kad jūsų DI asistentas staiga tapo konkretesnis ir mažiau linkęs tuščiažodžiauti, tikėtina, kad matote šio naujo susitelkimo į suderinamumą ir efektyvumą rezultatus. Tikslas nebėra tiesiog sukurti mašiną, kuri galėtų išlaikyti testą, bet sukurti tokią, kuri galėtų palaikyti naudingą, saugų ir prieinamą pokalbį.



Pašto ir debesies saugojimo sprendimas suteikia galingiausias saugaus keitimosi duomenimis priemones, užtikrinančias jūsų duomenų saugumą ir privatumą.
/ Sukurti nemokamą paskyrą