Kuigi tehnoloogiamaailm eeldab tavaliselt, et uued tehisintellekti mudelid on suuremad, silmapaistvamad ja kallimad, murdis Anthropic just selle tsükli. Teisipäeval avaldatud Opus 5.5 tähistab eemaldumist traditsioonilisest toore arvutusvõimsuse võidurelvastumisest. Enamik arendajaid ootas massiivset ja ressursimahukat järglast juulis välja antud Opus 5 mudelile. Selle asemel on tegelikkuseks süsteem, mis on säästlikum, taskukohasem ja teadlikult vaoshoitum. Anthropic panustab sellele, et kasutajad eelistavad tõhusalt töötavat tööriista sellele, mis lihtsalt jahib võimalikult kõrgeid parameetreid.
See väljalase on esimene suursamm pärast seda, kui tegevjuht Dario Amodei lubas avalikult "piirialasid tempereerida" (pacing the frontier). See filosoofia hõlmab tehisintellekti võimekuse arengu teadlikku aeglustamist, et tagada ohutusprotokollide sammu pidamine tehnoloogiaga. Valdkonnas, kus kiirus on sageli ainus oluline näitaja, püüab Anthropic tõestada, et küpsus on väärtuslikum kui hoog. Tavakasutaja jaoks tähendab see, et tarkvara, millele nad toetuvad, muutub ennustatavamaks isegi siis, kui selle võimekus kasvab.
Ettevõtete ja arendajate jaoks on kõige tuntavam muutus hinnasilt. Digitaalset intelligentsust mõõdetakse sageli tokenites, mis on sisuliselt väikesed tekstiosad. Miljon tokenit on ligikaudu võrdne 750 000 sõnaga ehk umbes seitsme keskmise pikkusega romaaniga. Opus 5 vana hinnakirja alusel maksis sellise tekstihulga genereerimine 25 dollarit. Opus 5.5 puhul on see hind langenud 20 dollarini. Kuigi viiedollarine erinevus tundub eraldiseisvana väike, on see märkimisväärne sääst ettevõtetele, mis töötlevad iga päev miljoneid dokumente.
See hinnalangus on otsene tõhususe tulemus. Anthropic suutis vähendada mudeli käitamiseks vajalikku arvutusvõimsust. Kui mudel nõuab päringu töötlemiseks vähem energiat ja riistvara, saab pakkuja need säästud kliendile edasi anda. See muudab tipptasemel tehisintellekti kättesaadavamaks väiksematele idufirmadele, kes pidasid varem Opus-taset oma eelarve jaoks liiga kalliks. Ajalooliselt jäid kõige võimekamad mudelid suurkorporatsioonide eksklusiivseks mängumaaks, kuid praegune muutus viitab sellele, et eliitsooritus on muutumas laiatarbekaubaks.
Opus 5.5 edestab suuremat Fable mudelit mitmes olulises võrdlustestis, eriti programmeerimises ja keerukas teadmustöös. Huvitaval kombel saavutab see selle, olles samas vähem aldis lillelisele ja žargoonirohkele keelele, mis vaevas eelmisi versioone. Anthropic muutis mudeli suhtlusviisi, sundides seda asetama kõige olulisema teabe vastuste algusesse. See muudatus lahendab levinud probleemi, kus kasutajad pidid oma küsimuse tegeliku vastuse leidmiseks lugema läbi mitu lõiku sissejuhatavat täitematerjali.
Mõelge Opus 5.5-st kui väsimatust praktikandist, kes õppis lõpuks ära, et ülemus soovib kõigepealt kuulda lõpptulemust. Varasemad mudelid püüdsid sageli kõlada targalt, kasutades tehnilist terminoloogiat ja keerulisi lausestruktuure. Uus versioon seab prioriteediks selguse. Veaparandust küsiva programmeerija jaoks tähendab see koodiploki saamist kohe, mitte loengut tarkvaraarhitektuurist. See nihkumine lakoonilisuse poole vähendab aega, mida kasutajad kulutavad tehisintellekti loodud müra filtreerimisele, mis on praktiline võit produktiivsuses.
Anthropic säilitab kolmetasandilise süsteemi erinevate vajaduste rahuldamiseks. Opus asub tipus kui raskekaallane keeruliste ülesannete jaoks. Sonnet toimib tasakaalustatud keskteena, samas kui Haiku pakub peaaegu viivitamatuid vastuseid lihtsatele päringutele. Nende tasemete vaheline soorituslõhe on 5.5 põlvkonna tulekuga muutumas.
| Mudeli tase | Peamine kasutusvaldkond | Staatus | Hind (1 miljoni väljundtokeni kohta) |
|---|---|---|---|
| Opus 5.5 | Edasijõudnud programmeerimine, uurimistöö, strateegia | Saadaval nüüd | $20.00 |
| Sonnet 5.5 | Igapäevased ülesanded, sisu modereerimine | Tulekul | Täpsustamisel |
| Haiku 5.5 | Vestlusrobotid, andmete kategoriseerimine | Tulekul | Täpsustamisel |
Fakt, et Opus 5.5 oli edukas mitteametlikes ülesannetes, milles suurem Fable mudel ebaõnnestus, on oluline näitaja praegusest turutrendist. See viitab sellele, et tööstus on jõudmas massiivsete mudelite puhul kahaneva tootluse punkti. Rohkem andmeid ei pruugi alati viia paremate tulemusteni. Selle asemel on edu peamisteks teguriteks saamas treeningu kvaliteet ja mudeli sisemise arhitektuuri loogika.
Dario Amodei on väitnud, et tehisintellekti riskide täielik käsitlemine nõuab suuremat ettevaatlikkust. See seisukoht on haruldane sektoris, mida kannavad riskikapital ja surve funktsioone kiiresti välja lasta. Piirialade tempereerimisega püüab Anthropic vältida stsenaariumi, kus tehisintellekti mudel omandab võime avastada ohtlikke bioloogilisi haavatavusi või küberründeid enne, kui ettevõttel on tööriistad sellise käitumise jälgimiseks. Opus 5.5-l on samad turvameetmed mis Fable mudelil, piirates konkreetselt selle võimet aidata kasutajatel arendada bioloogilisi relvi või leida haavatavusi kompileeritud arvutiprogrammides.
Need turvameetmed hõlmavad välishindamist organisatsioonidelt nagu METR ja Frontier Design. Need rühmad tegutsevad digitaalse ohutusinspektsioonina, testides mudeli ohtlikke võimekusi enne selle avalikustamist. Kuigi mõned kriitikud väidavad, et need piirangud takistavad innovatsiooni, peab Anthropic neid alustalaks olevaks infrastruktuuriks. Kuna tehisintellekt muutub kaasaegse elu süsteemsemaks osaks, väidab ettevõte, et avalik poliitika ja ohutusjärelevalve peavad arenema koos koodiga.
Kui kasutate tehisintellekti professionaalseteks ülesanneteks, muudab Opus 5.5 väljalaskmine tasuvusanalüüsi selle kohta, millist mudelit kasutada. Varem jäid paljud kasutajad keskmise taseme Sonnet mudeli juurde, sest Opuse hinda oli igapäevatööks raske õigustada. 20-protsendiline hinnalangus koos kiirema töötlemiskiirusega muudab tipptaseme variandi rutiinsete ülesannete jaoks elujõulisemaks valikuks. Mudel raiskab vähem tõenäoliselt teie aega asjatute selgitustega, olles seeläbi tõhusam partner tehnilistes projektides.
Suurt pilti vaadates näitab see väljalase, et tehisintellekti tööstus on sisenemas lihvimise faasi. Esialgne šokk tehisintellekti võimekuse üle on möödumas ning kasutajad nõuavad nüüd usaldusväärsust, madalamaid kulusid ja paremaid kasutajaliideseid. 21. sajandi digitaalset toornaftat – arvutusvõimsust – kasutatakse tõhusamalt, mis stabiliseerib turgu ja muudab tehnoloogia hinnatõusude suhtes vastupidavamaks.
Tarbija seisukohast on kõige olulisem järeldus see, et tehisintellekt on muutumas pigem kommunaalteenuse sarnaseks ja vähem laboratoorseks eksperimendiks. Jälgige järgmiste nädalate jooksul, kuidas teie digitaalsed tööriistad vastavad. Kui märkate, et teie tehisintellekti assistent on äkitselt otsesõnalisem ja vähem aldis heietama, näete tõenäoliselt selle uue, joondumisele ja tõhususele suunatud fookuse tulemusi. Eesmärk ei ole enam lihtsalt ehitada masinat, mis suudab läbida testi, vaid ehitada selline, mis suudab pidada kasulikku, turvalist ja taskukohast vestlust.



Meie läbivalt krüpteeritud e-posti ja pilvesalvestuse lahendus pakub kõige võimsamaid vahendeid turvaliseks andmevahetuseks, tagades teie andmete turvalisuse ja privaatsuse.
/ Tasuta konto loomin