Enamik inimesi eeldab, et tarkvarauuendus on nagu telefoniuuendus, kus sama hinna eest saab rohkem funktsioone. Anthropic murdis selle tsükli Claude Fable 5.1 väljalaskmisega. Kuigi mudel on oma eelkäijast märnatavalt võimekam, asub see turul kummalisel positsioonil. Selle käitamine maksab kaks korda rohkem kui mudelil, mille Anthropic väljastas alles kaks kuud tagasi, ning see nõuab kasutajatelt enne nupule vajutamist oma eelarve põhjalikumat läbimõtlemist.
Anthropic väljastas sel teisipäeval Claude Fable 5.1 ja selle sõsarmudeli Mythos 5.1. See on esimene suurem uuendus tipptasemel Mythos-sarjale pärast algse Fable 5 käivitamist juunis. Väljalase järgneb ettevõtte jaoks kaootilisele kolmekuulisele perioodile. Selle aja jooksul seisis Anthropic silmitsi 18-päevase ekspordikontrollist tingitud seisakuga ja hinnavaidlusega, mis jättis paljud kasutajad mõtlema, millist mudelit nad tegelikult kasutama peaksid.
Mõistmaks, miks see uuendus oluline on, tuleb vaadata, kuidas neid mudeleid testitakse. Anthropic kasutab testi nimega Terminal-Bench-Science 0.1. See etalon mõõdab, kas tehisintellekti agent suudab teha teaduslikke uurimistöid arvutiterminalis. See on sisuliselt test selle kohta, kas tehisintellekt suudab tegutseda väsimatu praktikandina, kes oskab laboriarvutis ilma inimese abita navigeerida.
Fable 5.1 saavutas selles testis tulemuseks 52,6%. Võrdluseks, eelmine versioon Fable 5 suutis vaid 24,7%. Keskklassi lipulaevmudel Opus 5 saavutas 29,0%. Lihtsas keeles öeldes on uus mudel keerulises teaduslikus päättlemises rohkem kui kaks korda parem kui mudel, mille see asendas. Selline arengutase kolme kuu jooksul on ebatavaline tööstusharus, kus edusamme mõõdetakse tavaliselt ühekohaliste numbritega.
Eraldiseisvas programmeerimistestis – Terminal-Bench 4.0 – näitas mudel sarnast progressi. Fable 5.1 sooritas 55,8% ülesannetest õigesti. See on märkimisväärne hüpe võrreldes Fable 5 tulemusega 42,0% ja edestab mugavalt Opus 5 tulemust 52,3%. Andmed näitavad, et inimeste jaoks, kes kasutavad tehisintellekti koodi kirjutamiseks, käitamiseks ja silumiseks, on Fable 5.1 nüüd Anthropicu tootevalikus parim valik.
| Mudeli nimi | Teadustesti tulemus | Kodeerimistesti tulemus | Sisendi hind (1 mln märgi kohta) | Väljundi hind (1 mln märgi kohta) |
|---|---|---|---|---|
| Claude Fable 5.1 | 52,6% | 55,8% | $10 | $50 |
| Claude Fable 5 | 24,7% | 42,0% | $10 | $50 |
| Claude Opus 5 | 29,0% | 52,3% | $5 | $25 |
Kuigi jõudluse hüpe on muljetavaldav, tekitab hinnastus tavakasutajale dilemma. Juulis väljastas Anthropic mudeli Opus 5. See mudel oli tohutu hitt, sest see oli parem kui vana Fable 5, kuid maksis täpselt poole vähem. Mõneks nädalaks tundus, et tipptasemel "Fable" tase on surnud, sest odavam mudel oli lihtsalt parem.
Fable 5.1 muudab seda, võttes tagasi jõudluse krooni, kuid säilitab algse kõrge hinna: 10 dollarit miljoni sisendmärgi ja 50 dollarit miljoni väljundmärgi kohta. Märgid (tokenid) on digitaalne toornafta, mis toidab tehisintellekti. Need on väikesed andmetükid, mida mudel töötleb, umbes 750 sõna väärtuses. Kui olete arendaja, kes teeb tuhandeid päringuid tunnis, on 10 dollari ja 5 dollari maksmise vahe kasumliku kuu ja kahjumi vahel.
Anthropic püüab seda lööki pehmendada uue funktsiooniga nimega "reasoning effort" (päättlemise pingutus). Selle asemel, et käitada mudelit iga ülesande puhul täisvõimsusel, saavad kasutajad keerata metafoorset nuppu. Ettevõte väidab, et Fable 5.1 käitamine madala või keskmise pingutusega annab paremaid tulemusi kui vana Fable 5, kuid madalama hinnaga. Kasutajad, kes vajavad mudelit probleemide lahendamiseks, mida teised tehisintellektid ei puuduta, peavad aga maksma täielikku premium-määra.
On üks valdkond, kus uus mudel on objektiivselt kõigi jaoks odavam. Anthropic on vähendanud vahemälu lugemise kulusid 75%. Tehisintellekti arhitektuuri maailmas on vahemällu salvestamine (caching) nagu raamatu avatuna hoidmine konkreetsel leheküljel, et te ei peaks seda uuesti otsima. Kui palute tehisintellektil analüüsida sama 500-leheküljelist dokumenti kümme korda tunnis, säästab vahemälu tehisintellekti iga kord kõige uuesti lugemisest.
Tüüpilise töö puhul vähendab see kulusid umbes 25%. Väga agentiliste töövoogude puhul – kus tehisintellekt sooritab projekti lõpetamiseks kümneid väikeseid samme järjest – ulatub sääst kuni 45%-ni. See muudab 10-dollarise hinnasildi edasijõudnud kasutajatele talutavamaks, kuid see ei muuda asjaolu, et ühe küsimuse alghind jääb kõrgeks.
Juurdepääs uuele mudelile on samuti astmeline viisil, mis võib tavatellijaid ärritada. Kui teil on Claude Pro pakett või tavaline Team-kasutaja koht, ei kuulu Fable 5.1 teie fikseeritud kuutasu sisse. Peate ostma kasutusliidid eraldi, sarnaselt ettemaksuga kõnekaardile. Ainult kallite Max-pakettide või premium-taseme Enterprise-kohtade omanikud saavad mudeli oma tellimuse osana, ja isegi siis katab see vaid kuni 50% nende iganädalasest kasutuslimiidist.
Anthropic väljastas koos Fable 5.1-ga ka Mythos 5.1. Ettevõte kirjeldab neid kui sama alusmudelit, millel on erinevad turvafiltrid. Fable 5.1 on versioon, mida kasutab laiem avalikkus. Sellel on ranged kaitsemeetmed, et vältida abi osutamist ohtlikes tegevustes.
Mythos 5.1 on teistsugune. See on piiratud kontrollitud küberjulgeoleku ja bioteaduste professionaalidele. Need eksperdid vajavad tehisintellekti, et mõista, kuidas viirused töötavad või kuidas häkkerid süsteemidesse sisse murravad, et nad saaksid luua paremaid kaitsemehhanisme. Kuna Mythos 5.1-l on leebemad filtrid, saavutas see kodeerimistestides tegelikult kõrgema tulemuse – 60,9% võrreldes Fable 5.1 55,8%-ga. See lõhe on tingitud sellest, et standardsed turvafiltrid peavad mõnikord legitiimseid kodeerimisülesandeid pahatahtlikeks ja takistavad tehisintellektil neid lõpetamast.
Kui kasutate tehisintellekti põhiülesanneteks, nagu e-kirjade kokkuvõtete tegemine või kaaskirjade kirjutamine, peaksite tõenäoliselt Fable 5.1 ignoreerima. Opus 5 mudel jääb igapäevatööks parema väärtusega valikuks. See on kiire, odav ja enam kui võimekas tavaliste kirjutamisülesannete jaoks. Fable 5.1 kasutamine e-kirja kokkuvõtteks on nagu raketiteadlase palkamine neljanda klassi matemaatika kodutööde lahendamiseks.
Kui olete aga tarkvarainsener või teadlane, siis matemaatika muutub. Võime sooritada teaduslikke uurimistöid 52%-lise edukusega on fundamentaalne muutus. See tähendab, et tehisintellekt liigub lihtsast tekstigeneraatorist funktsionaalseks agendiks, mis suudab hallata mitmeetapilisi protsesse. Nende kasutajate jaoks on kõrge hind praktiline kompromiss säästetud aja eest.
Suurt pilti vaadates näitab Fable 5.1, et tehisintellekti tööstus on jagunemas kaheks teeks. Üks tee on keskendunud tehisintellekti võimalikult odavaks muutmisele massidele. Teine tee, mida esindab Fable 5.1, nihutab arvutite võimekuse piire, olenemata kuludest. Tarbijana peate nüüd otsustama, kas maksate põhitööriista või suure jõudlusega mootori eest. Jälgige oma kasutusharjumusi järgmise nädala jooksul. Kui leiate end palumas tehisintellektil sama ülesannet kolm korda teha, enne kui see õigesti õnnestub, võib targema mudeli premium-hind teile pikas perspektiivis tegelikult raha säästa.
Allikad:
Anthropic Official Technical Announcement (September 2026)
Terminal-Bench Science 0.1 Performance Report
Anthropic API Pricing Schedule
Cyber and Life Sciences Verification Program Documentation



Meie läbivalt krüpteeritud e-posti ja pilvesalvestuse lahendus pakub kõige võimsamaid vahendeid turvaliseks andmevahetuseks, tagades teie andmete turvalisuse ja privaatsuse.
/ Tasuta konto loomin