Lielākā daļa cilvēku uzskata, ka programmatūras atjauninājums ir līdzīgs tālruņa atjauninājumam, kur par to pašu cenu tiek iegūts vairāk funkciju. Anthropic tikko pārtrauca šo ciklu, izlaižot Claude Fable 5.1. Lai gan modelis ir ievērojami spējīgāks par tā priekšgājēju, tas tirgū ieņem neparastu vietu. Tā darbināšana izmaksā divreiz dārgāk nekā modelis, ko Anthropic izlaida pirms diviem mēnešiem, un tas liek lietotājiem rūpīgāk pārdomāt savu budžetu, pirms viņi noklikšķina uz iesniegšanas pogas.
Anthropic šo otrdien izlaida Claude Fable 5.1 un tā brāli Mythos 5.1. Šis ir pirmais lielais atjauninājums augstākās klases Mythos līnijai kopš oriģinālā Fable 5 izlaišanas jūnijā. Izlaidums seko haotiskam trīs mēnešu periodam uzņēmumā. Šajā laikā Anthropic saskārās ar 18 dienu eksporta kontroles dīkstāvi un cenu strīdu, kas daudziem lietotājiem lika domāt, kuru modeli viņiem patiesībā vajadzētu izmantot.
Lai saprastu, kāpēc šis atjauninājums ir svarīgs, ir jāskatās, kā šie modeļi tiek testēti. Anthropic izmanto testu ar nosaukumu Terminal-Bench-Science 0.1. Šis etalons mēra, vai mākslīgā intelekta (MI) aģents spēj veikt zinātniskās pētniecības uzdevumus datora terminālī. Tas būtībā ir tests tam, vai MI var darboties kā nenogurdināms praktikants, kurš prot orientēties laboratorijas datorā bez cilvēka palīdzības.
Fable 5.1 šajā testā ieguva 52,6%. Salīdzinājumam, iepriekšējā versija Fable 5 spēja sasniegt tikai 24,7%. Vidējā līmeņa flagmanis Opus 5 ieguva 29,0%. Vienkāršā valodā runājot, jaunais modelis ir vairāk nekā divas reizes labāks sarežģītos zinātniskos spriedumos nekā tas, kuru tas aizstāja. Šāds uzlabojumu līmenis trīs mēnešu laikā ir neparasts nozarei, kur ieguvumi parasti tiek mērīti viencipara skaitļos.
Atsevišķā programmēšanas testā — Terminal-Bench 4.0 — modelis uzrādīja līdzīgu progresu. Fable 5.1 pareizi izpildīja 55,8% uzdevumu. Tas ir ievērojams lēciens no Fable 5 uzrādītajiem 42,0% un pārliecinoši apsteidz Opus 5 ar tā 52,3%. Dati rāda, ka cilvēkiem, kuri izmanto MI, lai rakstītu, palaistu un atkļūdotu kodu, Fable 5.1 tagad ir labākā izvēle Anthropic piedāvājumā.
| Modeļa nosaukums | Zinātnes etalona rezultāts | Programmēšanas etalona rezultāts | Ievades cena (par 1M žetoniem) | Izvades cena (par 1M žetoniem) |
|---|---|---|---|---|
| Claude Fable 5.1 | 52.6% | 55.8% | $10 | $50 |
| Claude Fable 5 | 24.7% | 42.0% | $10 | $50 |
| Claude Opus 5 | 29.0% | 52.3% | $5 | $25 |
Lai gan veiktspējas lēciens ir iespaidīgs, cenu noteikšana rada dilemmu ikdienas lietotājam. Jūlijā Anthropic izlaida Opus 5. Šis modelis kļuva par milzīgu hitu, jo tas bija labāks par veco Fable 5, bet maksāja tieši uz pusi mazāk. Dažas nedēļas šķita, ka augstākās klases "Fable" līmenis ir miris, jo lētākais modelis vienkārši bija labāks.
Fable 5.1 to maina, atgūstot veiktspējas kroni, taču tas saglabā sākotnējo augsto cenu — 10 ASV dolārus par miljonu ievades žetonu un 50 ASV dolārus par miljonu izvades žetonu. Žetoni (tokens) ir digitālā jēlnafta, kas darbina MI. Tie ir mazi datu gabaliņi, ko modelis apstrādā, aptuveni atbilstot 750 vārdiem. Ja esat izstrādātājs, kurš stundā veic tūkstošiem pieprasījumu, maksāt 10 dolārus pretstatā 5 dolāriem ir atšķirība starp peļņu nesošu mēnesi un zaudējumiem.
Anthropic mēģina mīkstināt šo triecienu ar jaunu funkciju, ko sauc par spriešanas piepūli (reasoning effort). Tā vietā, lai darbinātu modeli ar pilnu jaudu katram uzdevumam, lietotāji var pagriezt metaforisku regulatoru. Uzņēmums apgalvo, ka Fable 5.1 darbināšana zemā vai vidējā piepūles līmenī sniedz labākus rezultātus nekā vecais Fable 5, taču par zemākām izmaksām. Tomēr lietotājiem, kuriem modelis nepieciešams tādu problēmu risināšanai, kurām citi MI nespēj pieskarties, būs jāmaksā pilna premium likme.
Ir viena joma, kurā jaunais modelis ir objektīvi lētāks ikvienam. Anthropic ir samazinājis kešatmiņas lasīšanas izmaksas par 75%. MI arhitektūras pasaulē kešdarbe ir kā grāmatas turēšana atvērta noteiktā lapaspusē, lai tā nebūtu jāmeklē vēlreiz. Ja lūdzat MI desmit reizes stundā analizēt vienu un to pašu 500 lappušu garu dokumentu, kešdarbe pasargā MI no visa dokumenta atkārtotas pārlasīšanas katru reizi.
Tipiskam darbam tas samazina izmaksas par aptuveni 25%. Augsti aģentiskām darba slodzēm — kur MI veic desmitiem mazu soļu pēc kārtas, lai pabeigtu projektu — ietaupījums sasniedz pat 45%. Tas padara 10 dolāru cenu pieņemamāku jaudīgajiem lietotājiem, taču tas nemaina faktu, ka sākuma cena par vienu jautājumu joprojām ir augsta.
Piekļuve jaunajam modelim ir arī sadalīta līmeņos, kas varētu sarūgtināt standarta abonentus. Ja jums ir Claude Pro plāns vai standarta Team vieta, Fable 5.1 nav iekļauts jūsu fiksētajā mēneša maksā. Lietošanas kredīti ir jāpērk atsevišķi, līdzīgi kā darbojas priekšapmaksas tālrunis. Tikai tie, kuriem ir dārgie Max plāni vai premium Enterprise vietas, saņem modeli kā daļu no sava abonementa, un pat tad tas sedz tikai līdz 50% no viņu iknedēļas lietošanas limitiem.
Anthropic kopā ar Fable 5.1 izlaida arī Mythos 5.1. Uzņēmums tos raksturo kā vienu un to pašu pamata modeli ar dažādiem drošības filtriem. Fable 5.1 ir versija, ko izmanto plaša sabiedrība. Tam ir stingri drošības pasākumi, lai novērstu tā palīdzību bīstamās darbībās.
Mythos 5.1 ir citāds. Tas ir pieejams tikai pārbaudītiem speciālistiem kiberdrošības un dzīvības zinātņu jomās. Šiem ekspertiem ir nepieciešams, lai MI saprastu, kā darbojas vīrusi vai kā hakeri ielaužas sistēmās, lai viņi varētu izveidot labāku aizsardzību. Tā kā Mythos 5.1 ir vieglāki filtri, tas faktiski uzrādīja augstākus rezultātus programmēšanas testos — 60,9%, salīdzinot ar Fable 5.1 sasniegtajiem 55,8%. Šī atšķirība pastāv, jo standarta drošības filtri dažkārt kļūdaini uzskata leģitīmus programmēšanas uzdevumus par ļaunprātīgiem un neļauj MI tos pabeigt.
Ja izmantojat MI pamata uzdevumiem, piemēram, e-pastu apkopošanai vai motivācijas vēstuļu rakstīšanai, jums, iespējams, vajadzētu ignorēt Fable 5.1. Opus 5 modelis joprojām ir izdevīgāks ikdienas darbam. Tas ir ātrs, lēts un vairāk nekā spējīgs parastiem rakstīšanas uzdevumiem. Fable 5.1 izmantošana e-pasta kopsavilkumam ir kā raķešu zinātnieka nolīgšana, lai palīdzētu ceturtās klases matemātikas mājasdarbos.
Tomēr, ja esat programmatūras inženieris vai pētnieks, matemātika mainās. Spēja izpildīt zinātniskās pētniecības uzdevumus ar 52% panākumu līmeni ir fundamentālas pārmaiņas. Tas nozīmē, ka MI no vienkārša teksta ģeneratora kļūst par funkcionālu aģentu, kas spēj tikt galā ar daudzpakāpju procesiem. Šiem lietotājiem augstā cena ir praktisks kompromiss par ietaupīto laiku.
Raugoties uz kopējo ainu, Fable 5.1 parāda, ka MI nozare sadalās divos ceļos. Viens ceļš ir vērsts uz to, lai padarītu MI pēc iespējas lētāku masām. Otrs ceļš, ko pārstāv Fable 5.1, ir datoru iespēju griestu paaugstināšana neatkarīgi no izmaksām. Kā patērētājam jums tagad ir jāizlemj, vai maksājat par pamata rīku vai augstas veiktspējas dzinēju. Vērojiet savus lietošanas paradumus nākamās nedēļas laikā. Ja konstatējat, ka lūdzat MI veikt vienu un to pašu uzdevumu trīs reizes, pirms tas tiek izdarīts pareizi, viedāka modeļa premium cena ilgtermiņā faktiski varētu ietaupīt jūsu naudu.
Avoti:
Anthropic Official Technical Announcement (September 2026)
Terminal-Bench Science 0.1 Performance Report
Anthropic API Pricing Schedule
Cyber and Life Sciences Verification Program Documentation



Mūsu end-to-end šifrētais e-pasta un mākoņdatu glabāšanas risinājums nodrošina visefektīvākos līdzekļus drošai datu apmaiņai, garantējot jūsu datu drošību un konfidencialitāti.
/ Izveidot bezmaksas kontu