Τεχνητή Νοημοσύνη

Γιατί η νεότερη έκδοση του Claude είναι δύο φορές πιο έξυπνη αλλά δύο φορές πιο ακριβή

Η Anthropic κυκλοφορεί το Claude Fable 5.1, διπλασιάζοντας την απόδοση σε βασικά σημεία αναφοράς, διατηρώντας παράλληλα την premium τιμολόγηση. Μάθετε πώς αυτό επηρεάζει τον προϋπολογισμό σας για την AI.
Γιατί η νεότερη έκδοση του Claude είναι δύο φορές πιο έξυπνη αλλά δύο φορές πιο ακριβή

Οι περισσότεροι άνθρωποι υποθέτουν ότι μια ενημέρωση λογισμικού είναι σαν μια ενημέρωση τηλεφώνου, όπου λαμβάνετε περισσότερες λειτουργίες στην ίδια τιμή. Η Anthropic μόλις έσπασε αυτόν τον κύκλο με την κυκλοφορία του Claude Fable 5.1. Παρόλο που το μοντέλο είναι πολύ πιο ικανό από τον προκάτοχό του, κατέχει μια περίεργη θέση στην αγορά. Κοστίζει διπλάσια για να λειτουργήσει σε σχέση με το μοντέλο που κυκλοφόρησε η Anthropic μόλις πριν από δύο μήνες και απαιτεί από τους χρήστες να σκεφτούν περισσότερο τον προϋπολογισμό τους πριν κάνουν κλικ στο κουμπί υποβολής.

Η Anthropic κυκλοφόρησε το Claude Fable 5.1 και το αδελφό του μοντέλο Mythos 5.1 αυτή την Τρίτη. Αυτή είναι η πρώτη σημαντική ενημέρωση στην high-end σειρά Mythos από τότε που κυκλοφόρησε το αρχικό Fable 5 τον Ιούνιο. Η κυκλοφορία ακολουθεί μια χαοτική περίοδο τριών μηνών για την εταιρεία. Κατά τη διάρκεια αυτής της περιόδου, η Anthropic αντιμετώπισε μια 18ήμερη διακοπή λειτουργίας λόγω ελέγχων εξαγωγών και μια διαφωνία τιμολόγησης που άφησε πολλούς χρήστες να αναρωτιούνται ποιο μοντέλο θα έπρεπε πραγματικά να χρησιμοποιούν.

Τα μαθηματικά πίσω από το άλμα στην πνευματική ισχύ

Για να καταλάβετε γιατί αυτή η ενημέρωση έχει σημασία, πρέπει να δείτε πώς δοκιμάζονται αυτά τα μοντέλα. Η Anthropic χρησιμοποιεί μια δοκιμή που ονομάζεται Terminal-Bench-Science 0.1. Αυτό το σημείο αναφοράς (benchmark) μετρά εάν ένας πράκτορας AI μπορεί να εκτελέσει επιστημονικές ερευνητικές εργασίες μέσα σε ένα τερματικό υπολογιστή. Είναι ουσιαστικά μια δοκιμασία για το αν η AI μπορεί να λειτουργήσει ως ένας ακούραστος ασκούμενος που ξέρει πώς να πλοηγείται σε έναν εργαστηριακό υπολογιστή χωρίς ανθρώπινη βοήθεια.

Το Fable 5.1 συγκέντρωσε 52,6% σε αυτό το τεστ. Για σύγκριση, η προηγούμενη έκδοση, το Fable 5, πέτυχε μόνο 24,7%. Το κορυφαίο μοντέλο μεσαίας κατηγορίας, το Opus 5, συγκέντρωσε 29,0%. Με απλά λόγια, το νέο μοντέλο είναι περισσότερο από δύο φορές καλύτερο στον σύνθετο επιστημονικό συλλογισμό από εκείνο που αντικατέστησε. Αυτό το επίπεδο βελτίωσης μέσα σε τρεις μήνες είναι ασυνήθιστο για τον κλάδο, όπου τα κέρδη συνήθως μετρώνται σε μονοψήφια νούμερα.

Σε μια ξεχωριστή δοκιμή για προγραμματισμό —το Terminal-Bench 4.0— το μοντέλο έδειξε παρόμοια πρόοδο. Το Fable 5.1 ολοκλήρωσε σωστά το 55,8% των εργασιών. Πρόκειται για ένα σημαντικό άλμα από το 42,0% του Fable 5 και βρίσκεται άνετα μπροστά από το 52,3% του Opus 5. Τα δεδομένα δείχνουν ότι για τους ανθρώπους που χρησιμοποιούν AI για να γράφουν, να εκτελούν και να αποσφαλματώνουν κώδικα, το Fable 5.1 είναι πλέον η κορυφαία επιλογή στη σειρά της Anthropic.

Όνομα Μοντέλου Σκορ Science Benchmark Σκορ Coding Benchmark Τιμή Εισόδου (ανά 1M tokens) Τιμή Εξόδου (ανά 1M tokens)
Claude Fable 5.1 52,6% 55,8% $10 $50
Claude Fable 5 24,7% 42,0% $10 $50
Claude Opus 5 29,0% 52,3% $5 $25

Το κρυφό κόστος του συλλογισμού υψηλού επιπέδου

Ενώ το άλμα στην απόδοση είναι εντυπωσιακό, η τιμολόγηση δημιουργεί ένα δίλημμα για τον καθημερινό χρήστη. Τον Ιούλιο, η Anthropic κυκλοφόρησε το Opus 5. Αυτό το μοντέλο σημείωσε τεράστια επιτυχία επειδή ήταν καλύτερο από το παλιό Fable 5, αλλά κόστιζε ακριβώς τα μισά χρήματα. Για μερικές εβδομάδες, φαινόταν ότι η high-end κατηγορία "Fable" είχε πεθάνει επειδή το φθηνότερο μοντέλο ήταν απλώς καλύτερο.

Το Fable 5.1 το αλλάζει αυτό διεκδικώντας ξανά το στέμμα της απόδοσης, αλλά διατηρεί την αρχική υψηλή τιμή των $10 ανά εκατομμύριο tokens εισόδου και $50 ανά εκατομμύριο tokens εξόδου. Τα tokens είναι το ψηφιακό αργό πετρέλαιο που τροφοδοτεί την AI. Είναι τα μικρά κομμάτια δεδομένων που επεξεργάζεται το μοντέλο, περίπου ίσα με 750 λέξεις. Εάν είστε προγραμματιστής που εκτελεί χιλιάδες αιτήματα την ώρα, η πληρωμή $10 έναντι $5 είναι η διαφορά μεταξύ ενός κερδοφόρου μήνα και μιας ζημίας.

Η Anthropic προσπαθεί να μετριάσει αυτό το πλήγμα με μια νέα λειτουργία που ονομάζεται προσπάθεια συλλογισμού (reasoning effort). Αντί να τρέχουν το μοντέλο σε πλήρη ισχύ για κάθε εργασία, οι χρήστες μπορούν να γυρίσουν έναν μεταφορικό διακόπτη. Η εταιρεία ισχυρίζεται ότι η λειτουργία του Fable 5.1 σε χαμηλό ή μεσαίο επίπεδο προσπάθειας παρέχει καλύτερα αποτελέσματα από το παλιό Fable 5 αλλά με χαμηλότερο κόστος. Ωστόσο, για τους χρήστες που χρειάζονται το μοντέλο για να λύσει προβλήματα που άλλες AI δεν μπορούν να αγγίξουν, θα πρέπει να πληρώσουν την πλήρη premium τιμή.

Διαχείριση της προσωρινής μνήμης δεδομένων (cache)

Υπάρχει ένας τομέας όπου το νέο μοντέλο είναι αντικειμενικά φθηνότερο για όλους. Η Anthropic μείωσε το κόστος των αναγνώσεων της προσωρινής μνήμης (cache reads) κατά 75%. Στον κόσμο της αρχιτεκτονικής AI, το caching είναι σαν να κρατάτε ένα βιβλίο ανοιχτό σε μια συγκεκριμένη σελίδα, ώστε να μην χρειάζεται να το ξαναψάξετε. Εάν ζητήσετε από μια AI να αναλύσει το ίδιο έγγραφο 500 σελίδων δέκα φορές σε μια ώρα, το caching γλιτώνει την AI από το να διαβάζει ξανά το όλο θέμα κάθε φορά.

Για τυπικές εργασίες, αυτό μειώνει το κόστος κατά περίπου 25%. Για φόρτους εργασίας με υψηλή αυτονομία πρακτόρων (agentic workloads)—όπου μια AI εκτελεί δεκάδες μικρά βήματα στη σειρά για να ολοκληρώσει ένα έργο—η εξοικονόμηση φτάνει έως και το 45%. Αυτό κάνει την τιμή των $10 πιο υποφερτή για τους προχωρημένους χρήστες, αλλά δεν αλλάζει το γεγονός ότι η τιμή εισόδου για μια μεμονωμένη ερώτηση παραμένει υψηλή.

Η πρόσβαση στο νέο μοντέλο είναι επίσης κλιμακωτή με τρόπο που μπορεί να απογοητεύσει τους απλούς συνδρομητές. Εάν έχετε ένα πρόγραμμα Claude Pro ή μια τυπική θέση Team, το Fable 5.1 δεν περιλαμβάνεται στη σταθερή μηνιαία συνδρομή σας. Πρέπει να αγοράσετε πιστώσεις χρήσης ξεχωριστά, παρόμοια με τον τρόπο λειτουργίας ενός καρτοκινητού τηλεφώνου. Μόνο όσοι διαθέτουν τα ακριβά προγράμματα Max ή τις premium θέσεις Enterprise έχουν το μοντέλο ενσωματωμένο στη συνδρομή τους, και ακόμη και τότε, καλύπτει μόνο έως και το 50% των εβδομαδιαίων ορίων χρήσης τους.

Γιατί τα φίλτρα έχουν σημασία

Η Anthropic κυκλοφόρησε επίσης το Mythos 5.1 μαζί με το Fable 5.1. Η εταιρεία τα περιγράφει ως το ίδιο υποκείμενο μοντέλο με διαφορετικά φίλτρα ασφαλείας. Το Fable 5.1 είναι η έκδοση που χρησιμοποιεί το ευρύ κοινό. Διαθέτει αυστηρές δικλείδες ασφαλείας για να το εμποδίζουν να βοηθήσει σε επικίνδυνες δραστηριότητες.

Το Mythos 5.1 είναι διαφορετικό. Περιορίζεται σε ελεγμένους επαγγελματίες στον τομέα της κυβερνοασφάλειας και των βιοεπιστημών. Αυτοί οι ειδικοί χρειάζονται την AI για να κατανοήσουν πώς λειτουργούν οι ιοί ή πώς οι χάκερ εισβάλλουν σε συστήματα, ώστε να μπορούν να δημιουργήσουν καλύτερες άμυνες. Επειδή το Mythos 5.1 έχει ελαφρύτερα φίλτρα, στην πραγματικότητα σημείωσε υψηλότερη βαθμολογία στα τεστ κώδικα—60,9% σε σύγκριση με το 55,8% του Fable 5.1. Αυτό το χάσμα υπάρχει επειδή τα τυπικά φίλτρα ασφαλείας μερικές φορές εκλαμβάνουν λανθασμένα νόμιμες εργασίες προγραμματισμού ως κακόβουλες και εμποδίζουν την AI να τις ολοκληρώσει.

Τι σημαίνει αυτό για τη ροή εργασίας σας

Εάν χρησιμοποιείτε AI για βασικές εργασίες, όπως η σύνοψη email ή η σύνταξη συνοδευτικών επιστολών, θα πρέπει πιθανώς να αγνοήσετε το Fable 5.1. Το μοντέλο Opus 5 παραμένει η καλύτερη επιλογή για την καθημερινή εργασία. Είναι γρήγορο, φθηνό και υπεραρκετό για κοινές εργασίες γραφής. Η χρήση του Fable 5.1 για μια σύνοψη email είναι σαν να προσλαμβάνετε έναν επιστήμονα πυραύλων για να σας βοηθήσει με τα μαθηματικά της τετάρτης δημοτικού.

Ωστόσο, εάν είστε μηχανικός λογισμικού ή ερευνητής, τα δεδομένα αλλάζουν. Η ικανότητα ολοκλήρωσης επιστημονικών ερευνητικών εργασιών με ποσοστό επιτυχίας 52% είναι μια θεμελιώδης αλλαγή. Σημαίνει ότι η AI μετακινείται από το να είναι μια απλή γεννήτρια κειμένου σε έναν λειτουργικό πράκτορα που μπορεί να χειριστεί διαδικασίες πολλών βημάτων. Για αυτούς τους χρήστες, η υψηλή τιμή είναι ένας πρακτικός συμβιβασμός για τον χρόνο που εξοικονομούν.

Κοιτάζοντας τη συνολική εικόνα, το Fable 5.1 δείχνει ότι η βιομηχανία AI χωρίζεται σε δύο μονοπάτια. Το ένα μονοπάτι επικεντρώνεται στο να κάνει την AI όσο το δυνατόν φθηνότερη για τις μάζες. Το άλλο μονοπάτι, το οποίο αντιπροσωπεύει το Fable 5.1, ωθεί τα όρια του τι μπορούν να κάνουν οι υπολογιστές, ανεξάρτητα από το κόστος. Ως καταναλωτής, πρέπει τώρα να αποφασίσετε αν πληρώνετε για ένα βασικό εργαλείο ή για μια μηχανή υψηλών επιδόσεων. Παρατηρήστε τις δικές σας συνήθειες χρήσης την επόμενη εβδομάδα. Εάν διαπιστώσετε ότι ζητάτε από την AI να κάνει την ίδια εργασία τρεις φορές πριν την πετύχει σωστά, η premium τιμή ενός εξυπνότερου μοντέλου μπορεί στην πραγματικότητα να σας εξοικονομήσει χρήματα μακροπρόθεσμα.

Πηγές:
Anthropic Official Technical Announcement (September 2026)
Terminal-Bench Science 0.1 Performance Report
Anthropic API Pricing Schedule
Cyber and Life Sciences Verification Program Documentation

bg
bg
bg

Τα λέμε στην άλλη πλευρά.

Η από άκρη σε άκρη κρυπτογραφημένη λύση ηλεκτρονικού ταχυδρομείου και αποθήκευσης στο cloud παρέχει τα πιο ισχυρά μέσα ασφαλούς ανταλλαγής δεδομένων, εξασφαλίζοντας την ασφάλεια και το απόρρητο των δεδομένων σας.

/ Εγγραφείτε δωρεάν