Intelligence Artificielle

Pourquoi la nouvelle version de Claude est deux fois plus intelligente mais deux fois plus chère

Anthropic lance Claude Fable 5.1, doublant les performances sur les principaux benchmarks tout en maintenant une tarification premium. Découvrez l'impact sur votre budget IA.
Pourquoi la nouvelle version de Claude est deux fois plus intelligente mais deux fois plus chère

La plupart des gens supposent qu'une mise à jour logicielle est comme une mise à jour de téléphone où l'on obtient plus de fonctionnalités pour le même prix. Anthropic vient de rompre ce cycle avec la sortie de Claude Fable 5.1. Bien que le modèle soit nettement plus performant que son prédécesseur, il occupe une place étrange sur le marché. Son exploitation coûte deux fois plus cher que le modèle qu'Anthropic a sorti il y a seulement deux mois, et il oblige les utilisateurs à réfléchir davantage à leur budget avant de cliquer sur le bouton d'envoi.

Anthropic a publié Claude Fable 5.1 et son frère Mythos 5.1 ce mardi. Il s'agit de la première mise à jour majeure de la gamme haut de gamme Mythos depuis le lancement du Fable 5 original en juin. Cette sortie fait suite à une période chaotique de trois mois pour l'entreprise. Durant cette période, Anthropic a dû faire face à un arrêt de 18 jours dû au contrôle des exportations et à un litige sur les prix qui a laissé de nombreux utilisateurs se demander quel modèle ils devraient réellement utiliser.

Les mathématiques derrière le bond de puissance intellectuelle

Pour comprendre pourquoi cette mise à jour est importante, il faut examiner comment ces modèles sont testés. Anthropic utilise un test appelé Terminal-Bench-Science 0.1. Ce benchmark mesure si un agent d'IA peut effectuer des tâches de recherche scientifique à l'intérieur d'un terminal informatique. Il s'agit essentiellement d'un test visant à déterminer si l'IA peut agir comme un stagiaire infatigable capable de naviguer sur un ordinateur de laboratoire sans aide humaine.

Fable 5.1 a obtenu un score de 52,6 % à ce test. À titre de comparaison, la version précédente, Fable 5, n'avait obtenu que 24,7 %. Le modèle phare de milieu de gamme, Opus 5, a obtenu 29,0 %. En clair, le nouveau modèle est plus de deux fois plus performant en raisonnement scientifique complexe que celui qu'il remplace. Ce niveau d'amélioration en trois mois est inhabituel pour l'industrie, où les gains se mesurent généralement en chiffres simples.

Sur un test distinct pour le codage — Terminal-Bench 4.0 — le modèle a montré des progrès similaires. Fable 5.1 a accompli 55,8 % des tâches correctement. C'est un bond significatif par rapport aux 42,0 % de Fable 5 et cela le place confortablement devant les 52,3 % d'Opus 5. Les données montrent que pour les personnes qui utilisent l'IA pour écrire, exécuter et déboguer du code, Fable 5.1 est désormais le premier choix dans la gamme d'Anthropic.

Nom du modèle Score au benchmark scientifique Score au benchmark de codage Prix d'entrée (par 1M de tokens) Prix de sortie (par 1M de tokens)
Claude Fable 5.1 52,6 % 55,8 % 10 $ 50 $
Claude Fable 5 24,7 % 42,0 % 10 $ 50 $
Claude Opus 5 29,0 % 52,3 % 5 $ 25 $

Le coût caché du raisonnement de haut niveau

Bien que le bond de performance soit impressionnant, la tarification crée un dilemme pour l'utilisateur quotidien. En juillet, Anthropic a sorti Opus 5. Ce modèle a été un succès massif car il était meilleur que l'ancien Fable 5 mais coûtait exactement deux fois moins cher. Pendant quelques semaines, il semblait que le niveau haut de gamme « Fable » était mort parce que le modèle moins cher était tout simplement meilleur.

Fable 5.1 change la donne en récupérant la couronne de la performance, mais il conserve le prix élevé d'origine de 10 $ par million de tokens d'entrée et 50 $ par million de tokens de sortie. Les tokens sont le pétrole brut numérique qui alimente l'IA. Ce sont les petits morceaux de données que le modèle traite, équivalant environ à 750 mots. Si vous êtes un développeur exécutant des milliers de requêtes par heure, payer 10 $ contre 5 $ représente la différence entre un mois rentable et une perte.

Anthropic tente d'atténuer ce choc avec une nouvelle fonctionnalité appelée « effort de raisonnement ». Au lieu de faire fonctionner le modèle à pleine puissance pour chaque tâche, les utilisateurs peuvent tourner un cadran métaphorique. L'entreprise affirme que l'exécution de Fable 5.1 à un niveau d'effort faible ou moyen fournit de meilleurs résultats que l'ancien Fable 5, mais à un coût moindre. Cependant, pour les utilisateurs qui ont besoin que le modèle résolve des problèmes que d'autres IA ne peuvent pas toucher, ils devront payer le plein tarif premium.

Gestion du cache de données

Il existe un domaine où le nouveau modèle est objectivement moins cher pour tout le monde. Anthropic a réduit le coût des lectures de cache de 75 %. Dans le monde de l'architecture de l'IA, la mise en cache revient à garder un livre ouvert à une page spécifique pour ne pas avoir à la chercher à nouveau. Si vous demandez à une IA d'analyser le même document de 500 pages dix fois en une heure, la mise en cache évite à l'IA de tout relire à chaque fois.

Pour un travail typique, cela réduit les coûts d'environ 25 %. Pour les charges de travail hautement agentiques — où une IA effectue des dizaines de petites étapes consécutives pour terminer un projet — les économies atteignent jusqu'à 45 %. Cela rend le prix de 10 $ plus supportable pour les utilisateurs intensifs, mais cela ne change pas le fait que le prix d'entrée pour une seule question reste élevé.

L'accès au nouveau modèle est également échelonné d'une manière qui pourrait frustrer les abonnés standards. Si vous avez un forfait Claude Pro ou un siège Team standard, Fable 5.1 n'est pas inclus dans votre forfait mensuel fixe. Vous devez acheter des crédits d'utilisation séparément, à l'instar d'un téléphone prépayé. Seuls ceux qui possèdent les forfaits Max coûteux ou les sièges Enterprise premium bénéficient du modèle inclus dans leur abonnement, et même dans ce cas, il ne couvre que jusqu'à 50 % de leurs limites d'utilisation hebdomadaires.

Pourquoi les filtres comptent

Anthropic a également publié Mythos 5.1 aux côtés de Fable 5.1. L'entreprise les décrit comme étant le même modèle sous-jacent avec des filtres de sécurité différents. Fable 5.1 est la version utilisée par le grand public. Elle dispose de garde-fous stricts pour l'empêcher d'aider à des activités dangereuses.

Mythos 5.1 est différent. Il est réservé aux professionnels agréés de la cybersécurité et des sciences de la vie. Ces experts ont besoin que l'IA comprenne comment les virus fonctionnent ou comment les pirates s'introduisent dans les systèmes afin de pouvoir construire de meilleures défenses. Parce que Mythos 5.1 a des filtres plus légers, il a en fait obtenu des scores plus élevés aux tests de codage — 60,9 % contre 55,8 % pour Fable 5.1. Cet écart existe parce que les filtres de sécurité standard confondent parfois des tâches de codage légitimes avec des tâches malveillantes et empêchent l'IA de les terminer.

Ce que cela signifie pour votre flux de travail

Si vous utilisez l'IA pour des tâches de base comme résumer des e-mails ou rédiger des lettres de motivation, vous devriez probablement ignorer Fable 5.1. Le modèle Opus 5 reste le meilleur rapport qualité-prix pour le travail quotidien. Il est rapide, bon marché et plus que capable pour les tâches d'écriture courantes. Utiliser Fable 5.1 pour un résumé d'e-mail, c'est comme embaucher un scientifique de la NASA pour vous aider avec vos devoirs de mathématiques de CM1.

Cependant, si vous êtes ingénieur logiciel ou chercheur, le calcul change. La capacité à accomplir des tâches de recherche scientifique avec un taux de réussite de 52 % est un changement fondamental. Cela signifie que l'IA passe du statut de simple générateur de texte à celui d'agent fonctionnel capable de gérer des processus en plusieurs étapes. Pour ces utilisateurs, le prix élevé est un compromis pratique pour le temps qu'ils gagnent.

En regardant la situation dans son ensemble, Fable 5.1 montre que l'industrie de l'IA se divise en deux voies. Une voie se concentre sur la fabrication d'une IA aussi bon marché que possible pour les masses. L'autre voie, que représente Fable 5.1, repousse les limites de ce que les ordinateurs peuvent faire, quel qu'en soit le coût. En tant que consommateur, vous devez maintenant décider si vous payez pour un outil de base ou pour un moteur de haute performance. Observez vos propres habitudes d'utilisation au cours de la semaine prochaine. Si vous vous surprenez à demander à l'IA de faire la même tâche trois fois avant qu'elle ne réussisse, le prix premium d'un modèle plus intelligent pourrait en fait vous faire économiser de l'argent à long terme.

Sources :
Anthropic Official Technical Announcement (September 2026)
Terminal-Bench Science 0.1 Performance Report
Anthropic API Pricing Schedule
Cyber and Life Sciences Verification Program Documentation

bg
bg
bg

On se retrouve de l'autre côté.

Notre solution de messagerie cryptée de bout en bout et de stockage en nuage constitue le moyen le plus puissant d'échanger des données en toute sécurité, garantissant ainsi la sûreté et la confidentialité de vos données.

/ Créer un compte gratuit