ИИ

Почему новая версия Claude в два раза умнее, но в два раза дороже

Anthropic выпускает Claude Fable 5.1, удваивая производительность в ключевых тестах при сохранении премиальной цены. Узнайте, как это повлияет на ваш бюджет на ИИ.
Почему новая версия Claude в два раза умнее, но в два раза дороже

Большинство людей полагают, что обновление программного обеспечения похоже на обновление телефона, когда вы получаете больше функций за ту же цену. Anthropic только что нарушила этот цикл выпуском Claude Fable 5.1. Хотя эта модель значительно функциональнее своей предшественницы, она занимает странное место на рынке. Ее эксплуатация обходится в два раза дороже, чем модели, выпущенной Anthropic всего два месяца назад, и она требует от пользователей более тщательного обдумывания бюджета, прежде чем нажать кнопку отправки.

В этот вторник Anthropic выпустила Claude Fable 5.1 и ее «родственную» модель Mythos 5.1. Это первое крупное обновление высокопроизводительной линейки Mythos с момента запуска оригинальной Fable 5 в июне. Релиз последовал за хаотичным трехмесячным периодом для компании. За это время Anthropic столкнулась с 18-дневной остановкой работы из-за экспортного контроля и ценовым спором, который заставил многих пользователей гадать, какую модель им на самом деле стоит использовать.

Математика скачка интеллектуальной мощи

Чтобы понять, почему это обновление важно, нужно посмотреть на то, как тестируются эти модели. Anthropic использует тест под названием Terminal-Bench-Science 0.1. Этот бенчмарк измеряет, может ли ИИ-агент выполнять научные исследования внутри компьютерного терминала. По сути, это проверка того, может ли ИИ действовать как неутомимый стажер, который знает, как ориентироваться в лабораторном компьютере без помощи человека.

Fable 5.1 набрала 52,6% в этом тесте. Для сравнения, предыдущая версия, Fable 5, показала результат лишь в 24,7%. Флагманская модель среднего уровня, Opus 5, набрала 29,0%. Проще говоря, новая модель более чем в два раза лучше справляется со сложными научными рассуждениями, чем та, которую она заменила. Такой уровень улучшения за три месяца необычен для индустрии, где прогресс обычно измеряется однозначными числами.

В отдельном тесте на программирование — Terminal-Bench 4.0 — модель показала аналогичный прогресс. Fable 5.1 правильно выполнила 55,8% задач. Это значительный скачок по сравнению с 42,0% у Fable 5, и она уверенно опережает Opus 5 с ее 52,3%. Данные показывают, что для людей, использующих ИИ для написания, запуска и отладки кода, Fable 5.1 теперь является лучшим выбором в линейке Anthropic.

Название модели Балл в научном бенчмарке Балл в бенчмарке по кодингу Цена за вход (за 1 млн токенов) Цена за выход (за 1 млн токенов)
Claude Fable 5.1 52.6% 55.8% $10 $50
Claude Fable 5 24.7% 42.0% $10 $50
Claude Opus 5 29.0% 52.3% $5 $25

Скрытая стоимость рассуждений высокого уровня

Хотя скачок производительности впечатляет, ценообразование создает дилемму для обычного пользователя. В июле Anthropic выпустила Opus 5. Эта модель стала хитом, потому что была лучше старой Fable 5, но стоила ровно в два раза меньше. На несколько недель показалось, что высокоуровневый сегмент «Fable» мертв, так как более дешевая модель была просто лучше.

Fable 5.1 меняет ситуацию, возвращая себе корону производительности, но сохраняет первоначальную высокую цену в 10 долларов за миллион входных токенов и 50 долларов за миллион выходных токенов. Токены — это цифровая «сырая нефть», питающая ИИ. Это небольшие фрагменты данных, которые обрабатывает модель, примерно равные 750 словам. Если вы разработчик, выполняющий тысячи запросов в час, оплата 10 долларов вместо 5 — это разница между прибыльным месяцем и убытком.

Anthropic пытается смягчить этот удар с помощью новой функции под названием «усилия рассуждения» (reasoning effort). Вместо того чтобы запускать модель на полную мощность для каждой задачи, пользователи могут повернуть метафорический регулятор. Компания утверждает, что запуск Fable 5.1 на низком или среднем уровне усилий дает лучшие результаты, чем старая Fable 5, но при меньших затратах. Однако пользователям, которым нужно, чтобы модель решала проблемы, непосильные для других ИИ, придется платить по полной премиальной ставке.

Управление кэшем данных

Есть одна область, где новая модель объективно дешевле для всех. Anthropic сократила стоимость чтения кэша на 75%. В мире архитектуры ИИ кэширование подобно тому, как держать книгу открытой на определенной странице, чтобы не искать ее снова. Если вы просите ИИ проанализировать один и тот же 500-страничный документ десять раз за час, кэширование избавляет ИИ от необходимости перечитывать все целиком каждый раз.

Для типичной работы это снижает затраты примерно на 25%. Для высокоагентных рабочих нагрузок — когда ИИ выполняет десятки последовательных мелких шагов для завершения проекта — экономия достигает 45%. Это делает ценник в 10 долларов более терпимым для продвинутых пользователей, но не меняет того факта, что входная цена за один вопрос остается высокой.

Доступ к новой модели также разделен на уровни, что может расстроить обычных подписчиков. Если у вас есть план Claude Pro или стандартное место в Team, Fable 5.1 не включена в вашу фиксированную ежемесячную плату. Вам придется покупать кредиты на использование отдельно, подобно тому, как работает предоплаченный телефон. Только те, кто пользуется дорогими планами Max или премиальными местами Enterprise, получают модель в рамках своей подписки, и даже тогда она покрывает лишь до 50% их еженедельных лимитов использования.

Почему фильтры имеют значение

Anthropic также выпустила Mythos 5.1 вместе с Fable 5.1. Компания описывает их как одну и ту же базовую модель с разными фильтрами безопасности. Fable 5.1 — это версия, которую использует широкая публика. В ней установлены строгие меры предосторожности, чтобы предотвратить помощь в опасных действиях.

Mythos 5.1 отличается. Она доступна только проверенным специалистам в области кибербезопасности и наук о жизни. Этим экспертам нужно, чтобы ИИ понимал, как работают вирусы или как хакеры взламывают системы, чтобы они могли создавать лучшую защиту. Поскольку у Mythos 5.1 более легкие фильтры, она на самом деле показала более высокие результаты в тестах по программированию — 60,9% по сравнению с 55,8% у Fable 5.1. Этот разрыв существует потому, что стандартные фильтры безопасности иногда ошибочно принимают законные задачи по кодингу за вредоносные и блокируют их выполнение.

Что это значит для вашего рабочего процесса

Если вы используете ИИ для базовых задач, таких как обобщение электронных писем или написание сопроводительных писем, вам, вероятно, стоит игнорировать Fable 5.1. Модель Opus 5 остается более выгодным вариантом для повседневной работы. Она быстрая, дешевая и более чем способна справляться с обычными письменными задачами. Использовать Fable 5.1 для краткого пересказа письма — это все равно что нанимать ученого-ракетчика, чтобы он помог вам с домашним заданием по математике за четвертый класс.

Однако, если вы инженер-программист или исследователь, математика меняется. Способность выполнять задачи научных исследований с вероятностью успеха 52% — это фундаментальное изменение. Это означает, что ИИ превращается из простого генератора текста в функционального агента, способного обрабатывать многоэтапные процессы. Для таких пользователей высокая цена является практичным компромиссом за сэкономленное время.

Глядя на общую картину, Fable 5.1 показывает, что индустрия ИИ разделяется на два пути. Один путь сосредоточен на том, чтобы сделать ИИ как можно более дешевым для масс. Другой путь, который представляет Fable 5.1, раздвигает границы того, что могут делать компьютеры, независимо от стоимости. Как потребитель, вы теперь должны решить, платите ли вы за базовый инструмент или за высокопроизводительный двигатель. Понаблюдайте за своими привычками использования в течение следующей недели. Если вы обнаружите, что просите ИИ выполнить одну и ту же задачу трижды, прежде чем он сделает ее правильно, премиальная цена более умной модели может фактически сэкономить вам деньги в долгосрочной перспективе.

Источники:
Anthropic Official Technical Announcement (September 2026)
Terminal-Bench Science 0.1 Performance Report
Anthropic API Pricing Schedule
Cyber and Life Sciences Verification Program Documentation

bg
bg
bg

До встречи на другой стороне.

Наше решение для электронной почты и облачного хранения данных со сквозным шифрованием обеспечивает наиболее мощные средства безопасного обмена данными, гарантируя их сохранность и конфиденциальность.

/ Создать бесплатный аккаунт