Кратко
- Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1 1 сентября, набрав 52,6% в Terminal-Bench-Science 0.1 против 24,7% у Fable 5, и 55,8% в Terminal-Bench 4.0 против 42,0%.
- Чтение кэша теперь стоит на 75% дешевле, что снижает типичные затраты на рабочие нагрузки примерно на 25%, а высокоагентные рабочие нагрузки — до 45%, при этом базовые цены остаются неизменными: 10/50 долларов за миллион токенов.
- Fable 5.1 не включен в планы Pro или стандартные места Team, которые используют его за кредиты; в Max и премиальных местах Team или Enterprise он включен до 50% недельных лимитов.
Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1 во вторник, это первое обновление линейки моделей класса Mythos с момента запуска Fable 5 9 июня.
Компания утверждает, что новые модели ИИ являются «самыми передовыми в мире для программирования и интеллектуальной работы», и это происходит через три месяца после начала цикла запуска, который уже включал 18-дневную приостановку экспортного контроля, летнюю ценовую борьбу за подписку и выпуск Claude Opus 5 в июле, который подорвал Fable 5 по цене.

Fable 5.1 и Mythos 5.1, по словам Anthropic, представляют собой одну и ту же базовую модель с разными предохранительными фильтрами. Fable 5.1 доступна всем, у кого есть аккаунт Claude. Mythos 5.1 остается ограниченной для проверенных специалистов по кибербезопасности и биологическим наукам через программу проверки кибербезопасности и программу проверки биологических наук Anthropic, которые являются преемниками траектории доступа Project Glasswing, ограничивавшей Mythos 5.
Что на самом деле измеряют бенчмарки
Главный показатель Anthropic получен из Terminal-Bench-Science 0.1, бенчмарка, который проверяет, может ли ИИ-агент выполнять задачи научных исследований в среде командной строки, и оценивается как процент успешных прохождений.
Fable 5.1 достигла 52,6% против 24,7% у Fable 5 и 29,0% у Opus 5, что более чем вдвое превышает показатель предшественника.
Terminal-Bench 4.0 проверяет агентное программирование через терминал — написание, запуск и отладку кода в многошаговых сеансах командной строки, оценивается как процент правильно выполненных задач. Fable 5.1 набрала 55,8%, что выше 42,0% у Fable 5 и опережает 52,3% у Opus 5.
Mythos 5.1, работающая с более легкими фильтрами кибербезопасности, набрала 60,9% на том же тесте; Anthropic объясняет разницу тем, что ее предохранительные механизмы перехватывали и перенаправляли задачи на Opus 4.8.

На Humanity's Last Exam, мультидисциплинарном тесте на рассуждение, составленном из вопросов экспертного уровня по десяткам академических областей и оцениваемом по проценту правильных ответов, Fable 5.1 достиг 60,9% без внешних инструментов и 65,0% с ними, обойдя Opus 5 в обоих случаях, что показывает, что это самая продвинутая модель Anthropic для академических целей.

Где он превосходит Opus 5, и где математика становится более туманной
Opus 5, запущенный в июле, стоил вдвое дешевле за токен, чем Fable 5, при этом превосходя Fable 5 по большинству основных бенчмарков, что фактически сделало флагманскую модель избыточной для большинства платящих пользователей.
Fable 5.1 меняет это: теперь она превосходит Opus 5 по всем бенчмаркам, опубликованным Anthropic, включая те, где Opus 5 ранее побеждал Fable 5.
Но Fable 5.1 по-прежнему стоит вдвое дороже за токен, чем Opus 5: 10 долларов за ввод и 50 долларов за вывод против 5 и 25 долларов у Opus 5. Токены — это базовое количество информации, которое модель может обработать (обычно около двух третей среднего английского слова), и компании платят за использование, потому что интенсивные рабочие процессы обычно быстро исчерпывают квоты, установленные в подписочных планах.
Собственное предложение Anthropic для этой модели опирается на уровни усилий, а не на сырые баллы: компания утверждает, что запуск Fable 5.1 с низким или средним уровнем рассуждений соответствует или превосходит прежние результаты Fable 5 при гораздо более низкой стоимости, оставляя высшие уровни усилий для задач, которые ставят в тупик всё остальное.
Для рутинной работы этот аргумент в пользу полного отказа от Opus 5 становится слабее, чем ниже установлен уровень усилий.
Доступ следует тому же разделению, которое применялось к Fable 5 после месяцев корректировки условий Anthropic. На планах Pro и стандартных местах Team или Enterprise Fable 5.1 полностью расходует кредиты оплаты по мере использования, выставляемые по тарифу API, поскольку она не входит в еженедельные лимиты этих планов. На планах Max и премиальных местах Team или Enterprise она включена как стандартная часть подписки на до 50% еженедельного использования.
Claude Fable 5.1 теперь доступна в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry под идентификатором модели "claude-fable-5-1".






