Коротко
- Anthropic випустила Claude Fable 5.1 і Claude Mythos 5.1 1 вересня, набравши 52,6% на Terminal-Bench-Science 0.1 проти 24,7% у Fable 5, і 55,8% на Terminal-Bench 4.0 проти 42,0%.
- Читання кешу тепер коштує на 75% менше, що скорочує типові витрати на робочі навантаження приблизно на 25%, а високоагентні робочі навантаження — до 45%, при цьому базові ціни залишаються незмінними: $10/$50 за мільйон токенів.
- Fable 5.1 не включено в плани Pro або стандартні місця Team, які використовують його за кредитами; Max і преміальні місця Team або Enterprise включають його до 50% тижневих лімітів.
Anthropic випустила Claude Fable 5.1 і Claude Mythos 5.1 у вівторок, це перше оновлення лінійки моделей Mythos-класу з моменту запуску Fable 5 9 червня.
Компанія стверджує, що нові моделі ШІ є «найдосконалішими у світі для кодування та інтелектуальної роботи», і це відбувається через три місяці після початку циклу запуску, який уже включав 18-денне призупинення експортного контролю, цінову війну в середині літа за доступ до підписки та випуск Claude Opus 5 у липні, який підірвав ціну Fable 5.

Fable 5.1 і Mythos 5.1, за словами Anthropic, є однією і тією ж базовою моделлю з різними фільтрами безпеки, доданими зверху. Fable 5.1 загальнодоступна для будь-кого з обліковим записом Claude. Mythos 5.1 залишається обмеженою для перевірених фахівців з кібербезпеки та наук про життя через програми Cyber Verification Program та Life Sciences Verification Program від Anthropic, які є наступниками доступу Project Glasswing, що обмежував Mythos 5.
Що насправді вимірюють бенчмарки
Головна цифра Anthropic походить від Terminal-Bench-Science 0.1, бенчмарку, який перевіряє, чи може AI-агент виконувати завдання наукових досліджень у середовищі командного рядка, оцінюючись як відсоток успішних проходжень.
Fable 5.1 досягла 52,6% проти 24,7% у Fable 5 та 29,0% у Opus 5, що більш ніж удвічі перевищує показник попередника.
Terminal-Bench 4.0 тестує агентне кодування через термінал — написання, запуск і налагодження коду в багатокрокових сесіях командного рядка, оцінюється як відсоток правильно виконаних завдань. Fable 5.1 отримала 55,8%, що вище за 42,0% у Fable 5 і випереджає 52,3% у Opus 5.
Mythos 5.1, що працює з легшими фільтрами кібербезпеки, отримала 60,9% на тому ж тесті; Anthropic каже, що розрив відображає завдання, які її захисні механізми перехопили та перенаправили на Opus 4.8.

На Humanity's Last Exam, мультидисциплінарному тесті на міркування, створеному з експертних питань з десятків академічних галузей та оцінюваному за відсотком правильних відповідей, Fable 5.1 досяг 60.9% без зовнішніх інструментів та 65.0% з ними, обидва показники випереджають Opus 5, що свідчить про те, що це найбільш просунута модель Anthropic для академічних цілей.

Де він перевершує Opus 5, і де математика стає заплутанішою
Opus 5, запущений у липні, коштує вдвічі дешевше за токен, ніж Fable 5, при цьому перевершуючи Fable 5 за більшістю основних бенчмарків, що фактично робить флагманську модель зайвою для більшості платних користувачів.
Fable 5.1 змінює це: тепер він перевершує Opus 5 за кожним бенчмарком, опублікованим Anthropic, включаючи ті, де Opus 5 раніше перевершував Fable 5.
Але Fable 5.1 все ще коштує вдвічі більше за токен, ніж Opus 5 — $10 за вхідний і $50 за вихідний токен проти $5 і $25 у Opus 5. Токени — це базова кількість інформації, яку може обробити модель (зазвичай близько двох третин середнього англійського слова), і компанії платять за використання, оскільки інтенсивні робочі процеси зазвичай дуже швидко вичерпують квоти, встановлені в підписних планах.
Власна презентація Anthropic для цієї моделі робить акцент на рівнях зусиль, а не на сирих балах: компанія стверджує, що запуск Fable 5.1 з низьким або середнім рівнем розумових зусиль відповідає або перевершує старі результати Fable 5 за значно нижчої вартості, залишаючи найвищі рівні зусиль для проблем, які ставлять у глухий кут усе інше.
Для рутинної роботи цей аргумент за повну відмову від Opus 5 стає слабшим, чим нижче встановлено рівень зусиль.
Доступ до моделі відбувається за тим самим принципом, що й до Fable 5 після місяців коригування умов Anthropic. У планах Pro та стандартних місцях Team або Enterprise Fable 5.1 повністю використовує кредити pay-as-you-go, які тарифікуються за ставкою API, оскільки він не входить до тижневих лімітів цих планів. У планах Max та преміальних місцях Team або Enterprise він включений як стандартна частина підписки на строк до 50% тижневого використання.
Claude Fable 5.1 тепер доступний через Claude API, Amazon Bedrock, Google Cloud та Microsoft Foundry під ідентифікатором моделі "claude-fable-5-1".






