Em resumo
- A Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1 em 1º de setembro, obtendo 52,6% no Terminal-Bench-Science 0.1 contra 24,7% do Fable 5, e 55,8% no Terminal-Bench 4.0 contra 42,0%.
- As leituras de cache agora custam 75% menos, reduzindo os custos típicos de carga de trabalho em cerca de 25% e cargas de trabalho altamente agentivas em até 45%, com o preço base inalterado em US$ 10/US$ 50 por milhão de tokens.
- O Fable 5.1 não está incluído nos planos Pro ou nos assentos padrão do Team, que o executam com créditos de uso; os assentos Max e premium do Team ou Enterprise o incluem por até 50% dos limites semanais.
A Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1 na terça-feira, sua primeira atualização da linha de modelos da classe Mythos desde o lançamento do Fable 5 em 9 de junho.
A empresa afirma que os novos modelos de IA são os “mais avançados do mundo para codificação e trabalho de conhecimento”, e isso chega três meses após um ciclo de lançamento que já incluiu uma paralisação de 18 dias por controles de exportação, uma disputa de preços no meio do verão sobre acesso por assinatura e um lançamento em julho do Claude Opus 5 que prejudicou o Fable 5 no preço.

Fable 5.1 e Mythos 5.1 são, de acordo com a Anthropic, o mesmo modelo subjacente com diferentes filtros de segurança aplicados. O Fable 5.1 está geralmente disponível para qualquer pessoa com uma conta Claude. O Mythos 5.1 permanece restrito a profissionais verificados de segurança cibernética e ciências da vida, por meio do Programa de Verificação Cibernética e do Programa de Verificação de Ciências da Vida da Anthropic, sucessores do caminho de acesso do Projeto Glasswing que limitava o Mythos 5.
O que os benchmarks realmente medem
O número principal da Anthropic vem do Terminal-Bench-Science 0.1, um benchmark que testa se um agente de IA pode realizar tarefas de pesquisa científica em um ambiente de linha de comando, avaliado como uma taxa de aprovação.
O Fable 5.1 atingiu 52,6% contra 24,7% do Fable 5 e 29,0% do Opus 5, mais que o dobro do seu antecessor.
O Terminal-Bench 4.0 testa codificação agêntica feita por meio de um terminal—escrever, executar e depurar código em sessões de linha de comando de várias etapas, avaliado como uma porcentagem de tarefas concluídas corretamente. O Fable 5.1 obteve 55,8%, acima dos 42,0% do Fable 5 e à frente dos 52,3% do Opus 5.
O Mythos 5.1, executado com filtros de segurança cibernética mais leves, obteve 60,9% no mesmo teste; a Anthropic diz que a diferença reflete tarefas que suas salvaguardas interceptaram e redirecionaram para o Opus 4.8.

No Humanity's Last Exam, um teste de raciocínio multidisciplinar construído a partir de perguntas de nível especialista em dezenas de campos acadêmicos e avaliado como taxa de aprovação, o Fable 5.1 alcançou 60,9% sem ferramentas externas e 65,0% com elas, ambos à frente do Opus 5, mostrando que este é o modelo mais avançado da Anthropic para fins acadêmicos.

Onde ele supera o Opus 5, e onde a matemática fica mais obscura
O Opus 5 foi lançado em julho custando metade do preço por token do Fable 5, enquanto superava o Fable 5 na maioria dos principais benchmarks, tornando efetivamente o modelo principal redundante para a maioria dos usuários pagantes.
O Fable 5.1 inverte isso: agora ele supera o Opus 5 em todos os benchmarks que a Anthropic publicou, incluindo aqueles em que o Opus 5 havia anteriormente superado o Fable 5.
Mas o Fable 5.1 ainda custa o dobro por token em comparação ao Opus 5—US$ 10 de entrada e US$ 50 de saída contra US$ 5 e US$ 25 do Opus 5. Tokens são a quantidade básica de informação que um modelo pode processar (geralmente cerca de dois terços de uma palavra média em inglês), e as empresas pagam pelo uso porque fluxos de trabalho pesados geralmente esgotam rapidamente as cotas definidas nos planos de assinatura.
A própria proposta da Anthropic para o modelo se baseia em níveis de esforço em vez de pontuações brutas: ela afirma que executar o Fable 5.1 com esforço de raciocínio baixo ou médio corresponde ou supera os resultados antigos do Fable 5 a um custo muito menor, reservando os níveis de esforço mais altos para problemas que desafiam todo o resto.
Para trabalhos rotineiros, esse argumento para pular o Opus 5 completamente fica mais fraco quanto mais baixo o nível de esforço.
O acesso segue a mesma divisão que se aplicou ao Fable 5 após meses de ajustes de termos pela Anthropic. Nos planos Pro e assentos padrão de Team ou Enterprise, o Fable 5.1 é totalmente retirado de créditos de uso pré-pagos cobrados pela taxa da API, já que não faz parte dos limites semanais desses planos. Nos planos Max e assentos premium de Team ou Enterprise, ele está incluído como parte padrão da assinatura para até 50% do uso semanal.
O Claude Fable 5.1 já está disponível na API Claude, Amazon Bedrock, Google Cloud e Microsoft Foundry, sob o ID do modelo "claude-fable-5-1".






