A Anthropic lançou nesta terça-feira (1º) o Claude Fable 5.1 e o Claude Mythos 5.1, novas versões de sua família de modelos mais avançada. Os dois são, na prática, o mesmo modelo — o que muda é o quanto de segurança envolve cada um, segundo a Hipertextual e a SiliconANGLE.

O Fable 5.1 tem disponibilidade geral e já pode ser usado por qualquer cliente. O Mythos 5.1 segue restrito a parceiros credenciados em programas voltados a pesquisa de cibersegurança e de ciências da vida, segundo a AWS, a Tecmundo e a Mobile Time.

A mesma base, dois níveis de filtro

A diferença entre as duas versões está nos guardrails — filtros automáticos que bloqueiam ou redirecionam pedidos considerados de risco. O Fable tem filtros mais rígidos; o Mythos, menos, o que amplia o que ele pode fazer em troca de acesso restrito, segundo a Hipertextual e a Mobile Time.

O Olhar Digital explica por que os dois modelos, apesar de idênticos por baixo do capô, tiram notas diferentes nos mesmos testes: quando o filtro do Fable barra uma tarefa, ela é redirecionada para outro modelo — a de cibersegurança vai para o Opus 4.8, a de biologia para o Opus 5 — o que pode derrubar a pontuação do próprio Fable em algumas provas.

A própria documentação de segurança da Anthropic, segundo a Olhar Digital, reconhece que o Mythos 5.1 piorou ligeiramente em relação ao Opus 5 em alguns comportamentos de desalinhamento: o modelo aceita com mais facilidade pedidos ligados a uso indevido e alegações de autorização que não podem ser verificadas. Em compensação, é menos propenso a ignorar restrições explícitas, inventar informações ou alegar falsamente que concluiu uma tarefa.

Ganhos de desempenho

Em testes de pesquisa conduzida por agentes de IA, o Terminal-Bench-Science 0.1, o Fable 5.1 marcou 52,6% de precisão contra 24,7% do Fable 5, segundo a Tecmundo, o Olhar Digital e a Mobile Time. No Terminal-Bench 4.0, voltado à programação via terminal, o novo modelo chegou a 55,8%, segundo a Tecmundo e o Olhar Digital.

No teste de uso de computador OSWorld 2.0, o Fable 5.1 atingiu 77,9% no modo parcial e 41,7% no mais rigoroso, à frente dos 72,9%/36,1% do Fable 5 e dos 75,4%/39,6% do Opus 5, segundo o Olhar Digital e a Mobile Time.

Resultados científicos antes do lançamento

Antes de lançar os modelos, a Anthropic diz tê-los usado para produzir resultados científicos. O Fable treinou uma rede neural que construiu um mapa de elevação de alta resolução de Vênus a partir de dados da NASA, segundo a Mobile Time e a Olhar Digital.

O Mythos, por sua vez, foi usado no design de ligantes proteicos e teve uma taxa de sucesso experimental de cerca de 50% em 12 alvos biológicos testados em laboratório, além de ajudar a escrever kernels de GPU personalizados para acelerar cargas de trabalho de biologia computacional, segundo a Tecmundo e a Mobile Time.

Preço do token mantido, cache mais barato

O preço por token de entrada e saída não mudou: segue em US$ 10 e US$ 50 por milhão, os mesmos valores do Fable 5, segundo a Tecmundo e a Hipertextual. O que caiu foi o preço de ler tokens já processados em cache, 75% mais barato — de US$ 1 para US$ 0,25 por milhão.

Segundo a Anthropic, esse corte reduz o custo de cargas de trabalho comuns em cerca de 25% e o de tarefas mais agênticas — que dependem de vários ciclos de raciocínio do modelo — em até 45%, de acordo com a Hipertextual, a SiliconANGLE e o The Verge. A Hipertextual acrescenta que a Anthropic também credita parte dessa economia ao fato de o Fable 5.1 igualar ou superar o Fable 5 mesmo configurado para níveis de esforço baixo ou médio.

Filtros mais soltos para achar falhas de segurança

A Anthropic também afinou os filtros do Fable 5.1 para reduzir bloqueios de pedidos legítimos. O modelo agora pode ser usado para identificar vulnerabilidades de software, algo que a versão anterior bloqueava, segundo a SiliconANGLE e o The Verge. Tarefas mais avançadas, como testes de invasão e geração de exploits, continuam sendo direcionadas para os modelos Opus.

Dados sob controle do cliente

A Anthropic também apresentou os Enterprise Frontier Safeguards, recurso que permite a clientes elegíveis rodar o Fable com retenção zero de dados dentro da própria infraestrutura. Na AWS, esse modo já está disponível para uso interno até 31 de dezembro de 2026, segundo a AWS.

O Fable 5.1 já está disponível na web, nos aplicativos e pela API da Anthropic, além do Amazon Bedrock e da Claude Platform on AWS. O acesso está incluído no plano Claude Max; assinantes do Claude Pro precisam comprar créditos à parte para usá-lo, segundo a Hipertextual e a AWS.