tradingkey.logo
tradingkey.logo
Pesquisar

O mais recente modelo Fable 5.1 da Anthropic salta para o topo das tabelas de classificação da LLM

Cryptopolitan1 de set de 2026 às 21:50
facebooktwitterlinkedin
Ver todos os comentários(0)

A Anthropic lançou um novo modelo no passado dia 1 de setembro, chamado Claude Fable 5.1. 

O modelo conquistou imediatamente o primeiro lugar no ranking de inteligência artificial da Artificial Analysis, com uma pontuação de 66 no índice do site, destronando o Opus 5 no processo.

O Fable 5.1 e o Opus 5 estão no topo da lista

A Artificial Analysis classifica mais de 250 modelos de linguagem com base no preço, velocidade e inteligência. Agora, classifica duas iterações do Fable 5.1 em primeiro e segundo lugar na tabela. O site atribui uma pontuação de 66 ao modelo "máximo com fallback" e 65 ao modelo "extremamente alto com fallback". 

Ambos superam o antigo líder Claude Opus 5, com uma pontuação de 63 nos modos max e xhigh.

Isto significa que a Anthropic ocupa os quatro primeiros lugares numa tabela de classificação que inclui modelos de laboratórios de IA de renome como OpenAI, Google, SpaceXAI, Alibaba e DeepSeek. Os modelos mais próximos da pontuação da Anthropic são o GPT-5.6 Sol da OpenAI no seu modo máximo e o Grok 4.6 da SpaceXAI, ambos com 61 pontos. 

O mais recente modelo Claude Fable 5.1 da Anthropic lidera o ranking da inteligência 
Classificação dos modelos de IA. Fonte: Análise Artificial

O ranking provém de uma entidadedent , o que lhe confere mais validade do que os gráficos elaborados por um laboratório.  

Onde ficaram as pontuações de codificação e pesquisa 

Os números internos da Anthropic contam uma história semelhante, embora devam ser interpretados como dados fornecidos pelo fornecedor. O relatório da Anthropic classifica o Fable 5.1 com 52,6% no teste Terminal-Bench-Science 0.1, que avalia a investigação científica com agentes. Este número é o dobro dos 24,7% do Fable 5 e muito superior aos 29% e 22,4% do Opus 5 e do GPT-5.6 Sol, respetivamente.  

O Fable 5.1 obteve uma pontuação de 55,8% no teste de avaliação de código Terminal-Bench 4.0, superior à pontuação de 42,0% do Fable 5.

A grande diferença é a capacidade deste novo modelo de executar tarefas que duram horas. A Millennium informou a Anthropic que o Fable 5.1 conseguiu tracuma falha rara no seu sistema até um bug que se revelou demasiado persistente para os seus engenheiros nos últimos quatro ou cinco anos. 

Segundo a Browserbase, o novo modelo concluiu 82% das tarefas no seu teste mais exigente de agentes browser, em comparação com 74% do Opus 5.

Redução de 75% no preço de leitura em cache                                      

Não houve alteração de preço. O Fable 5.1 mantém as taxas do Fable 5: 10 dólares por milhão de fichas de entrada e 50 dólares por milhão de fichas de saída, bem mais do que o Opus 5, que custa 5 e 25 dólares, e o Sonnet 5, que custa 2 e 10 dólares.

A alteração ocorre no preço do contexto em cache. A Anthropic reduziu o preço de leitura da cache de 1,00 dólares para 0,25 dólares por milhão de tokens, um corte de 75%. 

A Anthropic estima que a carga de trabalho média será 25% mais barata, enquanto as cargas de trabalho com uma grande participação de agentes serão 45% mais baratas. Isto deve-se à capacidade dos agentes de reler o mesmo código, instruções e histórico de conversas.

Mesmo modelo, dois níveis de proteção

A Anthropic lançou um segundo nome para o Fable 5.1: Claude Mythos 5.1. São basicamente os mesmos modelos, mas com salvaguardas distintas. O Fable 5.1 está disponível para o público em geral, enquanto o Mythos 5.1 está apenas disponível para grupos de cibersegurança e ciências biológicas selecionados, através do Projeto Glasswing da Anthropic. 

Esta separação ocorre após um período difícil para os testes de segurança da Anthropic. Tal como Cryptopolitan , a Anthropic suspendeu as avaliações externas de cibersegurança a 23 de julho. Isto aconteceu depois de Claude ter tido acesso a sistemas reais durante testes que deveriam ser realizados em ambiente isolado (sandbox). 

A empresa retomou as avaliações externas de cibersegurança assim que conseguiu implementar as medidas de contenção adequadas.

As mentes mais brilhantes do mundo das criptomoedas já leem nossa newsletter. Quer participar? Junte-se a elas.

Aviso legal: as informações fornecidas neste site são apenas para fins educacionais e informativos e não devem ser consideradas consultoria financeira ou de investimento.

Comentários (0)

Clique no botão $, digite o código do ativo e selecione para vincular uma ação, ETF ou outro ticker.

0/500
Diretrizes de comentários
Carregando...

Artigos recomendados

tradingkey.logo
Aviso de risco: Nosso site e aplicativo móvel fornecem apenas informações gerais sobre determinados produtos de investimento. A Finsights não oferece, e o fornecimento de tais informações não deve ser interpretado como se a Finsights estivesse oferecendo, aconselhamento financeiro ou recomendação para qualquer produto de investimento.
Os produtos de investimento estão sujeitos a riscos significativos, incluindo a possível perda do valor investido e podem não ser adequados para todos. O desempenho passado dos produtos de investimento não é indicativo de seu desempenho futuro.
A Finsights pode permitir que anunciantes ou afiliados realizem, ou forneçam anúncios em nosso site, ou aplicativo móvel, ou em qualquer parte deles e pode ser compensada por eles com base em sua interação com os anúncios.
 © Copyright: FINSIGHTS MEDIA PTE. LTD. Todos os direitos reservados.