Pular para o conteúdo

Claude Opus 5 chega com desempenho perto do Fable 5

No Frontier-Bench, o Claude Opus 5 supera a versão 4.8, mas a Anthropic ainda indica Fable 5 para tarefas longas e autônomas.

Por Redação 4 min de leitura
Ilustração antiga de ovos de aves numerados, com tamanhos, cores e manchas variadas, dispostos em espiral sobre fundo bege
Imagem: Anthropic/Reprodução

Ainda na última sexta-feira (24), a Anthropic lançou o Claude Opus 5, novo modelo de IA que promete desempenho próximo ao do topo de linha Claude Fable 5 por metade do custo. O Opus 5 já é o modelo padrão do Claude Max e o mais forte disponível no Claude Pro, com preço mantido em US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída, o mesmo valor cobrado pelo antecessor Opus 4.8. Veja os detalhes:

O lançamento fecha um mês de atualizações na família Claude. A Anthropic já havia lançado o Claude Mythos 5 e o Claude Fable 5 no mês passado, seguidos pelo Claude Sonnet 5 em 1º de julho. Com a chegada do Opus 5, a empresa atualiza a camada intermediária da própria hierarquia de modelos, historicamente usada como equilíbrio entre poder de raciocínio e custo operacional para empresas e desenvolvedores.

Preço segue igual ao da Opus 4.8, mas o Opus 5 dispara no Frontier-Bench v0.1

No Frontier-Bench v0.1, avaliação interna da Anthropic para codificação agêntica em terminal, o Opus 5 marcou 43,3%, mais que o dobro dos 21,1% obtidos pela Opus 4.8 e acima dos 33,7% do Fable 5. Segundo a empresa, esse ganho vem a um custo por tarefa menor que o do modelo anterior.

O salto se repete em outras métricas. No ARC-AGI 3, teste de resolução de problemas inéditos, o Opus 5 marcou 30,2%, contra apenas 1,5% da Opus 4.8. Já no OSWorld 2.0, avaliação de uso de computador, o modelo chegou a 70,6% e superou o melhor resultado do Fable 5 (66,1%) usando pouco mais de um terço do custo, segundo a Anthropic.

Claude Opus 5 chega perto do Fable 5, mas não vence em tudo

AvaliaçãoOpus 5Fable 5Opus 4.8GPT-5.6 Sol
Codificação agêntica (Frontier-Bench v0.1)43,3%33,7%21,1%34,4%
Conhecimento (GDPval-AA v2)1.8611.7471.5931.736
Problemas inéditos (ARC-AGI 3)30,2%sem dado1,5%7,8%
Uso de computador (OSWorld 2.0)70,6%66,1%55,7%62,6%
Fluxos de negócio (AutomationBench)26,0%17,4%17,0%18,1%
Codificação agêntica (DeepSWE v1.1)68,8%69,7%59,0%72,7%

Comparativo de benchmarks entre os principais modelos da Anthropic e o GPT-5.6 Sol (Fonte: Anthropic)

Como podemos ver na tabela acima, o Opus 5 lidera a maior parte das categorias, incluindo conhecimento geral, uso de computador e fluxos de negócio automatizados.

Tabela comparando benchmarks do Claude Opus 5 com Fable 5, Opus 4.8 e GPT-5.6 Sol em código, raciocínio e agentes
Opus 5 lidera a maioria das categorias avaliadas pela Anthropic, mas fica atrás de Fable 5 e Mythos 5 em saúde, biologia e tarefas jurídicas (Imagem: Anthropic/Divulgação)

A exceção fica por conta do DeepSWE v1.1, em que o GPT-5.6 Sol chega a 72,7% e supera tanto o Opus 5 quanto o Fable 5, justamente o tipo de resultado por trás da ressalva feita pela VentureBeat de que um modelo da família OpenAI ainda lidera em pelo menos um benchmark de codificação agêntica.

Vale destacar que o Fable 5 segue à frente em área jurídica (13,3% contra 11,7% no Legal Agent Benchmark). Já em saúde e biologia, quem lidera é o Mythos 5, não o Fable 5: 66,0% no HealthBench Professional e 89,0% nos problemas de biologia já resolvidos por humanos no BioMysteryBench, segundo a mesma tabela divulgada pela Anthropic.

Preço e disponibilidade

O Claude Opus 5 já está disponível em todas as plataformas e planos que antes davam acesso à Opus 4.8, com preço de US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. Desenvolvedores podem chamar o modelo pelo identificador claude-opus-5 na API da Anthropic. Assim como os Opus anteriores, o Opus 5 não tem exigência de retenção de dados para o acesso geral.

Página do Opus 5 no OpenRouter, com preço, contexto de 1M tokens e provedores como Anthropic, AWS e Azure
Além do acesso direto pela Anthropic, o Claude Opus 5 também aparece no agregador OpenRouter, que distribui as chamadas entre provedores como AWS, Azure e Google Vertex ao mesmo preço de US$ 5 e US$ 25 por milhão de tokens, mas com uptime e latência que variam por provedor (Imagem: OpenRouter/Reprodução)

Vale destacar que a própria Anthropic recomenda o Fable 5 para os projetos mais longos e autônomos, e trata o Opus 5 como o modelo do dia a dia, não como substituto direto do topo de linha.

E você? Já testou o Claude Opus 5? Acha que a promessa de desempenho perto do Fable 5 por metade do preço se confirma no uso do dia a dia? Deixe seu comentário!

https://seashell-marten-153702.hostingersite.com/pre-venda-do-ea-sports-fc-27-precos

Fontes: Anthropic, ZDNet, VentureBeat

Deixe um comentário