Skip to content
comparisons

Opus 5: O Fable Killer chegou

A Anthropic acaba de lançar seu desafiante ao Fable 5 pela metade do preço, prometendo um desempenho de última geração. Mas nossos testes práticos revelam um detalhe crítico sobre seu custo no mundo real que os benchmarks não mostram.

Vera Cole
Opus 5: O Fable Killer chegou

A Blitz de Benchmarks: O domínio teórico do Opus 5

O Opus 5 da Anthropic chegou, posicionando-se como o novo estado da arte para avaliações críticas de codificação e trabalho intelectual. No Frontier-Bench, ele supera comprovadamente o Fable 5 em quase 10%, uma margem significativa que redefine as expectativas de desempenho.

O desempenho do Opus 5 no benchmark ARC-AGI é particularmente inovador, atingindo impressionantes 30,2%. Isso representa um salto monumental em relação aos 1,5% do Opus 4.8 e ao recorde anterior de 7,8% do Sol, demonstrando uma nova capacidade de converter testes em notação algébrica para raciocínio lógico avançado.

Métricas de terceiros da Artificial Analysis reforçam o domínio teórico do Opus 5 em múltiplas dimensões críticas. Ele assume a liderança incontestável sobre o Fable 5 e o GPT 5.6 Sol tanto no Agentic Index quanto no Intelligence Index.

Embora o Opus 5 garanta o segundo lugar no Coding Index, apenas 0,3 pontos atrás do GPT 5.6 Sol Extra High, ele ainda supera o Fable 5 em 1,5 pontos. Esses resultados abrangentes de benchmark confirmam a liderança imediata e substancial do Opus 5 em inteligência de fronteira.

Decodificando a promessa de 'metade do preço'

A Anthropic posiciona o Opus 5 como uma alternativa de "metade do preço" ao Fable 5, e suas taxas oficiais de API confirmam isso. O Opus 5 mantém o mesmo preço do Opus 4.8: US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de tokens de saída. Essa estrutura, de fato, o torna aproximadamente metade do custo do Fable 5 com base por token.

Análises de custo baseadas em benchmarks frequentemente reforçam a proposta de valor do Opus 5, mostrando que ele é mais barato por tarefa do que o Fable 5. A Artificial Analysis descobriu que o Opus 5 custa 72 centavos a menos para uma tarefa típica. O CursorBench também relatou que o Opus 5 custou US$ 8 para uma tarefa em que o Fable 5 custou US$ 17.

No entanto, testes práticos revelam uma história diferente para tarefas complexas. Uma única tarefa de codificação de jogo de corrida de Fórmula 1 custou US$ 12,99 para o Opus 5, tornando-o mais caro que o Fable 5 nesse caso. Essa anomalia decorreu do fato de o Opus 5 consumir cinco vezes mais tokens para a mesma saída, desafiando a narrativa de "metade do preço" em cenários práticos de alto consumo de tokens.

Apesar da redução de custo relativa do Opus 5, o GPT 5.6 Sol continua sendo o campeão indiscutível de relação custo-benefício. Os modelos da Anthropic, incluindo o Opus 5, ainda ocupam uma faixa de preço premium. Usuários que priorizam a eficiência de custo absoluta encontrarão melhor valor fora do ecossistema Opus.

Dos Benchmarks às Construções: Confronto no Mundo Real

Indo além dos benchmarks teóricos, o Opus 5 demonstra um desempenho impressionante no mundo real. Em uma tarefa de geração de jogo de Fórmula 1, o Opus 5 produziu visuais e funcionalidades superiores em comparação com os rivais. Sua saída, um único arquivo HTML usando Three.js, apresentava carros de F1 bem modelados, manuseio preciso, tempos de volta funcionais e posicionamento preciso. Os carros do Fable 5 pareciam mais básicos, enquanto o GPT 5.6 Sol entregou uma versão com bugs, sem pista, ativos invertidos e uma seção de pista quebrada, tornando o Opus 5 o vencedor claro em qualidade de execução.

O Opus 5 destacou-se ainda mais em um projeto de dashboard financeiro full-stack. Ele gerou uma aplicação moderna e totalmente funcional, com um UI/UX limpo e páginas dedicadas para todas as funcionalidades solicitadas. O Opus 5 utilizou uma stack tecnológica contemporânea, incluindo React Router e Node com SQLite para uma gestão de dados robusta. O Fable 5 optou por um roteador próprio, uma abordagem mais antiga, enquanto o Kimi K3 utilizou um banco de dados de arquivos JSON menos robusto, destacando a abordagem sofisticada do Opus 5 em relação à arquitetura de projeto. Para mais detalhes técnicos sobre suas capacidades, veja Introducing Opus 5 - Anthropic.

Este modelo demonstra consistentemente um forte bom gosto em codificação e uma capacidade excepcional de executar projetos complexos com múltiplos arquivos de uma só vez. Seus resultados não são apenas funcionais, mas também seguem padrões modernos de desenvolvimento, estabelecendo o Opus 5 como uma ferramenta de desenvolvedor formidável e altamente capaz para uso profissional.

Gostando do artigo? Receba um assim na sua caixa de entrada toda manhã.

um e-mail por dia · cancele em dois cliques · sem rastreadores de terceiros

O Novo Padrão? Onde o Opus 5 se Encaixa na Sua Stack

O Opus 5 apresenta uma alternativa ao Fable 5 convincente para 95% das tarefas, entregando inteligência de alto nível a um preço significativamente mais favorável. Ele supera o Fable 5 em quase 10% no Frontier-Bench e alcançou inéditos 30,2% no ARC-AGI, demonstrando uma nova capacidade de raciocínio algébrico. O Opus 5 custa US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de saída, aproximadamente metade do custo típico de conclusão de tarefas do Fable 5.

Criticamente, o Opus 5 oferece vantagens estratégicas por meio de suas políticas de dados. Ao contrário do Fable 5, o Opus 5 não possui requisitos de retenção de dados para acesso geral. As políticas de dados restritivas do Fable 5 impediram até mesmo sua inclusão no benchmark ARC-AGI, destacando a maior flexibilidade e aplicabilidade mais ampla do Opus 5 para fluxos de trabalho sensíveis ou proprietários.

O cenário atual de IA apresenta agora uma hierarquia distinta para necessidades especializadas:

  • Fable 5: Mantém sua vantagem para pesquisas complexas de longo prazo.
  • GPT 5.6 Sol: Entrega desempenho consciente do orçamento, quase metade do preço do Opus 5.
  • Kimi K3: Impressiona com capacidades de pesos abertos, garantindo seu nicho.

O Opus 5, no entanto, emerge definitivamente como o novo driver diário de alto desempenho, oferecendo inteligência de fronteira sem o custo premium ou políticas de dados restritivas.

Perguntas Frequentes

O que é o Claude Opus 5?

Claude Opus 5 é o mais recente modelo de linguagem grande da Anthropic, projetado para oferecer inteligência próxima ao seu modelo de fronteira, o Fable 5, mas a um preço significativamente menor. Ele é posicionado como um modelo poderoso e eficiente para tarefas diárias.

Como o Opus 5 se compara ao Fable 5?

No papel, o Opus 5 iguala ou supera o Fable 5 em benchmarks chave como os Índices de Codificação, Agência e Inteligência. Ele também não possui os requisitos de retenção de dados do Fable. No entanto, o Fable 5 provavelmente ainda é superior para problemas extremamente complexos e de longo prazo.

O Opus 5 é realmente mais barato que o Fable 5?

O preço da API para o Opus 5 é aproximadamente metade do preço do Fable 5. Embora os benchmarks sugiram custos de tarefa mais baixos, alguns testes no mundo real mostram que ele pode usar significativamente mais tokens, tornando-o potencialmente mais caro para certas tarefas complexas de geração.

O que houve de especial na pontuação do benchmark ARC-AGI do Opus 5?

O Opus 5 alcançou uma pontuação massiva de 30,2% no ARC-AGI, comparado ao recorde anterior de 7,8%. Pesquisadores notaram que ele demonstrou uma nova capacidade ao converter problemas de raciocínio abstrato em notação algébrica para resolvê-los, uma habilidade não vista em outros modelos.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only