MuiRouter
Voltar ao blog
8 min de leitura

Claude Opus 5 chegou: inteligência perto da Fable pela metade do preço, agora no MuiRouter

Claude Opus 5 se aproxima do nível Fable 5 em codificação e trabalho de conhecimento, ao preço do Opus 4.8. Os primeiros retornos destacam o custo-benefício; o MuiRouter já suporta claude-opus-5.

Claude Opus 5AnthropicModelos de IA

Em 24 de julho de 2026, a Anthropic lançou o Claude Opus 5. O posicionamento oficial: a capacidade bruta pode ficar um pouco abaixo de Fable/Mythos, mas o preço é mais acessível. Com o tempo, pode atuar como executor do dia a dia sob o Fable. A Anthropic o descreve como um modelo mais proativo e que verifica o próprio trabalho, aproximando-se do Claude Fable 5 em codificação e trabalho de conhecimento, pela metade do preço do Fable 5 — os mesmos US$ 5 / US$ 25 por milhão de tokens do Opus 4.8.

Para quem desenvolve no dia a dia, cada atualização da Anthropic merece atenção. Nestes meses o Fable foi forte, mas caro, escasso e muitas vezes penalizado por classificadores de segurança; após o lançamento do Fable, o boato de que o Opus 4.8 “ficou mais burro” ganhou força. O Opus 5 finalmente traz alguma esperança: mesmo preço, grande salto de capacidade.

O MuiRouter já suporta claude-opus-5. Mesma chave de API, mesmos paths /v1/chat/completions e /v1/messages — mude o nome do modelo e teste.

Resumo da atualização da Anthropic

Segundo o anúncio do Claude Opus 5 e a system card:

  • ID do modelo: claude-opus-5, disponível na API, Claude Code e Claude Platform.
  • Novo padrão no Claude Max, e o modelo mais forte atualmente no Claude Pro.
  • Preço igual ao Opus 4.8: US$ 5 / 1M tokens de entrada, US$ 25 / 1M de saída.
  • Fast mode opcional: ~2,5× a velocidade padrão a 2× o preço base.
  • Foco: agents de longo prazo, engenharia de software, trabalho de conhecimento e verificar-e-iterar de forma proativa. Diferente do Mythos, não é centrado em ciberoffensiva, então não precisa de lançamento “só para parceiros”.

A Anthropic é explícita: em tarefas de exploração de cibersegurança, o Opus 5 fica de propósito atrás do Mythos 5.

Benchmarks e custo: baixar o custo por tarefa concluída

A Anthropic não vende um preço de etiqueta mais baixo por token. Vende um custo mais baixo para terminar o mesmo tipo de trabalho. Essa tem sido a corrida de mercado entre os grandes labs.

ÁreaMensagem Anthropic / parceirosPor que importa
Frontier-Bench v0.1Supera os modelos comparados; ~2× Opus 4.8 com menor custo por tarefaSe a engenharia de longo horizonte é de fato mais forte e mais barata
CursorBench 3.2 (max effort)A ~0,5 % do pico do Fable 5 a cerca de metade do custo por tarefaCoding em IDE / agent do dia a dia
ARC-AGI 3~3× o segundo melhor modeloProblemas inéditos, raciocínio não convencional
Zapier AutomationBench~1,5× a taxa de acerto do segundo no mesmo custo; o effort mais baixo muitas vezes ainda lideraAutomação de negócio ponta a ponta
OSWorld 2.0Melhor a qualquer custo dado; supera o pico do Fable 5 a ~1/3 do custoAgents de uso de computador / desktop
GDPval-AA e trabalho de conhecimentoNovo SOTA (competindo na faixa do Fable)Relatórios, pesquisa, docs profissionais

Em resumo: preço de lista igual, curva oficial de “saída útil por unidade de custo” claramente em alta. Que isso se confirme na prática.

Primeiras opiniões: custo-benefício é o tema principal

Um dia após o lançamento, a discussão pública e os círculos de builders estão divididos: uns veem algo no nível do Fable; outros não. Na nossa experiência, isso costuma acompanhar o stack de agent e o harness embutido, não só o modelo base.

O criador do OpenResty, 春哥 (Zhang Yichun), avalia o Opus 5 muito bem — no framework de avaliação dele, pode até superar o Fable. O desenvolvedor independente Baye pensa o oposto: o raciocínio do Opus 5 não é profundo nem abrangente o bastante, e ainda é preciso investir mais esforço para gerenciá-lo.

Temas recorrentes:

  • “Metade do preço frente ao Fable.” Fable 5 ~US$ 10 / 50; Opus 5 a US$ 5 / 25. CursorBench max effort a ~0,5 % do pico do Fable. Para orçamento de time, é re-pricing, não renome cosmético.
  • Loops de auto-checagem mais fortes. Casos iniciais: abrir layout desktop e mobile, pegar produtos abaixo da dobra e botões de checkout fora da tela, e corrigir; ou achar a causa raiz que um patch da comunidade não cobriu.
  • Empurrão sem teimosia cega. Alguns refactors: o modelo contesta um design ruim, sustenta até clarear o desacordo e propõe compromisso. Para agents, julgamento vence obediência cega.
  • Vozes mais frias. Continua medindo no seu harness. Fast mode dobra o preço de lista por velocidade.

Consenso comprimido: Opus 5 é hoje o “Opus padrão do dia a dia” que mais vale avaliar primeiro.

Preços

ModeloInputOutput
claude-fable-5US$ 10 / 1M tokensUS$ 50 / 1M tokens
claude-opus-5US$ 5 / 1M tokensUS$ 25 / 1M tokens
claude-opus-4-8US$ 5 / 1M tokensUS$ 25 / 1M tokens
claude-sonnet-5 (intro até 2026-08-31)US$ 2 / 1M tokensUS$ 10 / 1M tokens
claude-sonnet-5 (padrão a partir de 2026-09-01)US$ 3 / 1M tokensUS$ 15 / 1M tokens

O prompt caching padrão da Anthropic continua valendo. Como no Sonnet 5: decida pela fatura por tarefa concluída, não só pelo preço de etiqueta.

Fast mode: ~2,5× velocidade a 2× preço base, bom para coding interativo; lotes longos podem ficar no nível padrão.

Segurança e salvaguardas

A Anthropic coloca o Opus 5 entre seus modelos mais alinhados: menos comportamentos indesejáveis em auditorias automatizadas, mais difícil de enganar para uso indevido.

No cyber: encontrar vulnerabilidades é bem mais forte e se aproxima do Mythos 5; o desenvolvimento completo de exploits continua bem mais fraco. Os classificadores são mais brandos que no Fable 5. Pedidos sinalizados podem cair para Opus 4.8.

Para a maioria das equipes de produto: “ajuda em auditoria defensiva” sem virar ferramenta de ataque para todo mundo. Na prática deve mal interpretar menos a intenção do usuário que o Fable 5, e ficar mais perto da engenharia do dia a dia.

O que isso muda para desenvolvedores

  • Do Opus 4.8: preço de lista plano — compare taxa de acerto e tokens no seu harness. Em geral deve correr bem.
  • Vs Fable 5: Fable para horizonte longo extremo se orçamento e guardrails permitirem; para a maioria das tarefas, Opus 5 tem melhor valor.
  • Vs Sonnet 5: volume e tarefas repetitivas no Sonnet; debug / arquitetura / multi-arquivo no Opus 5.
  • Effort e Fast mode: comece em effort médio. 春哥 aconselha não maxear effort sem pensar — pensar demais pode baixar a qualidade. Quanto ao Fast mode: deixe de lado por enquanto.
  • Skills antigos / prompts rígidos demais: o modelo é mais “opiniático”; limpar rails obsoletos pode melhorar o resultado.

O que isso muda para usuários do MuiRouter

O MuiRouter se baseia em uma ideia simples: uma chave de API, um estilo de integração, troca de modelo como configuração.

Adicionamos claude-opus-5 ao catálogo no preço publicado de US$ 5 / 25 (caches inclusos), com o mesmo markup dos outros Claude. Aponte model para claude-opus-5 (ou escolha no Playground).

Como sempre, só migre produção após um teste de ponta a ponta. O papel de um gateway unificado: novo modelo, novo default, nova curva de custo, código da app quase sem mexer.

Conclusão

Claude Opus 5 é uma atualização sólida do dia a dia mais um salto geracional ao mesmo preço: números oficiais e primeiros retornos apontam teto mais alto em coding/conhecimento e menor custo por tarefa. A avaliação de 春哥 é mais um motivo para prestar atenção ao salto de capacidade.

Se você ainda está no Opus 4.8, recomendamos subir cedo. Se o preço ou as salvaguardas do Fable 5 te fizeram hesitar, o Opus 5 provavelmente é a melhor ferramenta padrão.

O MuiRouter está pronto — comece agora.

Fontes de referência

Fonte principal publicada em 24 de julho de 2026.

Prepare-se para a próxima mudança em IA

Comece com uma API Key e um caminho mais claro para manter o acesso a modelos estável enquanto ferramentas e disponibilidade upstream mudam.

Cadastrar