Claude Opus 5 chegou: inteligência perto da Fable pela metade do preço, agora no MuiRouter
Claude Opus 5 se aproxima do nível Fable 5 em codificação e trabalho de conhecimento, ao preço do Opus 4.8. Os primeiros retornos destacam o custo-benefício; o MuiRouter já suporta claude-opus-5.
Em 24 de julho de 2026, a Anthropic lançou o Claude Opus 5. O posicionamento oficial: a capacidade bruta pode ficar um pouco abaixo de Fable/Mythos, mas o preço é mais acessível. Com o tempo, pode atuar como executor do dia a dia sob o Fable. A Anthropic o descreve como um modelo mais proativo e que verifica o próprio trabalho, aproximando-se do Claude Fable 5 em codificação e trabalho de conhecimento, pela metade do preço do Fable 5 — os mesmos US$ 5 / US$ 25 por milhão de tokens do Opus 4.8.
Para quem desenvolve no dia a dia, cada atualização da Anthropic merece atenção. Nestes meses o Fable foi forte, mas caro, escasso e muitas vezes penalizado por classificadores de segurança; após o lançamento do Fable, o boato de que o Opus 4.8 “ficou mais burro” ganhou força. O Opus 5 finalmente traz alguma esperança: mesmo preço, grande salto de capacidade.
O MuiRouter já suporta claude-opus-5. Mesma chave de API, mesmos paths /v1/chat/completions e /v1/messages — mude o nome do modelo e teste.
Resumo da atualização da Anthropic
Segundo o anúncio do Claude Opus 5 e a system card:
- ID do modelo:
claude-opus-5, disponível na API, Claude Code e Claude Platform. - Novo padrão no Claude Max, e o modelo mais forte atualmente no Claude Pro.
- Preço igual ao Opus 4.8: US$ 5 / 1M tokens de entrada, US$ 25 / 1M de saída.
- Fast mode opcional: ~2,5× a velocidade padrão a 2× o preço base.
- Foco: agents de longo prazo, engenharia de software, trabalho de conhecimento e verificar-e-iterar de forma proativa. Diferente do Mythos, não é centrado em ciberoffensiva, então não precisa de lançamento “só para parceiros”.
A Anthropic é explícita: em tarefas de exploração de cibersegurança, o Opus 5 fica de propósito atrás do Mythos 5.
Benchmarks e custo: baixar o custo por tarefa concluída
A Anthropic não vende um preço de etiqueta mais baixo por token. Vende um custo mais baixo para terminar o mesmo tipo de trabalho. Essa tem sido a corrida de mercado entre os grandes labs.
| Área | Mensagem Anthropic / parceiros | Por que importa |
|---|---|---|
| Frontier-Bench v0.1 | Supera os modelos comparados; ~2× Opus 4.8 com menor custo por tarefa | Se a engenharia de longo horizonte é de fato mais forte e mais barata |
| CursorBench 3.2 (max effort) | A ~0,5 % do pico do Fable 5 a cerca de metade do custo por tarefa | Coding em IDE / agent do dia a dia |
| ARC-AGI 3 | ~3× o segundo melhor modelo | Problemas inéditos, raciocínio não convencional |
| Zapier AutomationBench | ~1,5× a taxa de acerto do segundo no mesmo custo; o effort mais baixo muitas vezes ainda lidera | Automação de negócio ponta a ponta |
| OSWorld 2.0 | Melhor a qualquer custo dado; supera o pico do Fable 5 a ~1/3 do custo | Agents de uso de computador / desktop |
| GDPval-AA e trabalho de conhecimento | Novo SOTA (competindo na faixa do Fable) | Relatórios, pesquisa, docs profissionais |
Em resumo: preço de lista igual, curva oficial de “saída útil por unidade de custo” claramente em alta. Que isso se confirme na prática.
Primeiras opiniões: custo-benefício é o tema principal
Um dia após o lançamento, a discussão pública e os círculos de builders estão divididos: uns veem algo no nível do Fable; outros não. Na nossa experiência, isso costuma acompanhar o stack de agent e o harness embutido, não só o modelo base.
O criador do OpenResty, 春哥 (Zhang Yichun), avalia o Opus 5 muito bem — no framework de avaliação dele, pode até superar o Fable. O desenvolvedor independente Baye pensa o oposto: o raciocínio do Opus 5 não é profundo nem abrangente o bastante, e ainda é preciso investir mais esforço para gerenciá-lo.
Temas recorrentes:
- “Metade do preço frente ao Fable.” Fable 5 ~US$ 10 / 50; Opus 5 a US$ 5 / 25. CursorBench max effort a ~0,5 % do pico do Fable. Para orçamento de time, é re-pricing, não renome cosmético.
- Loops de auto-checagem mais fortes. Casos iniciais: abrir layout desktop e mobile, pegar produtos abaixo da dobra e botões de checkout fora da tela, e corrigir; ou achar a causa raiz que um patch da comunidade não cobriu.
- Empurrão sem teimosia cega. Alguns refactors: o modelo contesta um design ruim, sustenta até clarear o desacordo e propõe compromisso. Para agents, julgamento vence obediência cega.
- Vozes mais frias. Continua medindo no seu harness. Fast mode dobra o preço de lista por velocidade.
Consenso comprimido: Opus 5 é hoje o “Opus padrão do dia a dia” que mais vale avaliar primeiro.
Preços
| Modelo | Input | Output |
|---|---|---|
claude-fable-5 | US$ 10 / 1M tokens | US$ 50 / 1M tokens |
claude-opus-5 | US$ 5 / 1M tokens | US$ 25 / 1M tokens |
claude-opus-4-8 | US$ 5 / 1M tokens | US$ 25 / 1M tokens |
claude-sonnet-5 (intro até 2026-08-31) | US$ 2 / 1M tokens | US$ 10 / 1M tokens |
claude-sonnet-5 (padrão a partir de 2026-09-01) | US$ 3 / 1M tokens | US$ 15 / 1M tokens |
O prompt caching padrão da Anthropic continua valendo. Como no Sonnet 5: decida pela fatura por tarefa concluída, não só pelo preço de etiqueta.
Fast mode: ~2,5× velocidade a 2× preço base, bom para coding interativo; lotes longos podem ficar no nível padrão.
Segurança e salvaguardas
A Anthropic coloca o Opus 5 entre seus modelos mais alinhados: menos comportamentos indesejáveis em auditorias automatizadas, mais difícil de enganar para uso indevido.
No cyber: encontrar vulnerabilidades é bem mais forte e se aproxima do Mythos 5; o desenvolvimento completo de exploits continua bem mais fraco. Os classificadores são mais brandos que no Fable 5. Pedidos sinalizados podem cair para Opus 4.8.
Para a maioria das equipes de produto: “ajuda em auditoria defensiva” sem virar ferramenta de ataque para todo mundo. Na prática deve mal interpretar menos a intenção do usuário que o Fable 5, e ficar mais perto da engenharia do dia a dia.
O que isso muda para desenvolvedores
- Do Opus 4.8: preço de lista plano — compare taxa de acerto e tokens no seu harness. Em geral deve correr bem.
- Vs Fable 5: Fable para horizonte longo extremo se orçamento e guardrails permitirem; para a maioria das tarefas, Opus 5 tem melhor valor.
- Vs Sonnet 5: volume e tarefas repetitivas no Sonnet; debug / arquitetura / multi-arquivo no Opus 5.
- Effort e Fast mode: comece em effort médio. 春哥 aconselha não maxear effort sem pensar — pensar demais pode baixar a qualidade. Quanto ao Fast mode: deixe de lado por enquanto.
- Skills antigos / prompts rígidos demais: o modelo é mais “opiniático”; limpar rails obsoletos pode melhorar o resultado.
O que isso muda para usuários do MuiRouter
O MuiRouter se baseia em uma ideia simples: uma chave de API, um estilo de integração, troca de modelo como configuração.
Adicionamos claude-opus-5 ao catálogo no preço publicado de US$ 5 / 25 (caches inclusos), com o mesmo markup dos outros Claude. Aponte model para claude-opus-5 (ou escolha no Playground).
Como sempre, só migre produção após um teste de ponta a ponta. O papel de um gateway unificado: novo modelo, novo default, nova curva de custo, código da app quase sem mexer.
Conclusão
Claude Opus 5 é uma atualização sólida do dia a dia mais um salto geracional ao mesmo preço: números oficiais e primeiros retornos apontam teto mais alto em coding/conhecimento e menor custo por tarefa. A avaliação de 春哥 é mais um motivo para prestar atenção ao salto de capacidade.
Se você ainda está no Opus 4.8, recomendamos subir cedo. Se o preço ou as salvaguardas do Fable 5 te fizeram hesitar, o Opus 5 provavelmente é a melhor ferramenta padrão.
O MuiRouter está pronto — comece agora.
Fontes de referência
Fonte principal publicada em 24 de julho de 2026.
Prepare-se para a próxima mudança em IA
Comece com uma API Key e um caminho mais claro para manter o acesso a modelos estável enquanto ferramentas e disponibilidade upstream mudam.