Workstation Logo
Produtos
Labs de IAAgentes OpenAIAgentes ClaudeGrok BotWorkstation CRM (WSL CRM)MarketingTodos os Produtos
Soluções IA
Estações de Trabalho IAAI SME PackagesIA PrivadaClusters GPUIA EdgeLaboratório IA EmpresarialIA por Indústria
Serviços
Modernização de plataformaEngenharia digitalFundações de dados e IAOperações autónomasConsultoria de IAAutomação DevOpsCibersegurançaDesenvolvimento de softwareConstrução de agentesConfiguração MLOps
Sobre Nós
ParceirosHistórias de Clientes
Artigos
Documentação
WSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7
Blog
Contacte-nosLogin
Workstation

Estações de trabalho de IA, software multiagente de IA, infraestrutura de GPU e soluções de agentes inteligentes para empresas modernas.

Contacte-nos

Soluções de IA

Estações de Trabalho IAAI SME PackagesIA PrivadaClusters GPUIA EdgeLaboratório IA EmpresarialIA por Indústria

Produtos

Todos os ProdutosWSL CRM e ERPMarketingAgentes OpenAIWSL ProxyRing PromoterWSL VaultJobshoutSysOps 24/7

Empresa

Sobre NósPor que WorkstationParceirosHistórias de ClientesPreçosContato

Recursos

ArtigosDocumentaçãoBlogPesquisarMapa do Site
Escritório Reino Unido
77-79 Marlowes, Hemel Hempstead HP1 1LFComo chegar: pegue a saída 20 da M25, Outer LondonN.º da empresa: 11641870Seg - Sex: 9:00 - 18:00 GMT
+44 7515 356 146
Escritório Bélgica
Workstation SRL, Rue Vanderkindere 34, 1180 Uccle, BrusselsBE 0751.518.683Seg - Sex: 9:00 - 18:00 CET
+32 492 45 67 46
Escritório Índia
#159 Sector 9, Pocket 1, DDA Flats, 110077 Dwarka, New Delhi
+91 98881 98841

© 2026 Workstation AI. Todos os direitos reservados.

PrivacidadeCookiesTermos de ServiçoMapa do site

Loading blog...

Home / Blog
AnthropicAILLMCodingFinOps

Modelos Claude comparados: Haiku vs Sonnet vs Opus vs Fable 5 (Mythos 5)

Um guia rápido para escolher o tier certo de Claude, mais um router cheap-to-frontier.

Balinder Walia8 de julho de 20263 min read

Um guia rápido e prático dos tiers de modelos Claude. Para o deep-dive completo com blueprints de routing, padrões de prompting e um playbook de orçamento de tokens, leia o artigo grande.

Comparação de modelos Claude: Haiku, Sonnet, Opus, Fable 5, Mythos 5

A versão num parágrafo. A seleção de modelos Claude é sobretudo um trade-off entre latência, custo, e quanto tempo a tarefa precisa que o modelo se mantenha no fluxo. Use claude-haiku-4-5 para trabalho de intenção rápido e barato, claude-sonnet-5 para o melhor equilíbrio velocidade/qualidade, claude-opus-4-8 para coding agêntico complexo e trabalho enterprise, e reserve claude-fable-5 (e gated claude-mythos-5) para os trabalhos verdadeiramente difíceis de longo horizonte que demoram horas ou dias.

Linha de modelos de relance

Modelo Ideal para Janela de contexto Saída máx. Preços (input / output) Comportamento de thinking
Claude Fable 5 (claude-fable-5) Agentes de longa duração e os problemas por resolver mais difíceis 1M tokens 128K tokens $10 / $50 per MTok Adaptive thinking always on
Claude Opus 4.8 (claude-opus-4-8) Coding agêntico complexo e trabalho enterprise 1M tokens 128K tokens $5 / $25 per MTok Adaptive thinking always on
Claude Sonnet 5 (claude-sonnet-5) Melhor equilíbrio velocidade/qualidade 1M tokens 128K tokens $3 / $15 per MTok Adaptive thinking always on
Claude Haiku 4.5 (claude-haiku-4-5-20251001) Modelo mais rápido para tarefas baratas de elevado volume 200K tokens 64K tokens $1 / $5 per MTok Extended thinking available (adaptive off)

Claude Mythos 5 (claude-mythos-5) é um modelo gated que partilha as mesmas specs e preços do Fable 5, mas não inclui os classificadores de segurança do Fable 5. A disponibilidade está limitada a parceiros aprovados via Project Glasswing.

Escolha o modelo certo (regras rápidas)

  • Haiku 4.5: routing, classificação, extração e qualquer workflow onde queira respostas rápidas e não possa pagar orçamentos elevados de tokens de saída.
  • Sonnet 5: coding diário e trabalho documental onde quer qualidade forte sem o preço Opus/Fable.
  • Opus 4.8: coding agêntico complexo, análise empresarial e debugging mais difícil onde é necessário trabalho mais longo e autónomo.
  • Fable 5: os problemas difíceis de longo horizonte que demoram horas ou dias, especialmente quando o modelo tem de manter o objetivo, delegar subtarefas e permanecer coerente.

Effort e thinking: impacto no custo

Na API, effort é o controlo principal do trade-off entre inteligência, latência e custo em Fable 5 e Mythos 5. Para Opus 4.8 e Sonnet 5, também pode definir effort de forma explícita quando precisar de um perfil diferente de custo/latência.

Implicação prática: colocar cada request no effort máximo é normalmente a forma mais rápida de gastar o orçamento em tokens de saída.

Estratégia de tokens que funciona em todos os tiers

Os tokens de saída Claude são a parte cara. Uma regra simples é: limitar o comprimento de saída, prompt para TLDR primeiro, e use prompt caching para que prefixos estáveis (instruções de sistema e schemas de tools) sejam reutilizados.

  • Use o modelo mais barato que consiga terminar. Um router (Haiku -> Sonnet/Opus -> Fable) muitas vezes corta o custo de forma dramática mantendo a qualidade elevada.
  • Defina limites de saída. Em produção, defina sempre um max output / teto de tokens. Respostas sem limite são um acidente de orçamento.
  • Use resumos de forma estratégica. Em vez de enviar transcripts completos em cada turno, mantenha uma memória compacta de “lessons” e atualize apenas essa.

Um blueprint de router simples

  1. Classifique a intenção e a complexidade estimada com claude-haiku-4-5.
  2. Envie o trabalho “normalmente difícil” para claude-sonnet-5 (ou claude-opus-4-8 quando espera coding agêntico mais pesado).
  3. Escale para claude-fable-5 apenas quando a tarefa é claramente de longo horizonte ou falhou em tiers inferiores.
  4. Se o Fable 5 recusar via classificadores de segurança, faça fallback para Opus 4.8 (a API permite reenviar com fallbacks quando configurado).

Leituras adicionais (oficial)

  • Resumo de modelos
  • A apresentar Fable 5 e Mythos 5
  • Prompting Claude Fable 5