Een snelle, praktische gids voor Claude-modeltieren. Voor de volledige deep-dive met routing blueprints, prompting patterns en een token-budget playbook, lees het groot artikel.
claude-haiku-4-5 voor snel en goedkoop intent-werk, claude-sonnet-5 voor de beste snelheid/kwaliteit-balans, claude-opus-4-8 voor complexe agentic coding en enterprise-werk, en reserveer claude-fable-5 (en gated claude-mythos-5) voor de echt harde, lange-horizon jobs die uren of dagen kosten.
Modellijn in één oogopslag
| Model | Het beste voor | Contextvenster | Max output | Prijzen (input / output) | Thinking-gedrag |
|---|---|---|---|---|---|
Claude Fable 5 (claude-fable-5) |
Langlopende agents en de moeilijkste onopgeloste problemen | 1M tokens | 128K tokens | $10 / $50 per MTok | Adaptive thinking always on |
Claude Opus 4.8 (claude-opus-4-8) |
Complexe agentic coding en enterprise-werk | 1M tokens | 128K tokens | $5 / $25 per MTok | Adaptive thinking always on |
Claude Sonnet 5 (claude-sonnet-5) |
Beste snelheid/kwaliteit-balans | 1M tokens | 128K tokens | $3 / $15 per MTok | Adaptive thinking always on |
Claude Haiku 4.5 (claude-haiku-4-5-20251001) |
Snelste model voor goedkope, high-volume taken | 200K tokens | 64K tokens | $1 / $5 per MTok | Extended thinking available (adaptive off) |
Claude Mythos 5 (claude-mythos-5) is een gated model dat dezelfde specs en prijzen deelt als Fable 5, maar zonder de safety classifiers van Fable 5. Beschikbaarheid is beperkt tot goedgekeurde partners via Project Glasswing.
Kies het juiste model (snelle regels)
- Haiku 4.5: routing, classificatie, extractie en elke workflow waar je snelle antwoorden wilt en geen hoge output-tokenbudgetten kunt betalen.
- Sonnet 5: dagelijks coderen en documentwerk waar je sterke kwaliteit wilt zonder Opus/Fable-prijzen.
- Opus 4.8: complexe agentic coding, enterprise-analyse en zwaardere debugging waar langer, autonomer werk nodig is.
- Fable 5: de harde, lange-horizon problemen die uren of dagen kosten, vooral wanneer het model het doel moet vasthouden, subtaken delegeren en coherent blijven.
Effort en thinking: impact op kosten
Op de API, effort is de primaire sturing voor de trade-off tussen intelligentie, latency en kosten op Fable 5 en Mythos 5. Voor Opus 4.8 en Sonnet 5 kun je effort ook expliciet zetten wanneer je een ander kosten-/latencyprofiel nodig hebt.
Praktische implicatie: elke request standaard op maximale effort zetten is meestal de snelste manier om je budget aan output tokens te verbranden.
Tokenstrategie die op alle tiers werkt
Claude output tokens zijn het dure deel. Een eenvoudige regel is: outputlengte begrenzen, prompt voor TLDR-first, en gebruik prompt caching zodat stabiele prefixes (systeeminstructies en toolschemas) worden hergebruikt.
- Gebruik het goedkoopste model dat kan afronden. Een router (Haiku -> Sonnet/Opus -> Fable) snijdt vaak de kosten dramatisch terwijl de kwaliteit hoog blijft.
- Zet outputlimieten. Zet in productie altijd een max output / token cap. Onbegrensde antwoorden zijn een budgetongeluk.
- Gebruik samenvattingen strategisch. Stuur niet elke beurt volledige transcripts; houd een compacte “lessons”-memory bij en werk alleen die bij.
Een eenvoudige router blueprint
- Classificeer intent en geschatte complexiteit met
claude-haiku-4-5. - Stuur “normaal hard” werk naar
claude-sonnet-5(ofclaude-opus-4-8wanneer je zwaardere agentic coding verwacht). - Escaleren naar
claude-fable-5alleen wanneer de taak duidelijk lange-horizon is of op lagere tiers is mislukt. - Als Fable 5 weigert via safety classifiers, val terug op Opus 4.8 (de API ondersteunt opnieuw afvuren met fallbacks wanneer geconfigureerd).