这是长格式参考。对于五分钟浏览版本(快速表+路由器规则),请参阅 同伴博客。
1. 为什么要比较 Claude 模型?
大多数团队不会因为他们的提示不好而赔钱。他们赔钱是因为他们在所有事情上都使用最昂贵的模型,或者因为他们将模型选择视为模糊的偏好而不是 预算产品决策。克劳德的阵容是明确分层的:它是为了让你可以匹配而构建的 任务形状 到能够很好地完成它的最小模型。
实际结果:模型选择是您可以用来改进的最简单的杠杆之一 延迟, 品质, 和 每个结果的成本 同时。
2.现代克劳德阵容(2026)
当前所有克劳德型号均支持 文本和图像输入, 多语言能力, 和 愿景,并且可以通过 Claude API、AWS、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上的 Claude 平台使用。
2.1 您真正应该关心的规格
| 型号 | API ID | 上下文窗口 | 最大输出 | 定价(输入/输出) | 思维行为 |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 (别名: claude-haiku-4-5) |
200K 代币 | 64K 代币 | 每个 MTok 1 美元/5 美元 | 可用扩展思维(自适应关闭) |
| Claude Sonnet 5 | claude-sonnet-5 |
100 万个代币 | 128K 代币 | 每个 MTok 3 美元/15 美元 | 适应性思维始终开启 |
| Claude Opus 4.8 | claude-opus-4-8 |
100 万个代币 | 128K 代币 | 每个 MTok 5 美元/25 美元 | 适应性思维始终开启 |
| Claude Fable 5 | claude-fable-5 |
100 万个代币 | 128K 代币 | 每个 MTok 10 美元/50 美元 | 适应性思维始终开启 |
Claude Mythos 5 (claude-mythos-5)是门控的,与Fable 5具有相同的规格和定价,但它配备了不同的安全架构(没有与Fable 5相同的安全分类器)。如果您没有访问权限,您仍然可以使用 Fable 5(如果可用)运行基本相同的集成逻辑。
2.2 知识截止(为什么它对“当前信息”很重要)
Anthropic 的模型概述列出了:
- 可靠的知识截止: 2026 年 1 月Fable 5 / Opus 4.8 / Sonnet 5; 2025 年 2 月Haiku 4.5。
- 训练数据截止: Fable 5 / Opus 4.8 / Sonnet 5 大致为 2026 年 1 月; 2025 年 7 月,Haiku 4.5。
实际操作:如果您需要截止后的事实,请使用 检索 (RAG) 或工具,无论模型层如何。
3. 层级在实践中的含义
3.1 延迟和输出代币现实
在整个阵容中,代币经济的差异更大 输出 比通过输入。一个简单的思考方式:
- 当您想要简短的结构化答案时,俳句是最便宜(也是最快)的。
- Opus 和 Sonnet 花费更多,但当提示有限时仍然可以很好地扩展。
- Fable 5 很昂贵,因为它适用于模型需要随着时间的推移保持在范围内的困难、长期运行。
如果您让任何模型生成无限制的文本,则输出令牌将主导支出。这就是为什么 最大输出 (或 TLDR 优先的强烈指示)对所有级别都很重要,而不仅仅是Fable 5。
3.2 适应性思维与扩展思维
Anthropic 的概览表强调了两个差异:
- Fable 5 / Opus 4.8 / Sonnet 5 始终保持适应性思维。
- Haiku 4.5 可以使用扩展思维,但适应性思维已关闭。
实践:使用俳句来完成大量任务,但请注意,它并未针对相同的长期“始终适应”行为进行优化。当您遇到模糊性或深度规划需求时,请转向十四行诗/作品/寓言。
3.3 努力作为成本质量表盘
努力是Fable 5和Mythos 5上智能、延迟和成本之间权衡的主要控制。 Opus 4.8 和Sonnet 5 还公开了API 表面上的工作量控制。
实际意义:最常见的迁移错误不是“错误提示”。这是“在任何地方都竭尽全力”。对于大多数生产工作负载,您可以通过故意分配工作量来获得最佳价值(低/中的廉价任务,较高的工作量的困难任务)。
4. 可以实施的决策矩阵
不要问“哪个模型最好?”,而要问“哪个模型可以完成 这个 使用最便宜的代币的工作流程?”
| 任务形状 | 选择 | 为什么 |
|---|---|---|
| 意图分类、路由、实体提取 | 俳句 | 快速、便宜,是高吞吐量的理想选择 |
| 日常编码帮助、文档、结构化推理 | 十四行诗 | 最佳速度/质量平衡 |
| 复杂的代理编码、企业分析、深度调试 | 作品 | 在长期、多步骤的企业任务中表现出色 |
| 长达数天的代理运行、委托多文档合成 | Fable 5 (或门控Mythos 5) | 专为长期自治和保持在范围内而设计 |
5、生产路线蓝图(廉价->智能->前沿)
这是一种实用的模式,当你有多种任务时效果很好:有些简单,有些困难,还有很多“大部分很简单,但有时很棘手”。
5.1 逐步路由器
- 用俳句分类。 确定意图和大致的复杂性;还可以估计您是否需要较长的上下文或工具使用。
- 在 Sonnet 或 Opus 上运行主路径。 适用于大多数“严肃但有限”任务的十四行诗。当您期望复杂的代理编码或更深入的调试时,Opus 是最佳选择。
- 升级到 Fable 5 以获得真正的长期工作。 示例:跨存储库重构、模型必须保持多个约束活动的多文档合成,以及委托子任务的自主运行。
- 处理后备/拒绝。 如果Fable 5因安全分类器而拒绝,请根据您的产品要求回退到Opus 4.8(或其他合适的型号)。
5.2 制定路由器预算(不要让升级毁掉节省的资金)
仅当升级很少发生时,路由器才具有成本效益。添加约束,以便昂贵的层不会膨胀:
- 在每一层设置最大输出令牌。
- 使用 TLDR 优先指令,以便模型可以在已知足够信息时尽早停止。
- 缓存稳定前缀(系统提示符和工具模式),减少重复输入成本。
6. 可以用代币经济学来进行健全性检查
由于定价是按令牌计算的,因此您可以估算每个请求的成本。使用模型概述定价值:
- Fable 5: 每个 MTok 10 美元输入/50 美元输出
- Opus 4.8: 每个 MTok 输入 5 美元/输出 25 美元
- Sonnet 5: 每个 MTok 输入 3 美元/输出 15 美元
- Haiku 4.5: 每个 MTok 1 美元输入/5 美元输出
粗略公式(代入您的估计):
cost ~= (input_tokens / 1_000_000) * input_price
+ (output_tokens / 1_000_000) * output_price
理智规则:如果输出代币很大,Fable 5很快就会成为主要成本驱动因素。这就是为什么即时结构和产出上限比许多团队预期的更重要。
7. 跨层提示模式
最有启发性的最佳实践适用于每个克劳德模型:提供明确的目标,限制输出格式,并且只询问您需要的内容。特定层级的差异体现在您如何 控制长度 和 控制努力。
7.1 防止预算泄漏的一般规则
- 以结果为主导。 你的第一行应该说明发生了什么或你发现了什么。
- 请求 TLDR 优先。 如果可以的话,让模型尽早停止。
- 范围蠕变上限。 除非有要求,否则不要要求额外的功能、重构或“最好有”的改进。
- 绑定输出长度。 使用最大输出标记或严格格式。
7.2 Fable 5换工作时
Fable 5 专为长期自治而打造:它可以长时间维持高效产出、委派子任务,并在任务真正涉及多个步骤时保持连贯性。显着的差异不仅仅是“更多的推理”。您可以(并且应该)将工作流程构建为 目标+检查点+工具驱动的证据,而不是强迫所有事情都一次性解决。
8. 示例工作流程(在哪里使用什么)
8.1 Haiku 4.5
- 对传入请求进行分类(意图 + 复杂性)并路由到正确的层。
- 将结构化字段提取为 JSON 供下游系统使用。
- 用严格的模式和最大输出上限总结短文。
8.2 Sonnet 5
- 用“什么/为什么/如何”的格式重构和解释代码。
- 以一致的语气和简短的输出起草面向客户的内容。
- 构建仍然需要速度的代理工具(工具调用+短循环)。
8.3 Opus 4.8
- 复杂的代理编码:多文件更改、更深入的调试以及更仔细的系统范围推理。
- 企业文档分析:电子表格、幻灯片和长报告。
- 在困难但有限的任务中,您仍然需要企业级答案,而不仅仅是草图。
8.4 Fable 5(和Mythos 5)
- 通过工具使用和验证步骤在存储库之间进行长达数天的代码迁移。
- 多文档综合,其中长期运行的指令保留和连贯性至关重要。
- 自主工作流程,委派子任务并在产生中间结果后继续。
9. 迁移注意事项
9.1 迁移到Opus 4.8
如果您当前使用的是 Opus 4.7 或更早版本,请从以下位置开始:
- 确保您设置
effort当您有延迟或预算要求时明确。 - 检查任何可能过于规范的提示技能。更高的能力可以放大过于具体的指令。
- 重新测试输出长度假设并在需要时应用最大输出上限。
9.2 从 Opus 迁移到 Fable 5
Fable 5 不是“更快的 Opus”。将其视为长期任务的工作流程工具:
- 转向目标+检查点结构(特别是对于代理运行)。
- 委派子任务,而不是将所有内容堆叠在一个长线程中。
- 使用缓存和有限输出,这样长时间运行就不会增加支出。
10. 常见问题
- 凡事都用寓言。 它适用于困难的、长期的情况。
- 无输出上限。 如果让俳句生成无限制的文本,即使是俳句也会变得昂贵。
- 假设上下文窗口是可互换的。 Haiku 拥有 200K 代币;其他默认为1M。
- 忽略截断差异。 如果您需要截止后信息,请使用检索/工具。
- 不是路由工作。 在任何地方设置最大努力通常会增加成本,而不会改善结果。
11. 底线
Claude 的产品线经过精心设计,您可以构建一个模型路由器,将最小的功能层与每个任务形状相匹配。从俳句开始,以实现廉价的路由和提取。使用 Sonnet 进行大部分日常工作。升级到 Opus 以进行复杂的企业和代理编码。为需要持续自主性和一致性的真正的长期运行保留Fable 5(和门控Mythos 5)。
如有疑问,请限制提示,限制输出长度,并测量每个结果的输出标记。这一指标往往使模型选择变得显而易见。
本文的 SEO 快照
- 搜索引擎优化标题: 克劳德模型比较:Haiku vs Sonnet vs Opus vs Fable 5 (Mythos 5)
- 元描述: 比较 Anthropic Claude Haiku、Sonnet、Opus、Fable 5 和门控 Mythos 5。包括规格、成本/代币策略、路由蓝图以及何时使用每一层。
- 主要关键词: Claude 模型比较、Claude Opus 4.8、Claude Fable 5、Claude Sonnet 5、Claude Haiku 4.5、Claude Mythos 5、代币预算、代理编码
- 推特/X: Claude 模型层解释道:Haiku 用于廉价路由,Sonnet 用于日常工作,Opus 用于复杂编码,Fable 5 用于长达数天的代理运行。里面有代币预算路由蓝图。
- 领英: 对 Anthropic Claude Haiku、Sonnet、Opus、Fable 5 和门控 Mythos 5 的实用且可实施的比较。规格、成本模型和控制输出代币的路由器。来自Workstation。