这是长篇深入探讨。如需更快、略读的版本,请参阅 同伴博客文章.
1.简介:一个新的能力层,而不是另一个点发布
2026 年 6 月 9 日,Anthropic 发货 克劳德寓言5 — 新的第一个普遍可用的模型 神话级 在 Claude 系列中,该级别位于 Opus 4.8 之上。这不是一次例行的基准测试。这是 Anthropic 之前认为过于强大而无法不受限制访问的功能的公开发布,于 2026 年 4 月预览为 克劳德神话预览 下 玻璃翼计划 并仅限于经过审查的网络防御者和关键基础设施运营商。
经过数月的安全工作以及围绕透明度的明显社区压力,Anthropic 向 Pro、Max、Team 和 Enterprise 订阅者以及任何拥有 API 密钥的开发人员提供《神鬼寓言 5》。型号 ID 是 claude-fable-5。定价为每百万个输入代币 10 美元,每百万个输出代币 50 美元,具有 1M 代币上下文窗口和每个请求最多 128K 个输出代币。
本文解释了什么是《神鬼寓言 5》、社区的反应、哪些 YouTube 评论值得您花时间、该模型何时获得其价格标签,以及如何在运行长期代理时控制代币支出。它是为工程主管、平台团队和构建者编写的,旨在将 Claude 集成到生产工作流程中——不是作为供应商营销,而是作为从发布窗口到 2026 年 7 月的实用指南。
2.《克劳德寓言5》是什么?
2.1 神话级:Opus 之上的一层
Anthropic 现在在速度、价格和功能方面对模型进行定位:
| 型号 | API ID | 最适合 | 背景 |
|---|---|---|---|
| 克劳德寓言5 | claude-fable-5 | 长期代理,最难解决的问题 | 100 万个代币 |
| 克劳德作品 4.8 | claude-opus-4-8 | 复杂的代理编码,企业工作 | 200K 代币 |
| 克劳德十四行诗 5 | claude-sonnet-5 | 最佳速度/智力平衡 | 128K 代币 |
| 克劳德俳句 4.5 | claude-haiku-4-5-20251001 | 快速、近前沿的情报 | 64K 代币 |
Fable 5 是 Anthropic 对先前模型的特定故障模式的回答: 需要持续自主的任务 — 在大型代码库中收集上下文、构建、自我验证、委派子代理,并持续几个小时而不会丢失线程。 Anthropic 将其描述为彻底、积极主动,并且倾向于测试自己的工作。
2.2 寓言 5 与神话 5
克劳德神话5 (claude-mythos-5)与《神鬼寓言 5》的权重和定价相同,但只能通过 Project Glasswing 向批准的合作伙伴提供——主要是网络防御者、关键基础设施运营商和精选的生物医学研究人员。差别不在于能力,而在于能力。是的 访问策略和安全架构.
Fable 5 包含安全分类器,可以拒绝涉及攻击性网络安全技术、敏感生物学和生命科学内容或提取模型总结思维的请求。触发后,可能会返回响应 stop_reason: "refusal" 或自动回退到 Claude Opus 4.8。 Anthropic 指出,这些回退发生在不到 5% 的会话中。对于那些工作真正需要在这些领域不受限制的前沿访问的组织,神话 5 忽略了这些分类器。
2.3 基准和能力声明
Anthropic 将《神鬼寓言 5》定位为软件工程、知识工作、视觉和科学研究领域最先进的作品,但有一个重要的警告: 它的领先优势随着任务长度和复杂性的增加而增加。社区测试人员和发布周 YouTube 评论一致强调:
- SWE-bench Pro: 在现实世界的软件工程任务上大大超越了 GPT-5.5 和之前的 Claude 模型。
- OSWorld /代理环境: 在多步骤计算机使用基准测试中取得了优异的成绩。
- 长视野编码: 之前需要在 Opus 上进行数天迭代的系统的首次实现。
- 愿景: 改进了对密集技术屏幕截图、UI 和噪声图像的解释——通常比 Opus 具有更少的输出标记。
- 代码审查: 跨存储库和 git 历史记录的更高错误查找召回率(在分类器覆盖的网络安全域之外)。
将标题基准数字视为方向性的。你的工作量、及时的脚手架和努力设置比排行榜上的任何一行都更重要。
3. 社区反应:兴奋、震惊、护栏强烈反对
3.1 建设者的评价
从业者的早期反应分为三个阵营:
- “终于——结束了。” 运行 Claude Code 和自定义代理工具的开发人员报告称,《神鬼寓言 5》能够维持数小时的运行,并且指令保留率比 Opus 更好。西蒙·威利森(Simon Willison)的发布说明很好地抓住了这种紧张局势:缓慢且昂贵,但它不断致力于解决阻碍其他模型的问题。黑客新闻主题从“另一种模型发布”转向“当自主编码代理广泛可用时会发生什么?”
- “最佳型号,但价格不适合我的工作流程。” 在 Fable 5、Opus 4.8 和 GPT-5.5 上重建相同应用程序的独立 API 测试人员经常将 Fable 5 的质量排名第一,但质疑这种溢价对于日常驱动程序编码是否合理——尤其是在 Opus 充分处理任务的中等工作量时。
- “我不知道我在和哪个模特说话。” 护栏争议。当敏感查询在没有明确披露的情况下悄悄路由到 Opus 4.8 时,研究人员和开发人员抱怨道。 Wired、The Verge 和 Business Insider 报道了 Anthropic 随后的调整。集成商的教训: UI 和日志中显示回退事件 — 支付前沿价格的用户应该知道。
3.2 YouTube 报道:信号与噪声
发布周制作了数十个《神鬼寓言 5》视频。缩略图最高级(“有史以来最伟大的人工智能”、“可怕的”)正在营销。有用信号位于 任务轨迹:多小时运行、并排比较、成本核算和诚实的故障模式。
| 视频 | 创作者聚焦 | 寻找什么 |
|---|---|---|
| 克劳德寓言 7 分钟 5 | 发布摘要 | 基准概述、神话预览比较、定价背景。 |
| 克劳德寓言5太棒了! (经过充分测试) | 广泛的功能演示 | 编码、3D/WebGL、物理模拟、视觉、代理工作流程——最广泛的测试面。 |
| 克劳德寓言5刚下架我无语了 | 克劳德代码代理模式 | 目标循环, /loop 每小时检查,线性积分——如何在自主循环中思考。 |
| 《神鬼寓言 5》与《Opus》——不要浪费积分 | 头对头比较 | UI 重建、3D 游戏创建、文档分析——第一印象质量差距。 |
| 我花了 200 美元测试《神鬼寓言 5》 | 成本质量经济学 | 同一应用 × 三种型号;努力程度;与真实支出数据的“最佳≠最佳价值”论点。 |
| 克劳德寓言 5 的氛围编码 | 直播码流 | 单个 HTML 文件中的 FPS,真实代码库的性能审查 — vivi-check 现实。 |
| 如何正确使用《神鬼寓言 5》 | 官方提示模式 | 努力拨号、精益提示、并行子代理——从 Anthropic 的文档中提炼出来。 |
如何批判性地观看: 请注意所使用的工作量设置,审阅者是否显示代币/信用支出,任务是一次性的还是迭代的,以及“胜利”是视觉上的美化还是功能上的正确性。生成更漂亮的登陆页面但在边缘情况下中断的模型与通过测试套件的模型是不同的结果。
3.3 发布周的十个有趣的要点
- 神话预览→神鬼寓言 GA 花了大约 8 周。 对于最初被认为对于一般发布来说风险太大的 Tier Anthropic 来说,从有限预览到受保护的公开发布的弧度异常快。
- 《神鬼寓言 5》并不是 Opus 的直接升级。 迁移提示并保持不变的团队经常表示失望。 《神鬼寓言 5》需要更精简的说明和不同的安全带超时。
- 努力是主要的成本杠杆。 《Medium Fable 5》经常以极高的价格击败 Opus,这一违反直觉的发现改变了路由经济性。
- 输出代币是预算杀手。 在 50 美元/MTok 输出与 10 美元/MTok 输入相比,长的代理独白和无限制的摘要主导了支出。
- 并行子代理是一流的模式。 《神鬼寓言 5》比之前的模型更容易派遣子代理;阻挡安全带将能力留在桌面上。
- 内存文件胜过聊天记录。 每个 Markdown 笔记一节课,更新而不重复,优于重新粘贴成绩单。
- “展示你的想法”会适得其反。 推理提取指令可能会引发拒绝和 Opus 回退——请使用结构化思维模块。
- 护栏透明度成为一个产品问题。 无声的模式切换比明确的拒绝更快地侵蚀信任。
- 订阅经济正在发生变化。 API 定价的前沿模型可能标志着神话级情报的大量补贴统一费率访问的结束。
- 长期的任务差距才是真实的情况。 基准很重要;改变行为的是那些通宵运行并且仍然记得目标的智能体。
4. 何时使用《神鬼寓言 5》——以及何时转向其他地方
4.1 任务矩阵
| 工作量 | 推荐型号 | 基本原理 |
|---|---|---|
| 多天代码库迁移 | 寓言5 (高/x高) | 持续自治、跨回购上下文、自我验证 |
| 过夜代理并使用工具 | 寓言5 (高) | 长转弯、平行子代理、指令保留 |
| 不明确的产品规格 → 实施 | 寓言5 (高) | 界定范围、澄清问题、端到端交付 |
| 跨 monorepo 的深入代码审查 | 寓言5 (中-高) | 更高的错误查找召回率、大上下文 |
| 财务模型/长企业文档 | 寓言5 (中-高) | 专业级输出,范围纪律 |
| 标准功能 PR(范围广泛) | 作品 4.8(高) | 以大约一半的成本获得接近同等的质量 |
| 日常编码助理 | 十四行诗 5 或作品 4.8 | 延迟、成本,对于大多数 PR 来说已经足够了 |
| 分类/路由/分诊 | 俳句 4.5 | 最便宜;仅升级疑难案件 |
| 亚秒级聊天用户体验 | 十四行诗 5 或俳句 4.5 | 《神鬼寓言 5》在困难任务上的速度相对较慢 |
| 使用模式进行大容量提取 | 十四行诗 5 或俳句 4.5 | 确定性任务不需要神话级推理 |
4.2 努力程度:每个人都忽略的刻度盘
在 API 上, 努力 是交易情报、延迟和成本的主要控制。存在四个级别: low, medium, high, 和 xhigh.
- 高 — 大多数值得运行的《神鬼寓言 5》任务的默认设置。
- 高 - 能力敏感的工作负载,其中成本对于正确性来说是次要的。
- 中等 ——日常工作;经常以超高的价格与 Opus 比赛。
- 低的 — 快速来回;仍然经常超过前一代的最大努力。
Anthropic 的指导和社区测试集中在一条规则上: 不要将一切都默认为最大努力。在简单任务上投入大量精力时,《神鬼寓言 5》可能会过度收集背景、过度计划和过度解释——在没有成比例质量增益的情况下销毁输出代币。如果中等难度的《神鬼寓言》呼叫符合你的质量标准,那么 xhigh 呼叫就是浪费。
4.3 实用的升级路由器
生产团队受益于三层路由器:
- 俳句 对意图和复杂性进行分类(便宜、快速)。
- 十四行诗或作品 处理大部分编码、起草和分析工作。
- 寓言5 仅在以下情况下才参与:(a) 任务在 Opus 上失败两次,(b) 预计持续时间超过两个小时的人力,(c) 工作流程明确是长期代理的,或 (d) 跨存储库上下文超出 Opus 的窗口。
日志升级原因。一个月后,大多数团队发现《神鬼寓言 5》应该满足 5-15% 的请求,而不是 50%。
5. 使用神鬼寓言5时如何保存代币
《神鬼寓言 5》的定价不对称——输出比输入贵五倍——使得代币纪律在代理工作负载上存在。如果该工具不限制冗长程度,那么一次夜间运行可能会消耗数百万个输出令牌。
5.1 减少输入令牌
- 提示缓存。 Fable 5 支持 Anthropic 的提示缓存,缓存输入前缀可享受高达 90% 的折扣。缓存您的系统提示、工具定义和稳定上下文。这是针对多轮代理的单一最高投资回报率优化。
- 精益系统提示。 为 Opus 编写的审核技巧和说明。 《神鬼寓言 5》通常在较短、意图驱动的提示下表现更好。删除模型默认已处理的行为枚举。
- 记忆文件胜过文字记录。 维持一个
lessons.md(或每个主题的注释)《神鬼寓言 5》在运行后更新。引用它而不是重新发送完整的聊天历史记录。 Anthropic 推荐的模式:每个文件一课,顶部一行摘要,更新不重复,删除错误注释。 - RAG 具有紧密的检索能力。 当基于文档时,只检索相关的块——而不是整个 wiki。 1M 上下文窗口并不是要填充它。
- 具有范围上下文的并行子代理。 每个子代理仅接收其所需的文件和指令,而不是一个线程累积所有内容。
5.2 减少输出代币
- 套装
max_tokens故意的。 无限生成是获得惊喜发票的最快途径。 - TLDR优先的说明。 Anthropic 建议:“以结果为主导。你的第一句话应该回答发生了什么或你发现了什么。随后是支持细节。”
- 不要在回复中要求推理。 在用户可见的文本中显示“一步一步解释你的想法”的提示可以触发
reasoning_extraction拒绝。阅读结构化thinking相反,会阻碍适应性思维。 - 使用一个
send_to_user工具。 对于长异步代理,客户端工具会逐字提供进度更新,而不会结束轮次 - 避免在主响应流中重复完整摘要。 - 限制范围蔓延。 添加:“不要添加功能、重构或引入超出任务所需的抽象。错误修复不需要周围的清理。”
- 单独的验证者子代理。 每隔一段时间检查工作的新上下文验证器会击败生成冗余分析文本的自我批评循环。
5.3 线束级别优化
- 异步、非阻塞架构。 《神鬼寓言 5》开启困难任务后可以运行很多分钟。阻止客户端重试和重复上下文。使用 Webhooks、轮询或作业队列。
- 隐藏上下文预算倒计时。 将“剩余令牌”呈现给模型可能会触发过早的汇总和移交要约。如果您必须显示预算,请添加保证:“您还有足够的背景信息。继续工作。”
- 通过明确的后备处理拒绝。 配置服务器端回退到 Opus 4.8
stop_reason: "refusal"— 但记录下来并考虑 Opus 是否可以比重试 Fable 更便宜地完成任务。 - 自主模式说明。 对于无人值守的管道:“用户无法在任务中回答问题。对于原始请求之后的可逆操作,无需询问即可继续。”
5.4 粗略的成本心智模型
假设代理运行生成 200K 输入令牌(缓存命中率为 80%)和 50K 输出令牌:
- 未缓存的输入:40K × $10/MTok = $0.40
- 缓存输入:160K × $1/MTok = $0.16
- 产出:50K × $50/MTok = $2.50
- 总计:每次运行约 3.06 美元
如果没有缓存和详细输出,相同的运行很容易超过 15 美元。每天运行 100 次,这就是订单项和预算危机之间的区别。
6. 提示寓言 5:重要的模式
Anthropic 发表了专门的 克劳德寓言5的提示 指导。对生产影响最大的模式:
6.1 从难度范围的顶部开始
在简单的工作负载上测试《神鬼寓言 5》并没有充分发挥它的作用。选择一个任务 更难 比你分配给 Opus 的任务更重要的是——让 Fable 界定它的范围,提出澄清问题,然后执行。这就是等级差距出现的地方。
6.2 给出意图,而不是详尽的规则
指令遵循得到了足够的改进,简短的指导胜过了冗长的枚举。简短附录示例:
Lead with the outcome. Be selective about what you include — drop details
that don't change what the reader would do next. If you've been working
for a while without the user watching, your final message is their first
look at any of it: outcome first, then what you need from them.
6.3 仅在必要时设置检查点
Pause for the user only when the work genuinely requires them: a destructive
or irreversible action, a real scope change, or input only they can provide.
6.4 地面进度声明
Before reporting progress, audit each claim against a tool result from this
session. Only report work you can point to evidence for.
6.5 明确的国家边界
When the user is describing a problem rather than requesting a change,
the deliverable is your assessment. Report findings and stop. Don't apply
a fix until they ask for one.
7. 集成清单
- 模型字符串:
claude-fable-5(基岩:anthropic.claude-fable-5-3;顶点:claude-fable-5). - 超时: 延长高/超高工作量的客户端超时 - 分钟,而不是秒。
- 流媒体: 为长时间运行启用带有进度 UI 的流式传输。
- 拒绝处理: 检测
stop_reason: "refusal";配置 Opus 4.8 后备;记录并呈现给用户。 - 仅适应性思维: 《神鬼寓言 5》使用适应性思维——没有扩展的思维预算。从结构化块中读取思维,而不是响应文本。
- 数据保留: 30 天强制保留(涵盖模型)——纳入合规审查的因素。
- 提示缓存: 在稳定前缀上实施缓存断点。
- 努力参数: 暴露你的内部工具的努力;默认为
high, 不xhigh. - 子代理线束: 支持具有范围上下文的并行异步子代理。
- 成本仪表板: 跟踪每个模型层的输入与输出标记;关于神鬼寓言 5 支出异常的警报。
8. 反模式
- 在每次 Claude Code 会话中使用《神鬼寓言 5》 — 在 Sonnet 几秒钟内完成的任务上燃烧积分。
- 逐字迁移 Opus 技能 — 过度规范的提示常常会降低《神鬼寓言 5》的输出质量。
- 默认最大努力 — 付出高昂的延迟和成本,但日常工作的质量却没有成比例。
- 忽略拒绝/回退事件 ——你可能在不知情的情况下为 Opus 的回复支付了 Fable 的价格。
- 依次阻止子代理 - 将并行化增益留在桌面上。
- 重新粘贴完整聊天记录 ——使用内存文件;缓存稳定的前缀。
- 仅根据玩具提示进行测试 — 《神鬼寓言 5》的价值体现在需要持续数小时、使用多种工具的工作负载上。
9. 结论
《克劳德寓言 5》是 Anthropic 的赌注,即有用人工智能的下一个前沿不是更快的聊天,而是 持续工作数小时和数天的代理。社区的反应证实了该功能是真实的:基准测试、长期编码演示甚至给持怀疑态度的审阅者留下了深刻的印象,以及循环和目标而不是单一提示的新思维模型。
摩擦同样真实存在:双重 Opus 定价、惩罚冗长代理的输出代币经济学、护栏透明度争议,以及发现《神鬼寓言 5》是一种不同的工具,而不是一个响亮的 Opus。获胜的团队将智能地制定路线(俳句 → 十四行诗/作品 → 寓言),调整工作量而不是最大化工作量,实施即时缓存和精益提示,并为实际需要的问题保留神话级智能。
观看 YouTube 评论以获取任务跟踪,而不是缩略图。在第一次生产迁移之前,请阅读 Anthropic 的提示指南。如果你还没有在 Opus 上失败过——你可能还不需要《神鬼寓言 5》。
同伴 博客文章 是与您的团队分享的五分钟版本。这篇文章是参考。
发布者: 工作站 (workstation.co.uk)。官方文档: anthropic.com/claude/寓言 · 克劳德寓言 5 简介.
本文的 SEO 快照
- 搜索引擎优化标题: 克劳德寓言 5 指南:何时使用、代币节省、社区反应
- 元描述: Claude Fable 5 解释了:神话级功能、用户反应、流行的 YouTube 评论、何时使用 Fable 与 Opus/Sonnet,以及如何在长期代理上节省代币。
- 主要关键词: 克劳德寓言 5、克劳德寓言 5、神话类、人类寓言 5、寓言 5 代币节省、克劳德寓言 5 与 Opus、代理编码
- 推特/X: 《克劳德寓言 5》已上线 — 神话级、100 万上下文,专为长达数天的代理工作而打造。我们编写了指南:何时使用、如何保存代币、社区反应以及值得关注的 YouTube 评论。 #ClaudeFable5 #AIagents
- 领英: Anthropic 的 Claude Fable 5 是首款普遍可用的 Mythos 级型号,而社区则分为“有史以来最好的型号”和“最佳型号,日常使用的价格错误”。我们发表了一篇深入研究文章,涵盖任务路由、努力水平、代币经济、护栏反弹以及带有实际信号的 YouTube 评论。来自工作站。
