Claude Fable 5

Anthropic 于 2026 年 6 月 9 日发布的首个公开 Mythos-class 模型,Anthropic 在 Opus 之上新增的等级,定位于超长时间自主运行与复杂系统编排。

Source: 2026-07-04-x-x-com-0xcodez-status-2065089060104720776-s-46(来源未公开)

发布背景

  • Mythos-class:Fable 5 是第一个公开可用的 Mythos 级别模型。Mythos Preview(代号 Glasswing)已于 2026 年 4 月向少数关键基础设施合作伙伴内测;Fable 5 是 Anthropic 认为可安全公开发布的版本,内置高风险领域(网络安全、生物、化学)安全分类器。Mythos 5(无分类器版本)仍仅限于 Glasswing 项目。
  • 定价:输入 50/M tokens;Prompt Caching 享有 90% 输入 Token 折扣。
  • 可用平台:Claude API、AWS、Amazon Bedrock、Vertex AI、Microsoft Foundry 及企业按用量计费方案。

核心能力

  • Days-long 自主运行:在 Claude Code 或 Claude Managed Agents (CMA) 的 Harness 中,Fable 5 可以跨阶段规划、委派子智能体并自我检查,连续工作数日。
  • 自我验证 (Self-verification):自动为自身工作编写测试;使用视觉能力将输出与目标对比;将经验提炼为通用规则;主动验证自身假设。
  • 大规模代码工程:大型代码迁移、复杂实现、多日自主编程会话。Anthropic 官方定位:“移交大型项目,审查完成的可交付物”。
  • 多阶段知识工作:从深度研究到可交付成果,支持极低监督下的全流程自主完成。

注意:自我改进 ≠ 自我学习

  • 自我学习(不支持):模型根据运行经验更新自身权重。Fable 5 不支持,任何当前公开可用模型均不支持。
  • 自我改进(支持):系统环境随运行积累而复合增益——每次会话将经验写入记忆,Skills 随边缘案例增加而锐化,状态文件积累已验证事实,Eval 循环精炼 Prompt 和评分标准。模型本身保持静态,运行它的环境持续变得更智能。

四层复合架构(Compound Stack)

层级名称内容
Layer 1原语 (Primitives)Fable 5 本身、子智能体、worktrees、工具调用——大多数用户停留在此层
Layer 2编排 (Orchestration)/goal 与 Outcomes 的自校正循环;Dynamic Workflows 多步编排;Routines 云端离线运行
Layer 3记忆 (Memory)状态文件、Skills、知识库、经验日志——让明天的会话延续而非重启
Layer 4自我改进 (Self-improvement)视觉自检、Eval 循环、规则蒸馏——Agent 为自身输出评分,精炼生成它的 Skill,并将经验写回 Layer 3

复合效应:Layer 1 的每次输出都流经 Layer 4 评估蒸馏,写回 Layer 3。次日 Layer 1 的运行继承昨日锐化后的记忆和 Skills。模型无状态,但系统有状态。

模型路由:成本-能力矩阵 (2026年最新多模型协同)

在 2026 年的工业级多 Agent 系统(如 Eval Ops)中,由于 GPT-5.6 Sol 的加入与 Fable 5 的高昂成本,业界普遍推行“混合模型路由”与“Manager-Worker(主管-执行者)”架构:

  • Fable 5 (顶级编排器 / Manager):扮演“智囊”与主管角色。具备顶级的创造力、设计品味与宏观战略判断(如架构顶层设计、PRD 脑暴、大纲起草)。由于 Token 消耗大且成本极高,通常仅用于跨日规划的顶级决策、委派子智能体,以及在最终阶段作为裁判(Judge)进行视觉自检与规则蒸馏。
  • GPT-5.6 Sol (硬核执行者 / Worker):扮演“突击队员”角色。其综合代码生成与执行能力略逊于 Fable 5,但显著强于 Opus 4.8 与 Sonnet 4.6。Sol 具有极高的 Token 效率且价格只有 Fable 5 的一小部分,极其擅长写单项测试、查漏补缺(扮演 devil’s advocate 进行 Bug 审查与 debug),以及运行自动化 bash 脚本进行快速交付。
  • Opus 4.8 (降级兜底):用于架构细化、复杂调试,以及在 Fable 5 触发敏感分类器拦截时的静默/显式 Fallback。
  • Sonnet 4.6 / Haiku 4.5 (极低成本评分子节点):用于 Lint 校验、文档同步和快速的小步骤 Step-level 过程打分。

最新的黄金协作范式:由 Fable 5 作为 Manager 发起 Dynamic Workflows 编排调度 ➡️ 派遣多路 GPT-5.6 Sol 节点并行执行硬核编译与交付工作 ➡️ 使用 Haiku 4.5 对中间步骤快速评分。这实现了高达数十倍的性价比放大。

Source: 2026-07-14-youtube-youtu-be-EthxaDswUFo-si-nQwfYWCzRFFtkY4g(来源未公开)

核心工作流原语

/goal vs Outcomes

两者共享相同结构:独立评分者检查工作,未通过则触发下一轮迭代,通过则退出循环。

  • /goal(Claude Code):适用于本机、会话内、有可测量终态的短循环。普通文本目标,模型评分,终端内反馈。
  • Outcomes(CMA):适用于需在 Anthropic 托管基础设施上运行数小时/数日的任务(含沙盒、GPU、受控环境)。文件化评分标准,子智能体评分,硬性 max_iterations 上限。

Verifier 子智能体优于自我批评

Anthropic 工程师实证:模型评估自身输出时会受到自身推理轨迹的干扰,倾向于偏好与已写内容一致的结论。独立模型(Verifier)仅见到输出物与评分标准,无”利益纠葛”。结论:独立 Verifier 能探索更大的假设空间,并能从负面中间结果中恢复。

Dynamic Workflows(2026年5月28日上线)

Claude 实时编写自己的 JavaScript Harness(使用 agent()、parallel()、pipeline() 原语),为任务定制编排,而非泛化框架。自我改进系统中最常用的三种模式:

  • Fan-out-and-synthesize:将工作分成 N 个独立片段并行执行,再合成结果。
  • Adversarial verification:为每个 Maker Agent 生成一个独立 Verifier,彻底隔离制造者的推理链。
  • Loop-until-done:循环生成 Agent 直至停止条件满足(无新发现、无错误、理论验证完毕);配合 /goal 设置硬性完成要求。

Worktrees 并行安全

多 Agent 并行时,每个 Agent 在独立 git worktree(独立工作目录,独立分支,共享 repo 历史)中工作,避免文件冲突——Maker 写 worktree A,Verifier 在 worktree B 中只读。

Source: 2026-06-17-x-x-com-0xcodez-status-2065089060104720776-s-46(来源未公开) | 2026-06-17-x-x-com-0xmovez-status-2065140283923128585-s-46(来源未公开)

六大 Prompting 最佳实践

Source: 2026-07-05-youtube-youtu-be-vcU85OrwuV0-si-N993d2n-fG_SwS5B(来源未公开)

来自 Anthropic 工程师和社区实践的 Fable 5 Prompting 规则,按适用范围分为通用型(Any Model)和 Fable 专有型。

努力级别(Effort Levels)

Fable 5 有四个努力级别:low / medium / high / extra-high

  • High:大多数任务的推荐默认值
  • Extra-high(X-high):最高能力要求的工作
  • Medium / Low:常规工作,降低成本
  • Fable 5 on low ≈ Opus 4.8 on X-high,但成本更低,说明合理降级能大幅提升性价比

仅需要 Fable 5 的真实比例估计在 5–15% 的任务,其余应路由至 Sonnet 或 Haiku。

通用规则(Any Model)

#规则核心要点
1给 Why,不只给 What提供意图背景,让模型将任务连接到正确信息,而不是猜测
2明确负面 Prompt(告诉它不做什么)AI 训练于海量数据,会主动”发挥创意”。明确禁止边界(“不要修复,不要发送,除非我说 go”)与告诉它要做什么同等重要
3有足够信息即可行动,停止过度规划不要要求”先研究一切,再做完整计划”。当模型有足够信息时让它行动,迭代比完美计划更有价值
4要求证明(Make It Prove It)验证循环是核心。让模型在报告”完成”之前,指向能证明结果的实际证据。未经验证的就如实说”未验证”

Fable 专有规则

#规则核心要点
5不要让 Fable 展示推理System prompt 中的 “explain your reasoning” 类指令会触发安全分类器,将任务静默路由到 Opus 4.8。避免此类要求
6说更少,不是更多Fable 5 智能度足够高,短指令能与详细指令达到相同引导效果。不是与 Tip 1 矛盾——给 Why 是必要的,但不要堆砌规则列表

静默路由到 Opus 的触发场景

当 Fable 检测到以下意图信号时,会静默地将请求路由到 Opus 4.8 处理(不通知用户):

  • 涉及黑客攻击
  • 涉及危险生物学
  • 要求模型展示其内部推理过程

通过 API 时,响应头会显示实际使用的模型;在 Claude 桌面端则无提示。路由到 Opus 4.8 的成本显著低于 Fable 5。