Claude Mythos 5定价与生产环境权衡

Claude Mythos 5与Fable 5采用高级API定价。了解成本权衡、访问限制,以及开发者何时应将任务路由到其他地方。

By WaveSpeedAI 4 min read

这篇文章本来是定价分析,写着写着变成了采购分析。不管怎样,以下是我的预算建议。

上周我想把一个长时间运行的 agent 任务路由到 Fable 5,结果收到了一个报错。不是限速,也不是计费墙。这个模型就这么……消失了。Fable 5 和 Mythos 5 在两天前(6 月 12 日)就因美国政府的出口管制指令,对所有用户全面下线。所以,在我告诉你任何关于 Claude Mythos 5 定价的内容之前,我必须先说一件标价不会告诉你的事:截至 2026 年 6 月中旬,你实际上根本无法购买到运行它的权限。这一点会影响你看待下文每一个数字的方式。

这是一篇成本分析文章,但也是一次现实核查。我会给出每 token 的费率、Fable 与 Mythos 的区别、与 Opus 4.8 的对比,以及防止前沿模型费用吞噬你整月预算的生产控制手段。我也会告诉你这些计算何时失效。因为现在,其中有相当一部分确实失效了。

30 秒版本

如果你只看这一段,以下是关键决策信息:

  • Fable 5 和 Mythos 5 的标价:输入 $10/百万 token,输出 $50/百万 token。 费率相同。名称差异关乎安全机制,与成本无关。
  • 这恰好是 Claude Opus 4.8 的 2 倍($5 / $25)。输出是贵的那一半——是输入费率的 5 倍——所以响应长度对账单的影响比提示词大小更大。
  • Mythos 5 从来就不是随便可以购买的模型。 它仅对 Project Glasswing 合作伙伴开放。Fable 5 才是面向公众的版本。
  • 而自 2026 年 6 月 12 日起,两者均已对所有用户暂停服务,等待政府指令。Opus 4.8 及以下模型不受影响。

因此,对于”Claude Mythos 5 多少钱”,诚实的答案分两部分:费率是 $10/$50,访问权限目前为零。只有在你准备好接受恢复日期可能一再推迟的情况下,才将这个模型纳入预算。

Claude Mythos 5 定价的实际含义

Fable 5 和 Mythos 5 的官方定价

Anthropic 对两款 Mythos 级别模型的定价完全相同。根据官方发布公告,两款模型的定价均为输入 $10/百万 token,输出 $50/百万 token,开发者可通过 Claude API 使用 claude-fable-5。模型 ID 分别为 claude-fable-5claude-mythos-5

有一个对预算规划很重要的细节:输入端享有现有的提示缓存折扣。根据 Fable 产品页面,Claude Fable 5 的定价为输入 $10/百万 token、输出 $50/百万 token,同时对提示缓存的输入 token 提供 90% 折扣,美国本地推理可享受输入和输出各 1.1 倍的定价。如果你大量复用静态上下文——系统提示词、检索文档、工具 schema——缓存在这里能发挥真实效果。下文会详细展开。

与 Mythos Preview 定价的对比

$10/$50 的费率实际上是降价后的结果。最初的受限前沿版本 Claude Mythos Preview 的价格要高得多。Anthropic 将新费率定位为 Claude Mythos Preview 价格的不到一半,据报道 Preview 版本的价格约为 $25/$125 每百万 token。所以趋势线才是值得关注的部分——随着算力规模扩大,前沿级推理正在变得越来越便宜,而非越来越贵。这才是正确的外推方向。具体数字你应该视为临时值,因为它已经变动过一次了。

为什么访问状态改变了定价问题的性质

这就是我不得不打破”给出费率,去构建吧”这一常规节奏的地方。Mythos 5 从一开始就是受限模型,通过 Project Glasswing 部署。Claude Mythos 5 仅限 Glasswing 合作伙伴使用,在部分领域解除了安全限制,并将很快向特定生物学研究人员开放,直到更广泛的可信访问计划上线。如果你不是美国政府网络防御机构或经批准的生物医学研究机构,Mythos 5 根本不会出现在你的控制台里。你实际能运行的是 Fable 5。

然后两者都被下线了。6 月 12 日,Anthropic 声明美国政府发布了出口管制指令,要求暂停所有境外人员对 Fable 5 和 Mythos 5 的访问,净效果是必须对所有用户禁用访问,而对 Anthropic 所有其他模型的访问不受影响。Anthropic 表示不同意该指令,并正在努力恢复访问。我不知道何时能恢复,除了室内当事人,没有人知道。所以:价格是真实的,访问权限不是——今天如此。

定价 vs 实际工作负载成本

标价是规划中最没用的数字。你实际支付的是费率 × token 数量,而在 Mythos 级别的模型上,token 数量的表现与小模型不同。Fable 5 是为长时程任务构建的——那种运行数小时并产生大量输出的任务。这恰恰是 5 倍输出乘数会复利累积的场景。一个在纸面上”只有”Opus 2 倍价格的模型,如果你的任务是输出密集型且不加约束地运行,发票上可能会是 3-4 倍。

另一面:Anthropic 和早期用户报告 Fable 5 在困难推理上更具 token 效率。一位合作伙伴表示,Fable 5 在 36 小时内完成了一项前沿物理研究任务,仅用了 GPT-5.5 花四天时间才能匹敌所需推理 token 的三分之一。如果你确实用更少的 token 达到了相同结果,实际成本差距就会缩小甚至逆转。这种效率体现在复杂的多步骤推理上,而非简短查询——所以投资回报率是任务形态决定的,并非一概而论。

Fable 5 vs Mythos 5:成本现实

标价相同,访问模型不同

我直说吧,因为命名确实容易混淆:Fable 5 和 Mythos 5 是同一个底层模型,价格相同。Anthropic 自己的表述是,Mythos 5 与 Fable 5 是同一模型,只是在某些领域解除了安全限制。区别在于安全分类器,不是能力层级,也不是价格层级。所以”哪个更便宜”是错误的问题。根本没有更便宜的那个。

为什么大多数团队会先评估 Fable 5

对于任何非 Glasswing 合作伙伴来说,这个选择从来就不是真正的选择——Fable 5 是唯一的入口。关于 Fable 成本行为,需要理解的是其回退机制,Fable 5 API 文档为集成说明了这一点。当其分类器标记某个请求时,响应会自动由 Claude Opus 4.8 处理,超过 95% 的 Fable 会话完全不触发回退。分类器平均在不到 5% 的会话中触发。

这对你的账单意味着什么?发生回退时,你支付的是 Opus 4.8 响应的费用,而非 Fable 的——并且你会被告知。对大多数工作负载来说,混合效果很小。但如果你的领域涉及网络安全、生物学或化学,你会更频繁地触发回退,你的实际模型——以及实际价格——会在你没有主动选择的情况下向 Opus 靠拢。这是一个规划输入,不是什么陷阱。

受限访问与采购摩擦

还有一项成本不会出现在任何费率卡上:30 天数据保留要求。Anthropic 现在要求在 Mythos 级别模型的所有流量上保留 30 天数据,无论是第一方还是第三方平台,且不会将数据用于模型训练或任何非安全目的。对于某些受监管的买家,这本身就是一场采购对话。不是一个金额,但在”我们能否使用这个”一栏中是真实存在的条目。结合当前的暂停状态,Mythos 级别的采购故事目前确实处于悬而未决的状态。我不会在 Q3 计划中写入它,除非同一句话里也提到了备用模型。

与 Opus 4.8 的成本对比

这是实际决定大多数路由的对比,以下是我常开着的那张表。

模型输入 / 百万输出 / 百万相对于 Opus 4.8访问状态(2026 年 6 月中旬)
Claude Opus 4.8$5$25基准可用
Claude Opus 4.8 (Fast)$10$502 倍(速度,非能力)可用
Claude Fable 5$10$502 倍已暂停
Claude Mythos 5$10$502 倍受限 + 已暂停

Opus 4.8 定价已确认为标准模式输入 $5/百万 token,输出 $25/百万 token,快速模式 $10 和 $50,输出速度约快 2.5 倍。值得注意的是:Opus 4.8 快速模式的标价与 Fable 5 完全相同,都是 $10/$50。所以如果你选择超越 Opus 的原因是延迟而非原始能力,快速模式能以相同价格满足你,完全不需要 Mythos 级别的模型。

Opus 4.8 仍然足够的场景

大多数时候。我是认真的。Opus 4.8 本身就是一个强大的模型——Anthropic 报告称,它比前代产品允许自己编写的代码存在缺陷而不加标记的可能性低约四倍,在 Online-Mind2Web 上得分 84%,是首个在 Legal Agent Benchmark 全通过标准上突破 10% 的模型。对于起草、标准编码、分析、大多数 agent 循环——你不会感觉到天花板的存在。而且它是 Fable 一半的价格,今天就能实际购买,这在眼下并非小事。

Fable 5 值得溢价的场景

溢价在最长、最难、最多步骤的任务上才能收回——Anthropic 表示,任务越长越复杂,Fable 5 相对其他模型的优势就越大。Stripe 报告称,Fable 5 将数月的工程工作压缩到几天内完成,在一个 5000 万行 Ruby 代码库中,一天内完成了一项原本需要一个团队两个多月才能完成的全代码库迁移。如果任务就是这种形态——长时程、模糊、高价值——那么支付 2 倍 token 价格、在极短时间内完成任务,显然是值得的。2 倍的标价相对于它所替代的人力成本,不过是噪音。

为什么输出密集型工作负载会改变投资回报率

驱动账单最关键的杠杆不是输入费率——而是输出长度,因为在这些模型上,输出的成本是输入的 5 倍。一个直白的成本分析这样说:输出 token 的成本是输入 token 的五倍,所以 Claude 响应的长度决定了你的账单,而不是你的提示词大小。一个长时间运行的 Fable 任务,在数小时内产生冗长的中间推理过程,可能悄然成为你最贵的那一行。这正是下一节存在的原因。

生产成本控制

如果你确实重新获得了访问权限,并将真实工作负载路由到 Mythos 级别的模型,以下是最重要的调节手段。它们在 Opus 4.8 上同样适用——同一家族,相同的控制。

努力参数与任务预算

努力参数是最大的单一成本杠杆。对更简单的任务降低努力级别,将最大努力保留给真正需要的工作。这个模型家族的标准建议:对简单任务降低努力级别,缓存重复提示内容,批量处理非紧急任务,并将 max_tokens 控制在较小范围内。设置严格的 max_tokens 是你能买到的最便宜的对抗失控响应的保险。在上线前做好,而不是收到账单后才想起来。

回退和重试行为

有两种回退行为需要纳入规划。第一,我之前提到的自动回退到 Opus 4.8——这是自动的,你会被告知。第二,你自己的重试逻辑。一个对失败步骤重试三次的长时程 agent,会为三次运行付费。在一个运行数小时的 $50/百万输出模型上,糟糕的重试策略才是预算真正死亡的地方。限制重试次数,记录每次运行的 token 消耗,并对异常值设置告警。Anthropic 对动态 agent 工作流的告诫值得引用:一个错误配置的计划生成了 500 个子 agent 而非 50 个,就是 10 倍的成本峰值,所以在生产环境中启用动态工作流之前,先在你的框架中设置预算限制。

按任务价值和风险级别路由

这部分是我真正信奉的。不要默认将所有请求发给最有能力的模型。按任务的价值和运行成本来路由:

  • 成本低、任务简单、量大 → Opus 4.8 或更小的模型,低努力级别。永远不要用 Mythos 级别的模型。
  • 对延迟敏感但能力要求不高 → Opus 4.8 快速模式(与 Fable 相同的 $10/$50,但当前可用)。
  • 真正的前沿任务——长时程、模糊、高价值 → Fable 5,等到恢复时,最大努力,附带预算上限。

你选择的模型应该是任务的函数,而不是一种习惯。默认选择菜单顶端是你最终要向某人解释为什么 2 倍模型产生了 4 倍账单的原因。

常见问题

Claude Mythos 5 多少钱? 输入 $10/百万 token,输出 $50/百万 token——与 Claude Fable 5 相同。但 Mythos 5 是受限访问模型(仅限 Project Glasswing 合作伙伴),且自 2026 年 6 月 12 日起,它和 Fable 5 因政府指令对所有用户暂停服务。所以费率是确定的;访问权限,目前,不是。在做预算之前,请始终核对 Anthropic 官方定价页面,因为这一情况仍在变动中。

Claude Fable 5 和 Mythos 5 定价相同吗? 是的,完全相同:$10/$50 每百万 token。它们是同一个底层模型。区别在于安全机制——Fable 5 带有面向通用场景的安全分类器;Mythos 5 为经审核的合作伙伴解除了部分限制。能力相同,价格相同,访问方式和风险状况不同。

为什么 Fable 5 在长时间运行的任务中会变得昂贵? 因为输出 token 的成本是输入的 5 倍,而 Fable 5 正是为那些运行数小时、产生大量输出的任务构建的。一个带有冗长推理过程的长 agent 循环,加上重试,会让你的输出花费迅速倍增。2 倍于 Opus 的标价在输出密集型工作上低估了实际差距。限制 max_tokens,控制努力级别,关注重试行为。

什么时候应该用 Opus 4.8 而不是 Fable 5? 说实话,大多数时候。Opus 4.8 价格是一半($5/$25),现在完全可用,对于大多数编码、分析和 agent 任务来说已经足够强大。只有当任务确实是长时程、高价值到足以让更快完成值得支付 2 倍 token 费用时,才选择超越它——而如果你只是需要速度,Opus 4.8 快速模式能达到 Fable 的价格点($10/$50),同时保持可用状态。

那么,现在该怎么办?

你来这里想找的数字是 $10/$50 每百万 token,Mythos 5 和 Fable 5 相同,是 Opus 4.8 的 2 倍。这部分很简单。真正决定你是否基于它构建的,是访问权限——而现在访问权限已暂停,没有确定的恢复日期。我的判断:把 Mythos 级别视为你为之设计但目前不依赖的模型。以 Opus 4.8 作为你的工作默认值,构建你的路由,让前沿模型成为可随时替换的组件而非基础,并无论哪个模型响应,都保持预算上限。

当访问恢复时,成本问题就变成了上文勾勒的路由问题——按任务的价值和风险,而不是”默认选最强大的”。在那之前,我建议把生产负载指向你实际能调用的东西。在承诺一个 token 之前,请亲自查阅 Anthropic 的模型概览文档Fable 与 Mythos 暂停声明——这件事还在变动中。

数字已根据 Anthropic 截至 2026 年 6 月 13 日的官方公告核实。访问状态尤其处于变化中;做预算前请先确认。

往期文章: