Claude Fable 5 API:访问、定价与使用场景

Claude Fable 5 已通过 API 正式开放。在路由工作负载之前,了解访问方式、定价、安全保障及开发者使用场景。

By Dora 2 min read

Anthropic于2026年6月9日发布了Claude Fable 5。API模型ID为claude-fable-5。过去几天我仔细研读了文档,并在几个真实工作负载上进行了测试,这篇文章是我希望在第一天就能拥有的Claude Fable 5 API访问、定价和使用场景概览。

有两点值得提前说明。这是Anthropic所称的Mythos级别中首个公开可用的模型——定价是Claude Opus 4.8的两倍,能力定位在更高一级。Claude Fable 5 API在某些特定方面的行为与早期Claude模型不同,这些差异对于生产集成至关重要。在改动任何一行代码之前,有必要先了解这些核心区别。

Claude Fable 5对开发者意味着什么

Anthropic官方公告将Anthropic Fable 5定位为首个正式可用的Mythos级模型,专为在软件工程、知识工作、视觉和科学研究领域持续执行长期自主任务而构建。这是官方说法,以下是实际含义。

具备公开安全防护的Mythos级能力

Fable 5与Claude Mythos 5使用相同的底层模型,区别在于各自能够提供的帮助范围。Mythos 5通过Project Glasswing仅向经过审核的合作伙伴开放,保留全套能力,包括高端进攻性网络安全技能。Fable 5是公开版本,运行安全分类器,将网络安全、生物学、化学和模型能力提取领域的请求转发至Claude Opus 4.8处理。

Anthropic的说法是,触发转发的会话不足5%。在这四个领域之外,两个模型的行为方式完全相同。

API模型ID与支持平台

API模型标识符为claude-fable-5。自6月9日发布起,Fable 5可通过Claude API、AWS上的Claude Platform、Amazon Bedrock、Vertex AI和Microsoft Foundry访问。Claude Code支持需要v2.1.170或更高版本——旧版本不会在模型选择器中显示Fable 5。

为何对长周期智能体工作负载至关重要

能力差距在长期、多步骤的智能体工作中体现最为明显。Anthropic的定位——以及早期基准测试数据——表明,在以小时或天为单位衡量的任务上,其持续自主性明显强于Opus 4.8。对于运行多阶段智能体框架的开发者而言,这种优势会不断累积。对于运行单次对话的开发者而言,则基本感知不到差异。定价反映了这一差距。

API访问与可用性

发布时共有五种访问路径。每种路径都有各自的启用细节,但Claude Fable 5 API接口在所有路径上保持一致。

Claude API与AWS上的Claude Platform

通过api.anthropic.com直接访问非常简便——将现有Claude API SDK指向模型ID claude-fable-5,请求即可到达该模型。相同的模型ID也适用于Anthropic在AWS上部署的Claude Platform。Anthropic随发布一同发布的API集成说明详细介绍了值得了解的行为差异——主要包括拒绝停止原因和自适应思考参数。

Amazon Bedrock、Vertex AI与Microsoft Foundry

对于已在云服务提供商上运行业务的团队,Anthropic Fable 5可在三大主流超大规模云平台上原生使用。Bedrock需要一次性的模型启用流程。Vertex AI需要高级AI安全附录同意及按区域启用项目。Foundry遵循Microsoft的标准合作伙伴模型入驻流程。封装细节各有不同,但底层模型完全相同。

在假设之前请务必确认:云平台上特定Claude别名的可用性(例如opus在Bedrock与Anthropic API上的解析结果)可能比直接API落后一个版本。固定使用明确的claude-fable-5字符串可避免意外情况。

Claude.ai访问与API访问

截至发布时,从2026年6月9日至6月22日的试用期内,Fable 5在Pro、Max、Team和按席位计费的Enterprise方案中免费提供。此后,消费者方案的访问将转为使用积分。无论方案层级如何,API才是开发者的正确选择——订阅访问面向终端用户对话,而非生产集成。如需了解当前状态,请参阅Anthropic官方文档,试用定价窗口关闭迅速。

受保护模型的数据留存要求

这一点非常重要,且容易被忽视。Fable 5和Mythos 5均被指定为受保护模型,这意味着适用30天数据留存策略,且零数据留存(ZDR)不可用。如果合同或合规要求ZDR,Fable 5不适用于这些工作负载——需继续使用Opus 4.8或更早版本,这些版本仍支持ZDR。请参阅Anthropic官方文档了解数据留存政策的当前状态。

定价与成本控制

在这款价格较高的模型上,成本控制不是可选项。模型定价只是一方面,真正决定账单金额的是三个数字:Claude Fable 5 API的基础定价、提示词缓存配置和max_tokens管控。每项都会产生复利效应。

官方Token定价及输出成本的重要性

发布时,公布的API定价为每百万输入token 10美元,每百万输出token 50美元,恰好是Claude Opus 4.8的两倍。第二个数字值得细品:在每百万输出token 50美元的价格下,单次3万token的响应——Fable 5在智能体任务中若不加限制会轻松生成这个量——仅输出成本就高达1.50美元。长时间的智能体会话会快速累积输出。在每次API调用时限制max_tokens是最廉价的成本控制手段。

100万上下文窗口、提示词缓存与仅限美国推理说明

完整的100万token上下文窗口包含在标准定价中——长上下文无需额外收费。提示词缓存与其他Claude模型的工作方式相同,缓存命中价格为每百万token 1美元(比标准输入价格低90%)。对于每轮都发送相同系统提示和工具定义的智能体框架来说,这决定了账单是正常还是失控。

出于数据驻留需求,仅限美国推理可用,所有token类别均有1.1倍的价格加成。默认路由为全球。

努力程度、自适应思考与任务预算

Fable 5使用自适应思考——模型自行决定每次请求的推理深度。Opus 4.8的扩展思考预算不适用。取而代之的是effort参数,用于在彻底程度与token消耗之间进行权衡。思考输出本身以摘要形式呈现,而非完整内容。对于从Opus 4.8迁移提示词的开发者来说,这是最可能需要关注的参数变化。

何时不应将Fable 5用于轻量级任务

Fable 5的价格是Opus模型的2倍,不应作为默认选择。对于简单对话、分类、格式转换,或任何Opus 4.8Sonnet 4.6已能达到可接受质量的任务,这些模型才是正确选择。将Fable 5保留给能力差距真正物有所值的工作负载——长期智能体会话、复杂代码库迁移、多阶段研究任务。按任务复杂度路由是一个月内最重要的成本控制杠杆。

拒绝响应、降级回退与安全过滤器

可能触发分类器的敏感领域

Fable 5运行的安全分类器针对进攻性网络安全工作(构建漏洞利用工具、恶意软件、攻击工具)、生物武器设计、化学武器设计和模型能力提取技术。防御性安全研究、上述特定类别之外的通用漏洞查找,以及大多数网络安全相关的专业工作均可正常运行。边缘情况确实存在,随着Anthropic积累数据,“边缘”的定义也在持续调整。

在生产环境中处理stop_reason: "refusal"

当分类器触发时,API响应携带stop_reason: "refusal"而非正常完成。这是集成代码需要处理的新字段。关于拒绝行为背后安全架构的独立背景,TechCrunch的发布报道总结了Anthropic关于Fable与Mythos分离的公开理由。

将降级回退实现细节留给专门的回退指南

本文不涉及回退模式的详细介绍。检测stop_reason: "refusal"、在Opus 4.8与其他模型之间重试、路由调用的计费影响、结构化错误处理——这些内容值得单独成文。对于集成概览而言,相关事实是:分类器存在、范围较窄、响应结构已有文档说明,且被路由的请求不按Fable价格计费。更深入的集成模式属于专门的回退指南范畴。

最适合的开发者使用场景

代码库迁移与智能体编程

我见过的最清晰的使用场景是长周期编程工作——多天的迁移、多阶段的重构、能够跨多个轮次保持上下文并自我验证的智能体框架。Claude Code Fable(记录在Anthropic的Claude Code模型配置指南中的Fable 5集成)正是针对这一场景设计的:适用于”超过单次工作时长”的任务。Claude Code Fable在这一范围的多天端表现最为出色,而非单次端。对于单文件编辑或快速脚本,Sonnet 4.6在成本和延迟上仍更胜一筹。

复杂推理与知识工作

长时间研究任务、50万token以上规模的文档分析、多源综合。100万的上下文窗口在此至关重要,但真正的约束通常是对模糊输入的推理深度,而非原始上下文大小。这是我目前观察到能力差距相对于Opus 4.8体现最明显的地方。

视觉密集型应用原型开发

Anthropic将Fable 5定位为视觉领域的最先进水平——阅读科学图表、从截图重建Web应用源代码、以最少的脚手架导航UI。对于开发视觉优先应用原型的开发者来说,这是一个有意义的起点。但需针对具体工作负载进行验证——视觉基准测试的泛化能力出了名地参差不齐,你的截图并不等同于基准测试。

常见问题

Claude Fable 5可通过API访问吗?

可以,自2026年6月9日起。Claude Fable 5 API模型ID为claude-fable-5,可通过Claude API直接访问,也可通过AWS上的Claude Platform、Amazon Bedrock、Vertex AI和Microsoft Foundry访问。Claude Code需要v2.1.170或更高版本。

哪些平台托管Claude Fable 5?

发布时共五个:Claude API、AWS上的Claude Platform、Amazon Bedrock、Vertex AI和Microsoft Foundry。每个云服务提供商都有各自的启用流程——Bedrock需要一次性模型启用,Vertex AI需要高级AI安全附录同意,Foundry遵循Microsoft的合作伙伴模型入驻流程。底层模型在所有平台上完全相同。请参阅官方文档了解特定平台访问要求的当前状态。

Claude Fable 5与Claude Mythos 5有何不同?

底层Mythos级模型相同。 Fable 5是公开版本,在网络安全、生物学、化学和能力提取领域启用了安全分类器。Mythos 5通过Project Glasswing仅向经批准的合作伙伴开放,运行时不启用这些分类器。Fable与Mythos的对比有更多维度值得深入探讨,专门的对比文章将详细涵盖这些内容。

如果Fable 5拒绝请求会发生什么?

API响应将携带stop_reason: "refusal"而非正常完成。Anthropic的说法是,这影响的会话不足5%,主要集中在上述四个敏感领域。开发者需要在生产代码中处理这一新的停止原因——检测它,并可选择在Opus 4.8或其他模型上重试。请参阅Anthropic最新文档了解当前的拒绝和回退规范。

结语

Claude Fable 5是任何人都能直接调用的首个Mythos级模型,Claude Fable 5 API集成也非常简单——一个模型ID、五个托管平台、公开的token定价。真正重要的决策不在于访问方式,而在于路由策略:何时将任务发送给Fable 5而非更廉价的模型,何时值得承担2倍成本,何时应预期拒绝响应以及如何降级回退。这些问题都无法通过阅读公告来解答。

在真实工作负载上亲自测试吧,那比我说的任何话都更有说服力。

关于Fable与Mythos对比以及回退模式的更多内容,后续将持续更新。

往期文章:

往期文章