Anthropic 在 6 月 9 日把旗舰模型 Claude Fable 5 推到 GA 之后,这家公司的最强模型并没有拿到企业市场的默认位。

Ramp 在 8 月 AI 指数里披露的数字很刺耳:在 7 月的 token 管理样本中,Fable 5 给 Anthropic 贡献了 6% 的 token 量和 11.4% 的模型相关支出。换句话说,这家公司的最强模型连 Ramp 样本里 Anthropic 模型支出的零头都没摸到,大部分花出去的钱还是流向 Sonnet 5、Opus 5 这些更便宜的前代和兄弟模型。

更耐人寻味的是对比组。同期 OpenAI 的 GPT-5.6 Sol 在 OpenAI 自家模型里拿到 25% 的 token 量和 23% 的支出,Fable 5 的模型相关支出大约只有 Sol 的 75%。也就是,Fable 5 不只是输给自家旧模型,跨厂商对照同样落后。

Ramp 的样本带有自己的 caveat。它来自 Ramp 的 token 管理产品,客户群相对偏技术,但即便在这个更可能买 Fable 5 长链编码能力的样本里,流量也绝大多数流向了别处。结论只能限定在工作负载分流这个范围里,但信号本身够强。

理解这 11.4% 的关键是:最强的模型和最好的默认模型解决的是两个不同的优化问题。最强模型靠处理最难的任务拿分;默认模型要兼顾价格、可用、合规、可预测,在成千上万普通任务里足够好。Fable 5 在第一件事上有强 case,在第二件事上有结构性短板。

Fable 5 的定价是 10 美元 / 百万输入 token、50 美元 / 百万输出 token,Opus 5 是 5 美元和 25 美元,前后两端都正好是 Fable 5 的一半。Anthropic 自己在产品页上把 Opus 5 描述为接近 Fable 前沿智能、价格一半的日常工作模型。

按简单的 1M 输入 + 200K 输出账单算,Fable 5 单次约 20 美元,Opus 5 约 10 美元。这个比较不是成本/完成任务的 benchmark。一个更聪明的模型可能一次搞定难题,便宜模型需要重试三次。prompt caching、批处理、effort 设置、输出长度差异都会改变账单。模型选择真正的指标应该是 cost per accepted result:初始运行、重试、回退、复核成本除以被接受的结果数。

但价格只是第一层。

订阅层同样有约束。Max 和 premium 团队的 Fable 配额上限是共享周额度的 50%,Pro 和标准 Team 一上来就走 pay-as-you-go 信用,超过额度要么买信用要么切模型。Anthropic 自己也把 Fable 5 定位为加封顶的专项通道。

比价格更要命的是企业合规。Anthropic 对 Fable 5 和其他 Mythos 类模型要求 30 天企业流量留存,即便公司强调数据用于安全监控、不用于训练、在 30 天后基本删除;严格 ZDR(零数据留存)要求的银行、医疗、国防、源代码平台,在政策层就被排除掉了。Opus 5 在通用访问下没有 covered-model 留存要求,部署优势是 benchmark 救不回来的那种。

最后是 guardrails。Fable 5 在网安、生物/化学、潜在模型蒸馏三个域加了独立的 classifier,Anthropic 自己说过,故意保守的 classifier 会把无害请求路由到 fallback 模型。95% 的会话没 fallback 听起来不多,但一个安全团队、认证平台、生物学家、恶意软件分析组可能就生活在 fallback 高发的那块分布里。Fable 重启之后,改过的网安 classifier 还会增加常规编码和调试的良性 flag。这就把 Fable 5 的经验从模型权重拆出来:收到什么取决于路由、refusal 行为、冗长度、延迟、harness。

Hacker News 上 200 多点 180 多条评论里反复收敛出来的使用模式是:Fable 5 留给架构、复杂评审、卡住的硬骨头;Opus 5、Sol、便宜模型负责日常实现。这不是给 Fable 5 的安慰奖,而是一种合理的生产架构。模型选择从来不该是 provider slogan,应该是 workload 加 acceptance test。

Ramp 同一份 8 月报告里 Anthropic 在付费美国企业里占了 43.5%,OpenAI 是 39.7%。Anthropic 可以同时是 vendor adoption 之王,而它的最贵模型依然是少数派产品。Fable 5 跟 Opus 5 的这次反差,真正预示的是前沿模型商业化的天花板,而非 Anthropic 的全局走势。

留给企业用户的实操建议

  • 默认工作交给最便宜且够用的模型。
  • 只有 Fable 5 的成功率溢价能打过 2 倍标价 + 合规排除 + fallback 风险时,才把任务升级给 Fable 5。
  • 评测指标用 accepted result rate、cost per accepted result、fallback rate、p95 latency、human review minutes,不要只看 token 价格。
  • 严格 ZDR 的工作流,从一开始就绕开 covered-model。

来源:Ramp August AI Index 2026Financial Times 报道Anthropic Fable 5 定价页Anthropic Fable 订阅规则explainx.ai 11.4% 解读