同一个模型拆两版:Claude Fable 5.1 缓存价降 75%,Mythos 5.1 只发给审核通过的团队
第一个版本把缓存读取价格一口气砍到 0.25 美元,是上一代的四分之一;第二个版本和它共享同一个底层模型,却连申请入口都不对普通开发者开放。9 月 1 日到 2 日,Anthropic 一次性发布了两款模型:Claude Fable 5.1 面向所有 API 用户开放,Claude Mythos 5.1 只发给通过审核的网络安全与生命科学团队。同一家公司、同一个底座模型、同一天的官方公告,却走出两条完全不同的分发路径。
这件事最值得琢磨的不是某个跑分数字,而是「同一个模型拆成两种出厂设置」本身。过去我们习惯把模型分成开源与闭源、便宜与昂贵,这次 Anthropic 给出的新分法是「能力全开给谁」。它把 AI 行业正在发生的一件大事摆到了台面上:前沿模型的能力分层,正在从实验室里的安全论文,变成实实在在的产品策略。
一、双轨从哪来:同一底座,两种护栏
先看两条轨道分别是什么。Claude Fable 5.1 是标准版,任何注册了 Anthropic API 的开发者都能直接调用,API 名就是 claude-fable-5-1。它的规格相当直白:官方支持 100 万 token 上下文,最大输出 128K token,始终启用自适应思考,支持文本加图像输入。Anthropic 给它的定位是研究、长周期智能体编程和知识工作,也就是那些要一次性吞下整本论文、整个代码仓库、整段长对话的活。
Claude Mythos 5.1 走的则是另一条路。Anthropic 官方说得很清楚,它的底层模型和 Fable 5.1 是同一个个模型,差别在于安全护栏被部分放开。在网络安全和生命科学这两个方向上,更强的能力被解禁,但前提是使用者必须通过 Anthropic 的「可信访问」审核,目前的审核窗口明显偏向美国机构。换句话说,Mythos 5.1 不是另一个小一号的模型,而是同一个大脑去掉了部分限制后的版本,只租给被确认不会拿它乱来的人。
为什么要这样拆?可以把 Fable 5.1 理解为民用版汽车,限速、限马力、谁都能买;Mythos 5.1 是赛道版,马力全开,但你要先证明自己持有赛道执照、有合格的防护团队。对 Anthropic 来说,这种拆分把「能力边界」从模型内部挪到了分发环节:同一个模型,对普通用户保留护栏,对审核过的防御方和科研团队放开限制。这让安全与商用不必互相牺牲,代价是产品逻辑多了一层「资格审查」。
二、缓存价降 75%:算的其实是长上下文这笔账
这次发布最直观的降价数字在缓存读取上。Fable 5 的缓存读取价格是每百万 token 1 美元,约为正常输入价的 10%;Fable 5.1 把这一档砍到 0.25 美元,降幅 75%,只相当于正常输入价 10 美元的 2.5%。与此同时,模型的常规输入输出价格纹丝不动,输入仍是每百万 token 10 美元,输出仍是 50 美元,与 Fable 5 保持一致。
价格只动缓存这一档,背后的逻辑非常清楚:这是冲着 100 万 token 上下文和长程智能体去的。当上下文窗口拉到 100 万 token,一次调用里真正新写的文字只占很小一部分,绝大部分成本来自重复读取已经处理过的历史内容。缓存机制让这部分历史不用重新计算,缓存命中价格越低,开发者才越敢把整个代码库、整段工作日志、整条长对话一次性塞进上下文,让模型在完整上下文里连续工作几小时甚至几天。
Anthropic 官方给了一个估算:对大多数典型工作负载,换到 Fable 5.1 后整体成本比 Fable 5 低约 25%。这个数字不是靠降价主模型得来的,而是靠缓存命中便宜之后,长上下文用得起的结构性省法。把缓存价从输入价的 10% 压到 2.5%,相当于给长会话类应用发了一张长期折扣券,这类应用恰恰是智能体编程与知识工作最吃成本的形态。
三、科研跑分翻倍:这一代强在哪
能力侧,Anthropic 最强调的一句是科研类基准跑分较上一代翻倍。在需要长程推理的科研任务上,Fable 5.1 相对 Fable 5 的提升不是几个百分点,而是接近翻番,这在模型迭代里是相当罕见的幅度。配合 128K 的最大输出,它能一次产出很长的完整分析,而不是把答案拆成碎片。
规格之外,有两个工程细节值得开发者注意。一是「始终启用自适应思考」,意味着模型会在后台自行决定何时延长推理链条,不需要开发者手动开关,长程任务的表现会更稳定,但响应耗时会随之变化。二是官方文档里列出了几条会影响现有调用方的 API 变更,凡是已经用 Claude API 跑智能体流水线的团队,升级前要重新过一遍迁移说明,不能只看跑分就无脑换。
放到竞争格局里看,Fable 5.1 的对手很明确:OpenAI 的 GPT-5.6 家族与 Google 同期迭代的 Gemini 旗舰线。这一轮 Anthropic 的打法不是拼单点跑分,而是拼「长上下文加便宜缓存」这套组合拳,把成本优势建立在上下文长度这个维度上。对做文档分析、代码库级智能体、长时科研代理的团队来说,这套组合比单纯堆参数更实用。
四、能力分级,正在成为前沿模型的默认动作
把视线从 Anthropic 拉远一点,会发现同一周 OpenAI 也在做类似的事。OpenAI 在《Path to Astra》报告里宣布,新模型 Astra 达到了自家「预备框架」中关键网络安全能力的门槛,成为公司历史上第一个触到这一档的模型,并因此限制谁可以用它最尖端的网络安全功能。一家把缓存价格打到 0.25 美元、希望更多人用上长上下文,另一家把最强能力锁进审核名单。两件事并排看,前沿模型的分发逻辑正在收敛到同一个方向:能力越强,越要分级。
这里的关键不是「谁安全谁不安全」的道德判断,而是商业模式的改变。过去 AI 公司的分发变量只有两个,价格与能力;现在多了一个变量,资格。同一个模型可以同时存在「人人可用」和「限审核发放」两个版本,成本结构一样,但触达的人群不同。对企业用户而言,这意味着两件事:一是买模型不再只是比价,还要比「你能买到哪一档」;二是安全与合规团队开始直接参与模型选型,而不只是事后走审批流程。
对 Anthropic 来说,双轨还有一个隐藏收益。Mythos 5.1 只对审核团队开放,等于把最前沿的能力限制在可控范围,从而在监管与舆论层面为整个产品线争取空间;Fable 5.1 则负责大规模商用与生态扩张。一张牌同时满足激进与保守两条路线,这是单模型策略做不到的。
五、给从业者的三个判断
第一,缓存降价直接改变长上下文应用的算账方式。如果你的产品依赖把长文档或长会话反复喂给模型,Fable 5.1 的 0.25 美元缓存价会显著压低边际成本,值得重新测算一次单位经济模型,而不是沿用旧模型的成本表。
第二,双轨发布意味着「资格」成为新的产品维度。接下来会有更多实验室跟进这种模式,企业采购模型时要提前想清楚:哪些场景需要能力全开的版本,哪些场景用标准版就够,以及谁能代表公司去申请可信访问通道。安全审核从锦上添花变成了前置环节。
第三,别被跑分标题带节奏。科研跑分翻倍和缓存降价都是真实变化,但对你的业务是否成立,要看具体负载:长文档、长会话、代码库级智能体这类吃上下文的负载受益最大;短对话、低延迟场景享受不到缓存红利,反而可能被「始终启用自适应思考」拉长响应时间。动手之前,先用自己真实的工作负载在 Fable 5.1 上跑一轮对照,比读任何评测都靠谱。

六、一张表看懂两个版本差在哪
| 对比项 | Claude Fable 5.1 | Claude Mythos 5.1 |
|---|---|---|
| 底层模型 | 与 Mythos 5.1 同底座 | 与 Fable 5.1 同底座 |
| 上下文窗口 | 官方 100 万 token | 官方 100 万 token |
| 最大输出 | 128K token | 128K token |
| 缓存读取价 | 每百万 token 0.25 美元(降 75%) | 随可信访问协议单独约定 |
| 输入输出价 | 10 美元 / 50 美元每百万 token | 不对公开目录开放 |
| 适用对象 | 全体 API 开发者 | 审核通过的网络安全与生命科学团队 |
| 安全护栏 | 完整保留 | 按审核范围部分放开 |
这张表最扎眼的一行是最后一行。同一个底座,护栏差异,决定了谁碰得到最强的能力。过去两年我们讨论 AI 商业化,谈的是算力成本、模型能力、开源闭源;2026 年秋天开始,可能要再加一个词:谁能拿到哪一档。能力分级从安全话题变成产品与销售都要面对的现实,而这只是第一波。




477

被折叠的 条评论
为什么被折叠?



