Claude Fable 5.1 已发布:回看 EAP 与网页灰度传闻
Claude Fable 5.1 已于 9 月 1 日发布。本文更新当前状态,并保留 8 月 EAP 代号、知识截止测试与网页灰度传闻的核查记录,说明哪些线索不能证明型号。
先说结论
- Claude Fable 5.1 已于 2026 年 9 月 1 日发布,不再是待官宣模型。
- Anthropic 正式发布页列出 API ID
claude-fable-5-1;输入、输出分别为每百万 Token 10、50 美元,缓存读取为 0.25 美元。- 8 月的 EAP 截图与知识截止测试,仍不能证明某个测试代号就是最终发布模型,也不能追溯证明某个账号当时的后台路由。
- 想了解现在是否值得使用,先看 Fable 5.1 编程、科研与价格变化;想比较开放范围,参见 Fable 与 Mythos 的访问区别。
已发布之后,这篇传闻核查还留下什么
9 月 8 日更新:官方产品页的更新记录列明 9 月 1 日发布。下文保留的是 8 月 27 日时的证据与推断,用于解释早期访问代号、网页回答和官方风险报告为什么不能互相画等号;旧截图不是当前型号、价格或可用性的证明。没有找到官方的代号映射说明,就不事后把 Melon、Marshmallow 和 Model 2 都改称 Fable 5.1。
8 月 27 日的观察记录
8 月下旬,一道很短的提示词在 Claude 用户圈里流传:要求模型不要搜索,再问 Opus 4.6 和 GPT Image 1.5 的发布日期。有人选的是 Fable 5,模型却答出了 2026 年 2 月 5 日——正好是 Opus 4.6 的官方发布日期。现有截图没有证明 Claude Web 的搜索工具开关真的被关闭。
这件事有意思,不是因为“模型答对了”本身,而是因为 Anthropic 的官方模型表把 Fable 5 的可靠知识截止日期写成 2026 年 1 月。2 月 5 日已经越过这条线。于是,一个很诱人的解释出现了:Claude Web 的模型选择器还显示 Fable 5,后台实际已把部分账号路由到未官宣的 Fable 5.1。
但先别急着把它写成发布新闻。把现有材料按证据强弱排一遍,会得到一个更克制、也更有用的结论:Anthropic 确实在测试新检查点;“它叫 Fable 5.1”“已经开始公网灰度”“明天发布”仍是三个不同层级的推断。
第一条线:EAP 代号是真的,型号映射仍是猜测
8 月 23 日,@Lentils80 称 Anthropic 正在测试两个模型:claude-marshmallow-eap 和 claude-melon-eap。EAP 是 Early Access Program,也就是早期访问计划。第二天,他贴出了两组 3D 场景输出,并写道:“建筑摆放得很好”,同时指出两个模型会消耗大量 thinking tokens(思考 token),多次撞到输出上限。
@Lentils80 于 8 月 24 日贴出的两组 EAP 输出。截图能证明代号与这两组输出被公开展示过,不能独立证明模型参数、训练方法或最终商品名。
这里有一个容易被忽略的反转。@Lentils80 在最初爆料里说“两者都没有到 Fable 水平”;8 月 26 日更新后才改成“Melon 像 Fable 检查点,Marshmallow 像较弱的 Fable 或较强的 Opus”。同一个测试者在三天内改变判断,说明模型可能更新了,也说明这种“凭手感猜型号”的方法误差很大。
因此,这条线能支持两句话:测试模型存在;至少一名拿到输出的人认为它们在快速更新。它不能支持“Melon 就是 Fable 5.1”,更不能支持具体发布日期。
第二条线:知识截止测试制造了悬念,却不是防伪码
@legit_api 给出的测试提示词是:
opus 4.6 date of release and gpt image 1.5 without searching the web
Anthropic 官方页面给出了可核对的基线:Fable 5 的可靠知识截止是 2026 年 1 月,API 模型 ID 是 claude-fable-5,当时价格为每百万输入 token 10 美元、每百万输出 token 50 美元。Opus 4.6 的官方模型页则把发布日期写成 2026 年 2 月 5 日。Anthropic 对“可靠知识截止”的定义是“模型知识最充分、最可靠的日期”,并不是过了这天就绝对不可能答对。
Anthropic 8 月 12 日存档的官方模型总览,Fable 5 一栏显示 claude-fable-5、1M 上下文、2026 年 1 月可靠知识截止和 $10/$50 的输入/输出价格。
@legit_api 8 月 26 日的原帖与模型回答。截图只记录这一次回答,不代表所有账号或所有会话。
问题出在推理的最后一步。“旧模型不该知道”不等于“答对的只能是新模型”。至少还有四种解释:模型猜中了日期;系统提示或会话上下文带入了信息;网页端注入了账户级或产品级数据;后端更新了检索或路由组件,但底层权重没有换代。用户说“不要搜索”,也不能审计服务端到底给模型喂了什么。
GPT Image 1.5 这一半更不能充当可靠的分界线,因为截图中的回答把它的日期写在 2025 年 12 月,仍在 Fable 5 的 2026 年 1 月截止日期之前。真正越界的只有 Opus 4.6 的 2 月 5 日。
所以,这个测试适合做“异常提示器”,不适合做“型号防伪码”。如果 20 个新会话、多个账号、无记忆环境都稳定答出同一批 2026 年 2 月之后的冷门事实,证据会变强;单次截图还不够。
第三条线:官方报告确认了新检查点,却没有确认发布
8 月的 Anthropic Risk Report 是目前最硬的一手资料。需要纠正一个流传很广的说法:完整的 Model 2 描述不在附录 6.6,而在报告第 16 页的第 1.4 节;附录 6.6 只是再次把 Model 2 列入内部模型清单。
Anthropic Risk Report 第 16 页原文:Model 2 比 Mythos 5 略强,在多项内部任务上有明显进步,但没有达到 Opus 4.6 到 Mythos Preview 那种跃升;报告覆盖日期时“没有对外发布计划”。
这页至少确认了三件事:Anthropic 有一个未公开的内部 Model 2;公司认为它整体略强于 Mythos 5;截至报告覆盖日期,它还没有完成全部常规发布前评估。报告没有出现“Fable 5.1”,也没有把 Model 2 与 Melon、Marshmallow 或 Claude Web 路由联系起来。
把三条线拼在一起,可以合理怀疑它们指向同一轮模型迭代;把它们直接画成等号,就越过了现有证据。
三重博弈:口碑、发布时间与价格
为什么市场愿意相信 Anthropic 会抢跑?第一重是口碑。负责 Claude Code 的 Thariq 在 8 月 22 日公开回复用户,承认 Opus 5 是一个 “really spiky model”——表现波动很大——并说修复一致性是团队的高优先级工作。这能证明团队知道体验问题,不能证明新模型就是修复方案。
第二重是竞品时间窗。爆料人 @synthwavedd 称 OpenAI 的 Astra 计划在几周内推出,随后又称 Anthropic 的准备工作在加速,最快次日发布。这里的关键词是“爆料人称”。在 OpenAI 或 Anthropic 公告出现之前,它只能解释市场情绪,不能写进确定性时间线。
第三重才是价格。当时的 Fable 5 并不便宜:官方价是 $10/$50;Opus 5 是 $5/$25;Sonnet 5 是 $2/$10,均按每百万输入/输出 token 计费。传闻中的 Fable 5.1 如果只是保持 Fable 5 原价,它更像能力升级,不是“地板价开战”。要构成价格战,Anthropic 至少得降低单价,或在相同单价下把完成任务所需 token、返工次数和工具调用显著压下来。截至 8 月 27 日,没有公开的 Fable 5.1 价格或可复现的成本对比;9 月发布后应改查正式价格,而不是沿用这条旧判断。
Fable 5.1 发布后,API 开发者怎么评估
现在可以根据官方发布页中的模型 ID、价格和系统卡开始受控测试。别用 Claude Web 的截图代替 API 测试:网页端的系统提示、记忆、工具和安全策略可能不同。
把 20–50 个真实任务整理成固定评测集,例如一个前端组件、一个需要连续调用三次工具的任务、一个长文档问答。用同一批输入比较成功率、总 Token、工具调用次数和人工返工时间。可参考同一道 3D 游戏题的 Astra / Fable 实测,但不要把单项测试推广成所有任务的排名。
常见问题
Anthropic 已经发布 Fable 5.1 了吗?
已经发布。官方产品页记录的日期是 2026 年 9 月 1 日,正式 API ID 为 claude-fable-5-1。本文的 8 月截图是发布前存档,不能当作当前状态。
Claude 答出 Opus 4.6 的发布日期,能证明后台是 Fable 5.1 吗?
不能。一次答对截止日期之后的事实,可能来自猜测、隐藏上下文、记忆、检索,或模型权重之外的路由变化。只有在新会话、多个账号和多组冷门事实上重复测试,证据才会更强。
claude-melon-eap 和 claude-marshmallow-eap 是什么?
它们是早期访问帖子里出现的检查点代号。公开材料没有给出参数量、最终商品名,本次核对的正式发布页也没有给出这两个代号与最终型号的对应关系。
API 团队切换模型前应该验证什么?
先核对所用服务的实际模型 ID、价格、可用权限和系统卡,再用固定任务集对比新模型与现有模型。官方发布不等于所有第三方平台都已开放同一路由。
在 SandBase 查看当前已公开的 Anthropic 模型:Anthropic 厂商页 | 模型目录
SandBase Docs 展示 Models and APIs 与 Managed Agents 的入口。这张历史截图只说明文档入口,不能单独证明某个具体型号在 SandBase 的可用状态。


