原文概要

2026 年 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1,链接由 denysvitali 贴上 HN,上线约一天拿到 1195 分、1116 条评论,冲上首页。

Anthropic 的说明里有个直白的设定:Fable 5.1 和 Mythos 5.1 是同一个模型,只是安全护栏级别不同。Fable 5.1 普遍开放;Mythos 5.1 只走”可信访问项目”,护栏专门为网络安全和生命科学研究设计,其中生物学能力的访问项目还与美国政府合作建立,预计不久后向科学家开放报名。

定价部分主打缓存读取降价:按 token 计费的典型负载比 Fable 5 便宜约 25%,高度 agentic 的活最多省到约 45%。安全方面,新的 Enterprise Frontier Safeguards(EFS)把数据存在客户完全掌控的云设施里、而非 Anthropic 那边,达到零数据保留同等隐私,秋季晚些时候分阶段给企业客户;在那之前,符合条件的客户可以直接以零数据保留方式用 Fable 5.1。护栏误报也在减少——网络安全方向少了 60%。

评测数字挑了几项:Terminal-Bench 4.0 的 agentic coding 拿到 55.8%(Mythos 5.1 为 60.9%),Fable 5 是 42.0%、Opus 5 是 52.3%、GPT-5.6 Sol 是 37.3%;CursorBench 3.2.0 为 73.4%。投资机构 Millennium 的例子被反复引用:Fable 5.1 找到了其内部系统里一个罕见崩溃的根因,该公司工程师和其他模型试了几年都没解释清楚。科学一侧也有两个吸睛案例:基于 NASA Magellan 三十多年前的雷达影像,Fable 5.1 训练神经网络做出一张覆盖金星三分之一表面的高程图,分辨率从 10–20 公里细化到 2–3 公里,海拔误差比原来小 25%,以 CC 许可发布;Mythos 5.1 设计的高亲和力蛋白结合剂,在 12 个靶点上的 hit rate 接近 50%——行业现在典型值只有 10–15%。

讨论焦点

“降价 25%”是表象:缓存之外的账单

评论区对”25% 便宜”反应冷淡,原因在于降价几乎全来自缓存读取。simonw 先把机制说清——缓存读取降价会惠及长会话 agent:

“Bit of a discount if you’re using caching:

same input and output prices, with cache reads at a quarter of the cost This should impact any long-running agent since subsequent calls can benefit from cached reads for previous transcripts.” — simonw

(”如果你用了缓存,确实算打个折:输入输出价格不变,缓存读取降到四分之一。任何长会话 agent 都会受益,因为后续调用能命中之前对话的缓存。”)

Twixes 给出了实测数据:

“~30% reduction in real-world task cost vs. Fable 5 in our evals at viktor.com ! Caching goes a looong way” — Twixes

(”我们 viktor.com 的评估里,真实任务成本比 Fable 5 低了约 30%。缓存立功很大。”)

george_max 则不买账,认为这是把缓存单拎出来算账的障眼法:

“This is just cache reads. In real usage it costs 15% more than Fable 5 – all for marginal gains.” — george_max

(”这只是缓存读取的事。按真实用法算,它比 Fable 5 还贵 15%——换来的全是边际收益。”)

三种算法摆在一起,分歧其实在”真实负载”的定义:长会话吃缓存多,自然是降价赢家;短而散的请求几乎吃不到缓存红利。

用量上限:发版附赠”窗口重置”,quota 却悄悄降了 17%

评论区第一条热评就带着怨气。nezhar 点破:这次发版顺带触发了用量重置。

“This time it came with a usage reset” — nezhar

(”这次发布还附赠了一次用量重置。”)

sva_ 立刻算起了自己 5 小时滚动窗口的账:

“Great, my usage reset is in 10 hours … And my 5 hour window was due to be reset in 2 hours (barely used), now its in 5 hours - so this reset effectively gives me 1 less 5 hour reset for this weekly cycle.” — sva_

(”太好了,我的用量本来 10 小时后才重置……我那个 5 小时窗口本来 2 小时后就该重了(几乎没用过),现在被推到 5 小时后——这次重置等于让我这个周期少了一次 5 小时重置。”)

behnamoh 则把矛头指向额度本身:

“And yet, despite this, the quota limits went down by 17%.” — behnamoh

(”然而即便如此,额度上限还是降了 17%。”)

后面的讨论吵成一团:davely 指出 5 月的额度曾临时上调 50% 且一再延期,现在只是恢复”原状”,算不上缩水;Petersipoi 反驳说把”用量减少”包装成”提升”就是糊弄人,何况 20x Max 计划根本达不到宣称的 20 倍。有用户顺势分享土办法:写个 cron 任务定时发一条 claude -p 空 prompt,用最低档模型把用量窗口对齐到自己想要的时间点。

护栏的左右横跳:能写,不能审

关于安全护栏的帖子是最长的线程。焦点不是”拦得严不严”,而是拦得莫名其妙。dijit 的复现最传神:

“Hey Fable, write me some win32 unsafe rust code” “sure thing boss” —— “Hey Fable, review this unsafe win32 rust code” “Potentially dangerous request, falling back to Opus” —- Every damn time, ironic because the unsafe win32 code can be generated by fable in the same session. Maddening. — dijit

(”嘿 Fable,给我写一段 win32 unsafe Rust 代码。”/”好的老板。”——”嘿 Fable,审查一下这段 unsafe win32 Rust 代码。”/”潜在危险请求,降级到 Opus。”每次都这样,讽刺的是这段 unsafe 代码就是 Fable 自己在同一会话里生成的。让人抓狂。”)

AlfeG 补了一个更荒诞的版本:

“Yep. Fable implemented 2FA login. Declined to review own code in same session.” — AlfeG

(”没错。Fable 实现了 2FA 登录,然后在同一会话里拒绝审查自己写的代码。”)

theplumber 用自嘲说明护栏口径有多宽:

“I do very security cyber dangerous work like building a signup/login form or setting up a certificate. For obvious and good reasons Fable refuses to work on such sensitive stuff.” — theplumber

(”我在做非常危险的网络安全工作,比如写个注册/登录表单、配个证书。出于明显且充分的理由,Fable 拒绝处理这类敏感内容。”)

nrmitchi 则给出了更阴险的观察——很多”降级”是静默发生的,用户压根没察觉:

“I’d guesstimate that ~80% of the time I thought I was using Fable, I wasn’t actually. It’s also led me to just… not even try, and just start with Opus regardless. I’ve found Fable unusable; not because it’s bad, but because it… can’t be used.” — nrmitchi

(”我估计大约 80% 我以为自己在用 Fable 的时候,其实不是。这让我干脆不试了,直接一律用 Opus。我发现 Fable 不是不好用,而是……根本没法用。”)

反对的声音同样存在:jjice 表示自己从没遇过这类拦截,用 Fable 做规划体验很好;simonw 说自己绝大多数复杂问题能被一次搞定,被踢回 Opus 的情况很少:

“I get punted down to Opus 5 occasionally (for security-adjacent things) but that’s pretty rare.” — simonw

(”偶尔会被踢回 Opus 5(和安全沾边的事),但相当少见。”)

vablings 给出的实操路线算是折中:接上 Binary Ninja MCP 做逆向,只要给点方向,Fable 能顺产出详细结果,几乎不触发拦截——仿佛它觉得你有正版授权就一定是正经人。

Mythos 5.1 的门槛:谁够格用高护栏模型?

Mythos 5.1 只对”可信访问项目”开放,准入规则随之成了话题。codexon 转述了一个说法——网络安全那个项目(CVP)的门槛是手里得有公开 CVE:

“I heard the only way you are going to get into the CVP program is if you have public CVEs. Doesn’t seem to matter if you are in a company account or not according to people that are supposedly in the program.” — codexon

(”我听说想进 CVP 项目的唯一途径是手里有公开 CVE。照那些据说已经进项目的人的说法,你是不是企业账号都无所谓。”)

Avicebron 说,公司里凡是沾”cyber”的活基本全被标记,而公司暂时也没计划申请 Mythos:

“No, almost anything related to my job is flagged for “cyber” and my company currently has no plan to try and enroll into mythos. I’m not sure if anyone has been able to enroll solo.” — Avicebron

(”不行,我工作里几乎任何跟 cyber 沾边的都会被打标,我们公司目前也没有申请 Mythos 的打算。我不确定有没有人能自己单独申请成功。”)

codexon 又补了一句更扎心的传闻——花钱多也许能买到护栏松动:

“Rumors are that if your company spends a lot, they will also remove safeguards.” — codexon

(”有传闻说,只要你们公司在他们那花得够多,护栏也能给你拆了。”)

围绕”高级能力该不该锁”的分歧在这里照进现实:一边是高门槛挡住了绝大多数开发者,另一边是安全围栏在金钱面前可以变通。评论区调侃,这个项目挑的不是能力,是背景。

Haiku 5 去哪儿了:Anthropic 放弃低端市场?

围观发版之余,一条老梗被顶了起来:spicypixel 一句 “Yeah but haiku 5 when?”(”所以 Haiku 5 什么时候出?”)带出几十条回复。Haiku 系列已经一年没更新,mchusma 从中读出了明确信号:

“I think the signal from Anthropic is pretty clear between Haiku not getting an update in a year and the Sonnet issues this year. They don’t care about low intelligence models. You should go elsewhere. That’s what we’ve done, migrated workflows away from Haiku and Sonnet.” — mchusma

(”Haiku 一年没更新,加上今年 Sonnet 那些破事,Anthropic 的信号已经很明显:他们不在乎低智能档模型。你该换别家了。我们就是这么干的,把工作流从 Haiku 和 Sonnet 迁走了。”)

km144 直接点出时机:

“Yep. Simple answer is they want to IPO in the fall, and a new Haiku does literally nothing for them” — km144

(”没错,答案很简单:他们秋天要 IPO,一个新 Haiku 对他们毫无用处。”)

这条线索把讨论串成了产品矩阵的对比。ayewo 干脆列了张对位表:Claude Fable/Mythos 对 GPT-5.6 Sol,Opus 对 Terra,Sonnet 对 Luna,而 Haiku 在 OpenAI 一侧没有对应物。2001zhaozhao 认为真该发个新 Haiku 去抢 Luna 的活——Luna 的成本优势强到离谱,已经是他大批量任务的首选;HDBaseT 则更悲观,觉得 Haiku 在几乎任何智能档位上都打不过 Luna 和 DeepSeek 的同档模型。CamperBob2 的立场是一记反问:为什么要给 Haiku 档的模型付钱?最后 deagle50 用三个字收束全场:”After IPO”(IPO 之后)。

花最贵的钱,写 CRUD:frontier 模型值不值?

针对 maxdo “这么贵不想试”的帖子,Philpax 的回复被顶得很高,带着一种不客气的事实陈述:

“Maybe you don’t! It is very possible that your problems don’t actually need frontier-level artificial intelligence.” — Philpax

(”也许你根本不需要!你的问题很可能根本用不上前沿级人工智能。”)

maxdo 自己倒是认账:他更看重迭代/验证的速度,而不是 CursorBench 上那 3 个百分点。enraged_camel 的说法更精确——Fable 强在帮他想通业务逻辑,而不是写代码;落地实现他反而用 Opus。taberiand 一句自嘲总结全场:”Most of us just shovel CRUD, we really should be honest with ourselves.”(”我们大多数人就是在搬 CRUD 代码,还是对自己诚实点吧。”)随后有人把”让 LLM 居中一个 div”编成段子,tomw1808 补刀:

“GTA VI will be released before an LLM will be able to do that” — tomw1808

(”在 LLM 能干成那事之前,GTA VI 早就发售了。”)

Fable 与 Opus:贵一倍,强多少?

另一条主线是 Fable 和自家 Opus 打架。eis 直言性价比存疑:

“Opus beats Fable in quite a few benchmarks and at twice the cost I just haven’t seen it provide noticeably better results compared to Opus.” — eis

(”好几个基准里 Opus 都比 Fable 强,而且 Fable 贵一倍——我没看到它比 Opus 有明显更好的结果。”)

rfgplk 的结论是:除开图形这类创意编程,Opus 5 全面优于 Fable 5;bredren 则反着来,说 Opus 5 的基准优势并没有转化成实际生产力,交互式会话里 Fable 5 一直很稳定,反而是 Opus 5 的输出质量让他失望。这条争论把”基准评测 vs 真实会话”的裂缝摆上台面——两边引的很可能都不是同一组数据。

便宜的模型在挖墙角

对 Anthropic 冲击更大的是来自下行的压力。ActionHank 的发言带着一点唱空味道:

“The big issue they face right now is that vastly cheaper open models are proving capable for more and more uses at cents on the dollar. This is the right direction, but they aren’t going to get there fast enough. They will list, investors who don’t know anything about tech will buy, the world will realise that China just put out a model that is good enough at a fraction of the price, they will crater.” — ActionHank

(”他们现在最大的问题是:便宜得多的开源模型正以几分钱的价格证明自己能干越来越多的事。降价方向是对的,但他们来不及了。他们会上市,不懂技术的投资者会买,然后全世界发现中国刚出了个只要零头价格就足够好的模型,股价就崩了。”)

这和”Fable 5.1 缓存降价”形成了同一枚硬币的两面:一边是推理成本曲线往下压,一边是 Anthropic 在往”科学前沿”这种高价区域挤。只是评论区对这种转型速度普遍持怀疑态度。

典型观点一览

立场 用户 一句话
降价务实派 Twixes 缓存立功,真实任务成本降约 30%
算账质疑派 george_max 真实用法比 Fable 5 还贵 15%
护栏讽刺派 dijit 能生成 unsafe 代码,不能审查它
幸运体验派 simonw 复杂问题基本一次成型,极少被踢
静默降级派 nrmitchi 80% 的时候以为在用 Fable,其实没有
战略派 km144 秋季要 IPO,新 Haiku 毫无用处
迁移派 mchusma 低端档不更新,工作流已迁走
务实反方 Philpax 你的问题未必需要 frontier 模型
唱空派 ActionHank 便宜开源模型会让股价崩盘

总体情绪

这条帖子的分裂感很强:Anthropic 把故事讲成”同模型双护栏、价格更低、科学能力翻倍”,但评论区的注意力几乎没在基准表上停留,全被日常使用体验占据——而且体验的方差大得惊人。一边是 simonw 式”一次成型”的爽文,另一边是 nrmitchi 式”静默降级到无法察觉”的荒诞,中间隔着一条”你的领域离 cyber 有多远”的分界线。

真正让讨论升温的是两个结构性问题的错位:降价只落在缓存读取上,而用量额度反而在收缩;高端模型越做越强,围剿它的却是价格低到几乎没有意义的同档竞品。整场对话下来,最被认同的一句话反而是最朴素的提醒:先搞清楚自己到底需不需要 frontier。

引用帖子

# 标题 URL
1 Claude Fable 5.1 and Claude Mythos 5.1 (HN) https://news.ycombinator.com/item?id=49525378
2 原文:Introducing Claude Fable 5.1 and Claude Mythos 5.1 https://www.anthropic.com/claude-fable-and-mythos-5-1
免责声明:本文为 AI 摘要,旨在提炼 HN 社区讨论要点,不代表本网站立场。内容可能存在遗漏或偏差,建议阅读原文以获取完整信息。

本摘要由 AI 模型辅助生成:deepseek/deepseek-v4-flash