Anthropic 放大招:Claude Fable 5 和 Mythos 5 来了

2026 年 6 月 9 日 Anthropic 同时发布 Claude Fable 5 与 Mythos 5:同一个底层模型,区别只在护栏。Fable 5 几乎全基准 SOTA、任务越长领先越大(Stripe 5000 万行代码库迁移一天搞定),价格 $10/$50 不到 Mythos Preview 一半,AWS Bedrock 已上线。最后聊聊:藏了几个月的 Mythos 为啥突然放出来了。

zhuermu··10 分钟
Claude Fable 5Mythos 5AnthropicAmazon Bedrock模型发布AI 安全
Anthropic 放大招:Claude Fable 5 和 Mythos 5 来了

English Version: Anthropic Goes Big: Claude Fable 5 and Mythos 5 Are Here

Mythos 级能力 · 内置安全护栏 · AWS 上已可用

2026 年 6 月 9 日,Anthropic 一口气发布了两个模型:Claude Fable 5 和 Claude Mythos 5。同一天,AWS 宣布 Fable 5 已经在 Amazon Bedrock 上线。这篇文章带你一次看懂:它强在哪、新增了什么能力、多少钱、在 AWS 上怎么用,最后再聊聊一个有意思的问题——藏了好几个月的 Mythos,为啥突然就放出来了?

先搞清楚:Fable 和 Mythos 到底啥关系

Anthropic 在 Opus 系列之上,专门划了一个更高的能力档位,叫 Mythos 级(Mythos-class)。今年 4 月,他们通过「Project Glasswing」项目,把第一个 Mythos 级模型(Mythos Preview)只交给了一小撮网络安全防御机构试用,普通人根本碰不到。

这次的 Fable 5 和 Mythos 5,底层其实是同一个模型。区别只有一个字:护栏。

  • Fable 5:加了安全护栏,给所有人用。
  • Mythos 5:在某些领域把护栏摘掉了,只给极少数经过审核的网络安全 / 生命科学伙伴用。

💡 小知识:Fable 来自拉丁语 fabula,意思是「被讲述的故事」,跟希腊语里的 mythos(神话)同源。名字不同,护栏不同,但「灵魂」是同一个。

性能:越是长任务,领先越夸张

Claude Mythos 5 / Fable 5 基准对比 Mythos 5 / Fable 5 与主流模型基准对比(数据来源:Anthropic)

Anthropic 的原话是:Fable 5 几乎在所有测过的基准上都是 SOTA(业界最强)。而且有个很关键的规律——任务越长、越复杂,它甩开其他模型的差距就越大。

几个早期客户的真实反馈,比跑分更有说服力:

  • Stripe:把几个月的工程量压缩到了几天。在一个 5000 万行的 Ruby 代码库里,一整个团队手动要干两个多月的全库迁移,Fable 5 一天就搞定了。
  • 编程:在 Cognition 的 FrontierCode 评测上得分最高,而且更省 token——中等强度就能拿第一。
  • 金融分析:在 Hebbia 的资深级金融推理基准上拿了所有模型里的最高分,图表、表格解读能力大幅提升。

一个有画面感的例子:以前的 Claude 想玩《宝可梦:火红》,得给它配一堆地图、导航等辅助工具才勉强能玩。Fable 5 只靠看游戏截图(纯视觉),就把整个游戏通关了。

新增的能力:能干「长活」了

长时间自主执行

这是最大的变化。Fable 5 能在没人盯着的情况下,长时间、异步地执行复杂的编程和知识类任务,处理那些以前模型「撑不住」的活儿。

更强的视觉能力

能看懂 PDF 和文件里嵌套的图表、表格,甚至能从一张截图反推出网页的源代码。写代码时,它还会用「眼睛」去检查自己的产出对不对得上目标——金融、法律、分析、建筑这类文档密集型工作受益最明显。

会自我验证、自我进化

它能根据学到的东西自己更新技能,甚至给自己搭测试框架和评估工具。配合文件式的「长期记忆」,在玩《杀戮尖塔》这种需要长期记忆的游戏时,记忆带来的提升是 Opus 4.8 的三倍。

科研能力(主要在 Mythos 5 上展现)

用 Mythos 5,Anthropic 内部的蛋白质设计专家把药物设计的部分流程加速了约 10 倍;在分子生物学上,科学家在盲测里有约 80% 的概率更喜欢 Mythos 提出的假说;它还独立做了一周多的基因组学研究,训出的模型比《Science》上的近期成果还强,体积却只有人家的 1/100。

安全护栏:能力越大,越要兜底

这么强的模型如果裸奔,在网络安全、生物等领域可能被坏人利用。所以 Fable 5 配了一套独立的「分类器」AI 系统,专门识别滥用和越狱企图。

机制很巧妙:当检测到网络安全、生物化学、模型蒸馏相关的敏感请求时,不直接拒绝,而是自动「降级」交给 Claude Opus 4.8 来回答,并且会告诉你发生了这个切换。

Anthropic 自己说护栏调得偏保守,有时会误伤正常请求。但触发概率平均低于 5%,也就是说超过 95% 的会话完全不会被降级——在这些会话里,Fable 5 的表现和 Mythos 5 基本一致。

而 Mythos 5 就是把这些护栏摘掉的版本。它拥有目前全世界最强的网络安全能力,目前只通过 Project Glasswing(与美国政府合作)给有限的网络防御者和基础设施伙伴使用。

价格:不到 Mythos Preview 的一半

项目价格
输入(每百万 token)$10
输出(每百万 token)$50

Fable 5 和 Mythos 5 同价。需要说明的是,这俩是首发模型,没有「降价迭代」一说——这里的「便宜」是和今年 4 月发布的第一个 Mythos 级模型 Claude Mythos Preview 比,价格不到它的一半(Anthropic 官方说法)。一个细节:在 AWS 上,如果你的请求被降级给了 Opus 4.8,那这部分就按 Opus 的价格收费;如果是对话中途被拦截,前面的 token 按 Fable 价,后面的按 Opus 价。

在 AWS 上怎么用

你有两条路:Amazon Bedrock,或者 Claude Platform on AWS(Anthropic 原生平台体验)。下面以 Bedrock 为例。

第一步:必须先开启数据共享

这是个硬门槛。调用模型前,你得通过 Data Retention API 把 provider_data_sharing 打开。Anthropic 要求对所有 Mythos 级流量做 30 天数据留存,并包含人工审核——目的是发现单次对话看不出来的滥用模式。注意:一旦开启,你的数据就会离开 AWS 的数据与安全边界。

curl -X PUT \
  https://bedrock-mantle.us-east-1.api.aws/v1/data_retention \
  -H "x-api-key: <your-bedrock-api-key>" \
  -H "Content-Type: application/json" \
  -d '{ "mode": "provider_data_share" }'

第二步:调用模型

方式一:用 Anthropic SDK,走 Messages API(bedrock-mantle 端点)。先 pip install anthropic

import anthropic

client = anthropic.Anthropic(
    base_url="https://bedrock-mantle.us-east-1.api.aws/anthropic",
    api_key="<your-bedrock-api-key>",
)
message = client.messages.create(
    model="anthropic.claude-fable-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "..."}],
)
print(message.content[0].text)

方式二:继续用熟悉的 Invoke / Converse API(bedrock-runtime 端点),配合 Boto3:

import boto3

rt = boto3.client("bedrock-runtime", region_name="us-east-1")
resp = rt.converse(
    modelId="global.anthropic.claude-fable-5",
    messages=[{"role": "user", "content": [{"text": "..."}]}],
    inferenceConfig={"maxTokens": 4096},
)
print(resp["output"]["message"]["content"][0]["text"])

几个要点:

  • 区域:目前在**美东(弗吉尼亚北部)欧洲(斯德哥尔摩)**上线。
  • 访问权限正在逐步开放给所有 AWS 账号,没开通的会陆续放开,急用可联系 AWS Support。
  • Mythos 5 在 Bedrock 上是有限预览(Limited Preview),面向网络安全和生命科学等双重用途场景。

聊点别的:藏着的 Mythos,为啥突然就放了?

说白了,4 月份 Mythos Preview 还只给政府和少数安全机构用,一副「太危险不能给你们玩」的样子。结果两个月后,换了个名字、加了层护栏,就大大方方地对所有人开放了。这个转弯,值得琢磨。下面是我的几点观察,纯属个人解读:

  • 官方说法是「护栏成熟了」。Anthropic 的叙事一直是:能力先关起来,等安全措施够强了再放。这次他们做了上千小时的外部漏洞悬赏、红队测试,号称没找到「通用越狱」。这套说辞符合它一贯的人设,也确实有技术支撑。
  • 但竞争压力是绕不开的现实。前沿模型的军备竞赛一刻没停,把最强能力一直锁在保险柜里,等于把市场让给对手。降价一半多、火速铺到 AWS / GCP / Azure 三大云,这是非常明确的「抢市场」动作。
  • 那是不是为了上市造势? 这个不能下定论,但时机确实耐人寻味。一次能拿出「全球最强」的旗舰、又能讲「我们最负责任」的安全故事,对任何想抬高估值、讲增长曲线的公司来说,都是教科书级的好素材。

我的看法:与其说是「为上市造势」,不如说这是一次「安全」与「商业」的精准合流。技术上护栏确实进步了,给了它对外的底气;商业上,前沿能力放太久不变现是巨大的机会成本。「先藏起来、再放出来」本身就是最好的市场剧本——既塑造了「能力强到不敢放」的稀缺感,又在合适的窗口完成了变现。至于是否精准卡着资本节点,外人只能看时机推测,但商业意图是写在脸上的。