Anthropic 昨晚一口气放出俩新模型,Fable 5 和 Mythos 5。
那个一直藏着掖着的“Mythos (神话)级别”能力,终于拿出来给普通人了。
但你能拿到的,是 Fable 5。Mythos 5 那个版本,还是只给少数人。这俩之间的关系,是这篇最该先讲清楚的事。
01先搞懂这对“双胞胎”
要听懂这事,得先知复习一下 Claude 原来的模型系列。
过去两年,Claude 的模型一直是三个档,从低到高:Haiku 干粗活,Sonnet 是中间档最常用,Opus 是最强旗舰。你以前能摸到的天花板,就是Opus。
今年 4 月,这个天花板被捅破了。
Anthropic 在 Opus 头上又搭了一层阁楼,叫 Mythos,比 Opus 高一级,是个全新的档位。这次的 Fable 5 和 Mythos 5,就住在这层阁楼里。
换句话说,它俩天生就比我们之前用过的任何 Claude 都高半头。
回到这俩“双胞胎”。Fable 5 和 Mythos 5,名字花里胡哨,你只要记住一句话:它俩是同一个大脑。
底层一模一样,唯一的区别是,有没有戴镣铐。
打个比方。一个绝顶高手,武功盖世。
Fable 5,是这高手戴着镣铐上街,谁都能找他比划,但有些狠招使不出来。这个版本,今天起你我都能用。
Mythos 5,是同一个高手把镣铐解开,关进实验室。只给信得过的人用,主要是搞网络安全的政府机构和大公司,普通人摸不着。
连名字都藏了心思。Fable 是拉丁语“寓言”,Mythos 是希腊语“神话”,本来就是一个意思。同根同源,区别只在那副镣铐。
02几乎屠榜,只输给自己
Fable 5 全面超越了 Anthropic 此前敢公开的任何一个模型。而且任务越长越复杂,它甩开别人越远。
直接上官方那张对比表,同台的有自家老二 Opus 4.8、OpenAI 的 GPT 5.5、谷歌的 Gemini 3.1 Pro,还有它自己的上一代特供版 Mythos Preview。
![]()
▲ 图:官方跑分对比表,带星号的是被安全机制影响的项目
我就不一一过了,挑几个差距大到离谱的给大家说说。
写代码那项,它把 GPT 5.5 和 Gemini 甩开了 20 多分,不是赢一点,是不在一个段位。
最难的那项编程测试更夸张,它能做对将近三成,GPT 5.5 连一成不到。这已经不是领先了,是降维打击。
法律那项最离谱。它分数本身不高,但看对手,GPT 勉强及格线都够不着,Gemini 干脆交了白卷,零分。这个赛道,目前基本没人能跟它站同一个台子上。
一句话:你能想到的主流对手,在这张表上几乎被它按在地上摩擦。
但有意思的是,它也有翻车的地方。
电脑操作那项,它居然输了,输给谁了?输给它自己的上一代 Mythos Preview,差了零点几分。
换句话说,这模型现在强到什么程度,全世界唯一还能跟它掰掰手腕的,只剩它自己的前一个版本了。
03具体强在哪,挨个说
跑分是抽象的,Anthropic 找了一堆真用过的公司现身说法。我按领域拆开讲,你看看哪块跟你有关。
第一块,写代码。这是它的看家本领。
最出圈的是 Stripe。他们有个老到不行的庞大系统要做全面改造,这种活,一个工程师团队正常得吭哧吭哧干两个多月。
Fable 5 用了一天。
![]()
它牛的地方不只是快,而是能“放养”。挂在 Claude Code 这类工具里,它能连干好几天不用人盯着,自己规划步骤、自己写测试验证、干到一半还会回头检查有没有跑偏。
GitHub 的人说,它能接那种以前只能交给人的、跨好几天的复杂任务。
第二块,知识工作。就是查资料、写报告、做分析这些白领日常。
Notion 的说法很形象:那种你“一下午都磨不完”的活,把一堆乱七八糟的笔记丢给它,它能直接给你整理成一份能用的项目计划。
简单说,它不是帮你写一段话,是帮你把整件事从头办到能交差。你只管验收,不用盯着每一步。
第三块,金融和法律。专业白领的硬骨头。
一家叫 Balyasny 的资管公司说,这是他们测过的最强的金融模型。它能啃那种藏在长篇财报附件里的数字,做投资研究、算风险。
法律这边,一家叫 Crosby 的律所说了句挺重的话:
“盲测里,我们律师发现它改的合同,每一次都追平甚至超过现用模型。”
每一次。这个词从律师嘴里说出来,分量不轻。
第四块,视觉。这是它这次升级最猛的地方之一。
它能看懂塞在文件和 PDF 里的图表、表格,这对天天跟文档打交道的金融、法律、分析岗特别有用。
更骚的是,它玩经典游戏宝可梦,全程只盯着游戏画面截图,没地图、没攻略,就靠一双“眼睛”裸眼通关。换以前的模型,得配一大堆辅助工具才勉强能玩。
还有一个能力,贯穿上面所有块:自动化。
一家叫 Zapier 的公司有句话点得很到位:
换 Opus 会停下来问你,Fable 5 会自己接着找。自动化平台 Zapier 的评价
这句话其实道破了这代模型的本质。它不再是个等你下指令的聊天框,而是个能自己往下推进、不撞墙不回头的“干活的”。
它还顺手干了件吓人的事:自己设计药物。
官方的蛋白质设计专家用它,把做药的某个环节提速了大概十倍,一批靶点里有大半跑出了能往下做药的候选方案。
它还自己搞了一周多的基因组研究,训出来的小模型,效果干翻了之前发在顶级期刊《Science》上的模型,个头只有人家的零头。
看到这儿你大概有数了。官方自己的形容是:它干活越来越不像个聊天助手,越来越像个能独当一面的资深同事。
04为什么给它戴镣铐
因为太强了,真怕。
它能自己设计药物蛋白,这本事用对方向是救命,用错方向就是造毒。它在网络攻击上也强得离谱,能自己找漏洞、自己发起攻击,这要落到坏人手里,等于给黑客直接开挂。
其实 Mythos 当初不敢公开,主要就是这个原因,挖漏洞的能力太吓人,只能先偷偷给搞网络安全的人用。
更拧巴的是,Anthropic 前脚刚公开警告“AI 正在变得太危险”,后脚就把这个最强的放出来了。一边喊危险,一边发最强,这操作本身就够迷惑的。
他们的解法是加一道安检。你要是问到网络安全、生物化学这几类敏感问题,这个最强模型并不会直接回答,而是自动把你的问题转给稍弱的老模型 Opus 4.8,还会明明白白告诉你“这题我转给同事了”。
为了证明这道锁结实,他们专门请红队来砸,砸了一千多个小时,愣是没找出一个能通用的破解办法。
代价是,有时候好人正常提问也会被误伤。官方也承认这道安检调得偏严,宁可错杀。不过他们说,真正触发的对话不到二十分之一,绝大多数情况你根本碰不到,用的就是满血版。
![]()
这副镣铐的痕迹,你在那张跑分表里就能亲眼看到。
带星号的几项,生物、网络安全、健康,戴镣铐的 Fable 和摘镣铐的 Mythos 分数突然拉开。
因为 Fable 在这些领域会触发拦截、甩锅给 Opus,真实表现更贴近那个稍弱的 Opus。在最极端的攻击型网络安全测试里,开了拦截的 Fable,干脆就是零分。
换句话说,你能从一张冷冰冰的跑分表里,直接看出哪几项被上了锁。那个星号,就是镣铐留下的印子。
05价格:全球最贵的那个
价格这事,得两头说。
它比上一代特供版砍了一半还多,听着像捡了大便宜。但你先别急着高兴,这个价,依然是全球主流模型里最贵的那一个,差不多是自家 Opus 4.8 的两倍。
主流模型综合价格对比(每百万 token,美元) 小米 MiMo Flash $0.4 DeepSeek V4 Pro $1.3 Gemini 3.1 Pro $22 Claude Opus 4.8 $30 GPT 5.5 $35 Claude Fable 5 / Mythos 5 $60 全球最贵 注:综合价 = 每百万输入 + 输出 token 价格之和
▲ 图:把主流模型按价格排队,Fable 5 站在最贵那头
所以这便宜,是跟它自己的前身比;贵,是跟全世界比。
怎么用,也透着一股扭捏。开发者今天起就能直接调用。
但订阅用户(Pro、Max、Team 这些)就复杂了:这两周免费用,到 6 月 22 号截止;过了这天,Anthropic 就把它从套餐里撤下来,之后想用得自己掏额度;等以后服务器扛得住了,再考虑塞回套餐。
给的理由是需求太猛,扛不住。、
还有个容易踩的坑:这类模型的所有数据,Anthropic 要求强制保留 30 天,哪怕你之前签的是“零留存”协议也得跟着改。
说是为了防新型攻击,不拿去训练。但对在意数据的人来说,这是个得留个心眼的变化。
也就是说,想白嫖史上最强,就 6 月 22 号之前这两周,过期不候。
我看完最大的感受,不是这模型多牛,而是行业的画风变了。
以前我们抱怨,是模型不够强,答不上来、办不成事。
现在反过来了,是模型强到厂商自己都得给它上锁,前脚喊完“太危险”,后脚就一边端出来一边给它戴镣铐。
至于那副镣铐,到底是真为了安全,还是顺手把最猛的能力留给了付费机构、把最贵的价签挂给了所有人,这事我没答案,你自己琢磨。
从“我盼着它更强”,变成了“我得琢磨怎么管住它”。这个转折,挺微妙的
免费窗口就这两周,你会去试试这个“史上最强”吗?
觉得有用 → 点个❤️在看,下次它没准能帮你把两个月的活一天干完
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.