当最强AI学会“自我阉割”:Claude Fable 5,一个能力与恐惧的混合体
全球最强AI模型,今天正式对所有人开放。
但你拿到手的,可能是一个被“阉割”过的版本。
Anthropic刚刚发布了Claude Fable 5,一个被称为“Mythos级”的怪物。它的能力全面碾压以往所有公开模型,在编程、科研、视觉任务上都是断层第一。但与此同时,它内置了一套精密的“安全开关”。
一旦你问到网络安全或生物化学的“敏感问题”,这个最强大脑会瞬间哑火,把你的请求悄悄转交给它那个更安全、但更弱的“兄弟”——Claude Opus 4.8来回答。
最强的武器,被主人亲手套上了枷锁。
能力怪兽:把“月”压缩成“天”
让我们先看看这个被“限制”的模型,到底有多强。
简单说,它把“长期任务”变成了“一次性任务”。 Stripe的工程师用它,在一个5000万行的Ruby代码库里,一天内完成了需要一个团队手动做两个多月的代码迁移。GitHub的测试人员说,以前需要上百次提示才能搞定的应用,现在它一次就能生成。
它的视觉能力是新的SOTA。以前的Claude玩个《精灵宝可梦 火红》都得靠一堆外挂工具,Fable 5光看游戏画面截图就直接通关了。 这就像蒙着眼睛走迷宫,它不仅没撞墙,还拿了通关纪录。
在更硬核的领域,它的表现更吓人。
- 药物设计: 内部专家用它,把药物设计的某些环节加速了10倍。
- 科研颠覆: 它自主工作一周多,分析了百万级别的单细胞数据,设计的模型性能吊打顶级期刊《Science》上发表的成果,而且模型小100倍。
- 金融市场: 它在IMC的交易分析评估中几乎全科满分。
它的价格更是个王炸: 输入百万token只要10美元,输出50美元。这比上一代顶级模型便宜一半还多。Anthropic的意思很明确:要用低价,把最强的“通用智能”铺到每个人的电脑上。
恐惧之源:被锁住的“超级大脑”
但问题来了。一个能力这么强、还这么便宜的AI,如果被坏人用来搞网络攻击、设计生物武器,怎么办?
这就是Claude Fable 5和它被“阉割”的根源。
Anthropic坦承,Fable 5的底层模型,其实就是给特定机构用的、毫无限制的Claude Mythos 5。两者的区别,全在于那套安全分类器。
这套系统像一个过分敏感的警卫。当它检测到你的问题涉及“网络安全”、“生物化学”甚至“试图蒸馏模型能力”时,会立刻触发警报,把请求转给更安全的Opus 4.8。
所以,你付了Fable 5的钱,但在关键问题上,你得到的是Opus 4.8的智商。
Anthropic也承认,这套系统“保守得过分”,平均有5%的无害请求会被误伤。他们正在努力改进,但态度很明确:宁可错杀,不可放过。
他们甚至做了一个看似“自断财路”的决定:强制要求所有商业用户的数据保留30天,专门用于监控和反击复杂的越狱攻击。 这等于承认,模型太强,他们自己也怕。
暗中赢家:一个特权俱乐部的盛宴
那么,完全体的Mythos 5,谁在用?
答案是一个正在扩大的、与政府合作的“特权俱乐部”。
最初,只有美国“玻璃翼计划”下的网络防御专家和关键基础设施提供商能用。现在,Anthropic计划扩大这个“可信访问计划”,接下来还会专门为生物医药研究人员开一个口子。
这意味着:AI的能力等级,正在人为地被划出三六九等。
- 普通人(Fable 5用户): 用着被限制的最强模型,接触不到最危险也最强大的能力。
- 可信伙伴(Mythos 5用户): 使用无限制的完全体,用于防御和特定研究。
- 模型本身(Mythos 5): 在药物设计、基因组学上展现出惊人的科学突破潜力,但这些潜力大部分普通用户无缘得见。
个人觉得,这才是最值得关注的转折。 我们通常谈论AI的能力差距,是算力、算法、数据的差距。但Fable 5的发布宣告了一种新差距:访问权限的差距。 同样的模型底子,因为使用场景不同,被授予了截然不同的能力。这会让AI的发展越来越像核技术吗?
一场关于“可控进步”的豪赌
回顾整件事,你会发现Anthropic在走钢丝。
一头是商业野心: 他们想用最低的价格、最快的速度,把最强的AI卖给所有人,抢占市场。
另一头是生存恐惧: 他们怕这个自己造出来的“怪物”失控,酿成灾难,或者被竞争对手“蒸馏”走。
所以他们做出了这个看似矛盾的产品:一个公开售卖的、但核心能力被锁住的“最强模型”。
这就像在卖一把绝世神剑,但附赠了一个只能在花园里修剪花草的剑鞘。你想劈开巨石?对不起,那得凭“可信凭证”来换个剑鞘。
从评论区也能看出这种撕裂。有开发者狂喜,说它解决了自己几个月的难题;也有人吐槽,问到关键领域就被“转接”太扫兴。
说实话,我对此是既佩服,又感到一丝凉意。
佩服的是,Anthropic至少愿意直面风险,宁可损失体验也要加上枷锁。凉意在于,这种“能力分级”的模式一旦成为行业标准,我们离一个由少数公司或机构掌握“终极AI”,而大众只用“幼儿版AI”的未来,还有多远?
Fable 5不是一个产品,它是一个信号。它标志着AI发展进入了“能力溢出期”,强大到必须主动自我限制。
当AI开始拥有“不能使用的最强能力”时,我们争论的,早已不是技术本身。
而是,谁有资格决定,这把最强的剑,该指向何方?
【锐评】:用户付了钱,买了个号称最强的大脑,结果发现最关键的决策,得由另一个“更安全”的大脑来做——这大概是最昂贵的“买椟还珠”了。
参考链接:
https://www.anthropic.com/news/claude-fable-5-mythos-5