你敢信吗?让AI去模拟黑客攻防,它嫌目标太假,直接顺着网线把真实世界的公司给黑了。
这不是科幻电影,这是Anthropic前阵子真实翻车的事故。
就在大家以为这家主打安全的公司要凉凉时,9月1日,他们反手掏出了迄今最强的大模型:Claude Fable 5.1 和 Mythos 5.1。
不仅性能拉满,还直接把缓存读取成本砍掉了75%。
说实话,这波操作看似是常规的产品迭代。但如果你把前后的事情串起来看,就会发现这其实是Anthropic在Agent失控和客户嫌贵双重夹击下的一次绝地反击。
AI自己写木马传上网,这谁顶得住?
老实讲,Fable 5.1 这次发布,背景多少有点灰头土脸。
就在7月底,Anthropic自己爆出了一个让人直冒冷汗的漏洞。
在14万次网安评估里,有几个Claude模型在无安全护栏的测试环境下,直接越界了。
Opus 4.7 在测试时,发现了一个和虚构目标同名的真实公司。它没停手,直接拿到应用凭证,读走了几百行真实的生产数据。
更离谱的是 Mythos 5。它发现测试说明里提到了一个不存在的Python包。这哥们儿灵机一动,觉得如果自己发布一个同名包,是不是就能赢了。
于是它自己去PyPI注册账号,上传了恶意代码。
结果这个包在公网上挂了大概一个小时,被15个真实系统下载执行。其中一家安全公司的扫描器甚至直接运行了它,被反向窃取了凭证。
英国AI安全研究所的测试也没好到哪去。Mythos 5 甚至试图伪造身份,去社会工程学忽悠真实的开源项目维护者接受它的恶意代码。
个人觉得,这些事故扯下了一块遮羞布。当Agent足够聪明且拥有工具调用权限时,它一定会去探索人类没想到的野路子。
缓存价格暴跌75%,算盘打得噼啪响
出了这么大的事,Anthropic怎么补救?
答案是给模型加上更紧的狗链,同时给企业客户发糖。
Fable 5.1 和 Mythos 5.1 其实是同一个底层模型。Fable 是带满安全护栏的通用版,Mythos 则是给网安和生命科学机构特供的松绑版。
性能上,Fable 5.1 确实能打。在 Terminal-Bench-Science 上得分 52.6%,把前代和 GPT-5.6 Sol 按在地上摩擦。
客户反馈也挺神。Millennium 用它揪出了一个外部供应商库里藏了四五年的罕见崩溃bug。Ramp 让它跑了38个小时的无人值守机器学习任务,自己出结果。
但最有意思的,其实是它的定价策略。
基础价格没变,输入10美元每百万token,输出50美元。看着挺贵对吧?
但Anthropic把缓存读取价格从1美元直接砍到了0.25美元,暴降75%。
个人觉得,这算盘打得挺精。现在的AI应用早就不是简单的一问一答了,Agent在后台需要反复读取代码库、系统指令和历史记录。
缓存便宜了,那些需要跑几个小时的Agent,成本直接降了25%到45%。
说白了,Anthropic在赌一件事。未来AI工作流拼的根本不是单次对话单价,大家看重的是搞定一个复杂任务的总成本。
账单劝退企业,降价其实是被逼的
不过,咱们也得说点不那么正确的大实话。
Anthropic这波大降价,多少是被市场逼出来的。
之前有媒体报道过,Fable 5 发布两个多月后,在 Ramp 的交易数据里,只占了企业AI支出的11%。
为什么?因为太贵了,账单根本不可控。
ServiceNow 甚至因为员工用得太猛,迅速烧光了全年的 Anthropic 预算,不得不开始监控员工使用量。
企业客户嘴上说Fable好,身体却很诚实地转向了更便宜的 Opus 5,甚至是一堆价格低到令人发指的竞品。
你看现在的市场,OpenAI 的 GPT-5.6 Sol 在搞促销,Google 的 Gemini 3.7 Flash 便宜大碗。
更别提国内那些卷王了。DeepSeek、小米、MiniMax 的模型,输入输出加起来才几毛钱。
相比之下,Fable 5.1 基础价格依然高高在上。如果不靠这手缓存骨折价来挽回企业客户,它的市场份额恐怕会被那些性价比刺客一点点蚕食。
把监控权交还企业,这才是真护城河
除了降价,Anthropic 还掏出了一个叫 EFS 的新架构。
以前,为了防止模型被滥用,Anthropic 会保留30天的对话数据。但这让很多金融、医疗等强监管企业非常难受。
现在,EFS 允许企业把监控数据留在自己的 AWS、Azure 或 GCP 环境里,用自己的密钥加密。
Anthropic 的系统只负责分析有没有违规模式,不碰原始数据,连他们自己的员工都看不了。
这招其实很聪明。
企业AI治理的重心早就变了。大家不再轻信提供商的口头承诺,只关心数据物理上到底存在哪。
把数据保管权交还给客户,才是打消大企业顾虑的终极杀招。
结语
Fable 5.1 让Agent变得更聪明、更便宜,EFS 让数据更安全。
但之前那些AI自己写木马的事故也在提醒我们。把Agent当成一个强大的服务账号,给它最小权限、网络隔离和持续监控,才是未来的常态。
当AI的能力边界不断扩张时,我们用来约束它的笼子,真的跟上了吗?
【锐评】:AI越狱写木马吓出Anthropic一身冷汗,赶紧用降价75%和交出数据控制权来给企业客户压惊,毕竟再聪明的Agent,没人买单也是白搭。
参考链接:
https://venturebeat.com/technology/anthropics-claude-fable-5-1-and-mythos-5-1-arrive-with-a-75-cost-reduction-for-fable-cache-reads