7月16日,Kimi K3追平Opus。
4周后,GLM 5.3把参数和成本砍到三分之一。
仅仅12天后,GLM 5.3-Flash来了。
参数再砍一半,价格直接打到五分之一。
老实讲,看到Z.ai这波操作,我第一反应是:这还让不让别人活了?
更有意思的是,Z.ai的官方博客正文,没写枯燥的技术文档,直接甩出了一份极具极客浪漫的《八大行星档案》(EIGHT WORLDS)。
一边是残酷到见血的AI价格战,一边是仰望星空的宇宙浪漫。
这种反差,绝了。
参数砍半,价格打骨折,国产芯片立功
先说硬实力。
GLM-5.3-Flash的性能,在评论区被各路硬核玩家扒了个底朝天。
比Luna xhigh聪明且便宜,比Luna max便宜。
击败DeepSeek v4 flash,匹配v4 pro但成本极低。
相当于Sol medium,但价格只有个零头。
最绝的是,它修复了上一代推理token数量过大的毛病。
现在成本跟DeepSeek v4 flash差不多,但脑子更灵光。
但这还不是最狠的。
最狠的是这句话:“all of this traffic served on Chinese AI chips.”
所有的流量,全跑在国产AI芯片上。
英伟达股东看了,估计得默默点根烟。
有硬核玩家已经算过账,花1万美元买硬件本地跑这个模型,几个月就能回本。
当算力不再被卡脖子,当推理成本被压到极致,大模型的牌桌,正在被重新洗牌。
“ox-alpha”的瞒天过海与估值泡沫
技术猛,营销更野。
发布前,Z.ai把GLM-5.3-Flash化名“ox-alpha”,偷偷扔到OpenCode和OpenRouter上盲测。
结果呢?它迅速成了当周最受欢迎的模型。
连谷歌的高级员工都被骗了,之前还在社区里含糊其辞地vagueposting,到处猜这到底是哪家的模型。
说实话,这种“扮猪吃老虎”的戏码看着很爽。
但评论区有明白人指出了更深层的东西:
“这其实是一场公开的埋葬(open burial)。”
AI经济的估值泡沫,正被这种极致的性价比无情戳破。
开发成本、硬件成本、推理成本,全在暴跌。
当模型越来越聪明,价格越来越低,那些靠“信息差”和“算力垄断”撑起的高估值,还能撑多久?
技术再猛,也掩盖不了“霸王条款”的猫腻
反转来了。
模型再牛,也挡不住网友去扒它的服务条款。
Z.ai的TOS(服务条款)里,藏着几个让人心里咯噔一下的设定:
- 广泛且永久的许可:不仅输入输出归他们,连你的名字和头像都要授权。
- 模糊的禁令:禁止任何损害Z.ai利益,甚至损害任何“国家利益”的内容。
- 最终解释权:只要Z.ai“单方面绝对认为”你违规,就能随时封号。
个人觉得,在如今这个强调数据隐私和开源精神的时代,这种条款简直是个定时炸弹。
特别是“国家利益”和“令人不安”这种极其模糊的字眼,边界在哪?
企业用户敢把核心数据喂给它吗?
模型再聪明,如果信任底座不稳,一切都是白搭。
暗淡蓝点与AI宇宙的引力
回到那篇《八大行星档案》。
从水星的冰火两重天,到海王星2100公里/小时的超音速风暴。
Z.ai用20张图版,丈量了太阳系的空旷与深邃。
最后,画面定格在旅行者1号在60亿公里外拍下的地球。
在画面中,地球只占0.12个像素。
“Look again at that dot. That's here. That's home. That's us.”
“...a mote of dust suspended in a sunbeam.”
在这个宏大的宇宙尺度下,大模型的参数、算力、价格战,似乎都变得微不足道。
但正是这些看似枯燥的数字和代码,正在重塑我们这颗“暗淡蓝点”的未来。
算力是引力,价格是轨道。
Z.ai用GLM-5.3-Flash在国产芯片上跑出了一个新纪元。
只是在这个新纪元里,我们交出的数据隐私,最终会通向星辰大海,还是沦为条款里的一串字符?
【锐评】:用国产芯片把价格打穿确实提气,但服务条款里那些模糊的“霸王规定”,迟早会教大厂做人。
参考链接:
https://z.ai/blog/glm-5.3-flash