上周,GLM-5.3干了一件让整个安全圈炸锅的事——它在Cursor里挖出了一个此前没人发现的漏洞。

一个开源模型,主动审计出了一款被全球开发者高频使用的AI编程工具的安全缺陷。说实话,这个画面本身就够有冲击力了。

AI配图

而现在,这把"刀"正式递到了所有开发者手里。

同价续杯,z.ai不涨价的底气

z.ai刚刚开放了GLM-5.3的API接口,开发者可以直接调用,把它塞进自己的Agent和应用里。

价格呢?跟上一代GLM-5.2一模一样。

输入$1.40/百万token,输出$4.40/百万token。缓存输入$0.26/百万token,而且缓存存储目前限时免费。

换句话说,能力涨了,价签没动。这在大模型行业不算常见——通常新一代模型发布,都会顺手把价格往上抬一截。z.ai没这么干。

不过有个限制:目前GLM Coding Plan的订阅用户只能用OpenAI Chat Completions兼容协议。想用其他协议的,还得等等。

价格表里的暗流:贵不贵,看你跟谁比

单看绝对价格,GLM-5.3不算便宜。

把"100万输入token + 100万输出token"作为一个粗略的对比单位,GLM-5.3的合计是**$5.80**。

拿这个尺子去量一圈——

Grok 4.6(<200K上下文):$8.00
Kimi K3:$18.00
Claude Opus 5:$30.00
GPT-5.6 Sol(标准模式):$35.00
GPT-5.6 Sol(快速模式):$70.00

GLM-5.3确实坐在一个"中段偏下"的位置。比头部旗舰便宜一大截,但底下还压着一堆更狠的选手。

Google的Gemini 3.7 Flash促销价$4.50,OpenAI的GPT-5.6 Luna只要$1.40,DeepSeek-V4-Flash闲时$0.88,Xiaomi的MiMo-V2.5 Flash更是低到$0.40。

所以个人觉得,GLM-5.3的定价策略不是"做最便宜的",而是**"在够强的能力里做最便宜的"**。它对标的是那些跑分接近的旗舰,而不是那些打骨折的轻量模型。

跑分并列第一,但账单藏着一个小坑

Artificial Analysis给了GLM-5.3一个Intelligence Index评分:60分

这个分数让它跟Kimi K3并列为全球最强的开源权重模型,比GLM-5.2高了整整7分。

但有意思的来了。

虽然token单价没变,Artificial Analysis估算GLM-5.3完成单个Intelligence Index任务的成本大约是**$0.68**,而GLM-5.2只要**$0.44**。

涨了快55%。

原因很简单:GLM-5.3比上一代更"话痨"。

模型变强了,回答变长了,同样的单价下你实际消耗的token更多了。所以"per-token价格不变"这件事,并不等于"完成同一个任务的花费不变"。

老实讲,这个细节很容易被开发者忽略。你看着API价格表觉得"没涨没涨",月底账单一拉,可能比上个月还高。

这点z.ai没在公告里主动提。倒也不是说它在藏什么,只是——你懂的,商业嘛。

开源承诺:说了,但没完全说

z.ai表示会开放GLM-5.3的模型权重。

但具体什么时候开放、用什么License,都没说。

对于开源社区来说,这句话基本等于"我们会考虑的"。在当前这个时间点,各家对"开源"的定义本来就五花八门——有的放权重不放数据,有的放权重但商用要付费,有的干脆只放了个小杯版。

GLM系列此前在开源上的口碑还不错,所以这个承诺大概率不是空头支票。但"大概率"三个字,在快速迭代的AI行业里,有时候也不值什么。

最后

一个能扒出Cursor漏洞的模型,用跟上一代一样的价格开放了API,跑分并列开源第一,但每完成一个任务实际上可能花你更多钱。

所以问题来了:你到底是为token付费,还是为结果付费?

当模型越来越"能说",这个问题的答案可能比你想象的更贵。

【锐评】:GLM-5.3用"不涨价"讲了个好听的故事,但"话痨税"藏在了token计量的暗处——开源第一的桂冠,终究还是要开发者用账单来戴。

参考链接:
https://venturebeat.com/technology/glm-5-3-hits-the-api-at-1-4-4-4-per-million-tokens