上周,GLM-5.3干了一件让整个安全圈炸锅的事——它在Cursor里挖出了一个此前没人发现的漏洞。
一个开源模型,主动审计出了一款被全球开发者高频使用的AI编程工具的安全缺陷。说实话,这个画面本身就够有冲击力了。
而现在,这把"刀"正式递到了所有开发者手里。
同价续杯,z.ai不涨价的底气
z.ai刚刚开放了GLM-5.3的API接口,开发者可以直接调用,把它塞进自己的Agent和应用里。
价格呢?跟上一代GLM-5.2一模一样。
输入$1.40/百万token,输出$4.40/百万token。缓存输入$0.26/百万token,而且缓存存储目前限时免费。
换句话说,能力涨了,价签没动。这在大模型行业不算常见——通常新一代模型发布,都会顺手把价格往上抬一截。z.ai没这么干。
不过有个限制:目前GLM Coding Plan的订阅用户只能用OpenAI Chat Completions兼容协议。想用其他协议的,还得等等。
价格表里的暗流:贵不贵,看你跟谁比
单看绝对价格,GLM-5.3不算便宜。
把"100万输入token + 100万输出token"作为一个粗略的对比单位,GLM-5.3的合计是**$5.80**。
拿这个尺子去量一圈——
Grok 4.6(<200K上下文):$8.00
Kimi K3:$18.00
Claude Opus 5:$30.00
GPT-5.6 Sol(标准模式):$35.00
GPT-5.6 Sol(快速模式):$70.00
GLM-5.3确实坐在一个"中段偏下"的位置。比头部旗舰便宜一大截,但底下还压着一堆更狠的选手。
Google的Gemini 3.7 Flash促销价$4.50,OpenAI的GPT-5.6 Luna只要$1.40,DeepSeek-V4-Flash闲时$0.88,Xiaomi的MiMo-V2.5 Flash更是低到$0.40。
所以个人觉得,GLM-5.3的定价策略不是"做最便宜的",而是**"在够强的能力里做最便宜的"**。它对标的是那些跑分接近的旗舰,而不是那些打骨折的轻量模型。
跑分并列第一,但账单藏着一个小坑
Artificial Analysis给了GLM-5.3一个Intelligence Index评分:60分。
这个分数让它跟Kimi K3并列为全球最强的开源权重模型,比GLM-5.2高了整整7分。
但有意思的来了。
虽然token单价没变,Artificial Analysis估算GLM-5.3完成单个Intelligence Index任务的成本大约是**$0.68**,而GLM-5.2只要**$0.44**。
涨了快55%。
原因很简单:GLM-5.3比上一代更"话痨"。
模型变强了,回答变长了,同样的单价下你实际消耗的token更多了。所以"per-token价格不变"这件事,并不等于"完成同一个任务的花费不变"。
老实讲,这个细节很容易被开发者忽略。你看着API价格表觉得"没涨没涨",月底账单一拉,可能比上个月还高。
这点z.ai没在公告里主动提。倒也不是说它在藏什么,只是——你懂的,商业嘛。
开源承诺:说了,但没完全说
z.ai表示会开放GLM-5.3的模型权重。
但具体什么时候开放、用什么License,都没说。
对于开源社区来说,这句话基本等于"我们会考虑的"。在当前这个时间点,各家对"开源"的定义本来就五花八门——有的放权重不放数据,有的放权重但商用要付费,有的干脆只放了个小杯版。
GLM系列此前在开源上的口碑还不错,所以这个承诺大概率不是空头支票。但"大概率"三个字,在快速迭代的AI行业里,有时候也不值什么。
最后
一个能扒出Cursor漏洞的模型,用跟上一代一样的价格开放了API,跑分并列开源第一,但每完成一个任务实际上可能花你更多钱。
所以问题来了:你到底是为token付费,还是为结果付费?
当模型越来越"能说",这个问题的答案可能比你想象的更贵。
【锐评】:GLM-5.3用"不涨价"讲了个好听的故事,但"话痨税"藏在了token计量的暗处——开源第一的桂冠,终究还是要开发者用账单来戴。
参考链接:
https://venturebeat.com/technology/glm-5-3-hits-the-api-at-1-4-4-4-per-million-tokens