GLM-5.3登顶开源榜,价格低Kimi K3 19%,开源却推迟两周
- 1856
中国AI初创公司Z.ai推出的GLM-5.3,在Artificial Analysis Intelligence Index上拿下60分,与Kimi K3并列开源模型榜首,比上一代GLM-5.2高出7分。这个分数背后,是它在智能体任务上的大幅进步。 智能体能力跃升246分 GLM-5.3最明显的提升集中在智能体(agentic)任务上。在GDPval-AA v2基准测试中,它的Elo评分从1,524分跳到1,770分,一口气涨了246分。这个成绩让它在所有模型中排到第二,仅次于Claude Opus 5的1,855分。 简单说,智能体任务考验的是模型能不能自主完成多步骤操作——比如自己规划路径、调用工具、处理中间结果。GLM-5.3在这一项的跨越式进步,是它登顶开源榜的关键推手。 价格策略:比对手便宜近两成 成本方面,Artificial Analysis对GLM-5.3的定价是每任务0.68美元,比上一代GLM-5.2的0.44美元贵了1.5倍,但比Kimi K3的0.84美元便宜19%。 这个定价逻辑值得琢磨:涨价是跟着性能走的,但涨完之后仍然比直接竞品低一截。在开源模型赛道,性能和价格的双重优势往往决定开发者选谁。 开源推迟两周,原因是安全 模型已经可以通过Z.ai的API调用,但开源权重(open weights)的发布要推迟大约两周。Z.ai给出的解释是:GLM-5.3在检测安全漏洞方面太强了,公司需要先加强控制措施,并且只对选定的安全合作伙伴开放完整访问权限。 这个说法有点意思。通常开源模型推迟发布,要么是技术没准备好,要么是合规问题。Z.ai这次把原因归结为"能力太强需要先做安全加固",在行业里不算常见。 怎么看这次发布 从数据看,GLM-5.3在开源模型里确实站到了第一梯队:总分并列第一,智能体任务单项第二,价格比主要对手便宜。但推迟开源这件事,给市场留了一个观察窗口——两周后权重真正放出来,开发者实际跑起来的效果,才是最终检验。 对开发者来说,现在能走的路是先用API试,等开源版本落地再决定是否迁移。对Z.ai来说,性能登顶和价格优势是明牌,安全加固的理由能否被社区接受,要看后续动作。 特别