智谱 5.3-flash 成了新的斩杀线
智谱 GLM-5.3-Flash 上线即成新标杆:321B 参数、全新架构,靠 10 万+ 张国产芯片跑出 OpenRouter 历史 4 倍的 token 消耗纪录并限时半价。能力越级、价格脚斩的背后,是混合注意力重写与 IndexPool 池化带来的成本重构。 这几天 ox-alpha 用爽了吧… 正如很多人猜的那样,这个模型来自智谱,正式名称为 glm-5.3-flash,支持多模态,但很多人没猜到的是:这个乱杀的模型只有 321B,且与 glm-5.3 不同,是完全的新架构 更尼玛离谱:智谱的这段时间模型给全世界畅跑,完全是用国产卡供的!!其支撑起的单日 token 消耗量,创下了 OpenRouter 平台历史纪录的 4 倍,而这一切的背后,是 10万+ 张国产芯片集群的服务 还有就是:这模型比 ds4p 聪明,比 ds4f 便宜,还开源,至此…大模型行业又多了一条斩杀线
原文:人人产品经理