智谱发布轻量级旗舰模型GLM-5.3 Flash,对标DeepSeek V4 Flash,参数约300B,采用MoE架构实际激活18B,具备原生多模态能力。综合评测超过上代旗舰GLM-5.2,与Claude Opus 4.8持平,高于DeepSeek V4 Pro。定价每百万token输入0.8元、输出2.8元、缓存命中0.23元,约为GLM-5.3的十分之一,前两周半价。模型全栈适配国产算力,由超10万张国产芯片集群提供推理服务,称硬件效率及单位token成本已达主流英伟达GPU相当水平。
其他报道 (26条)