8月28日·星期五 12:06·来源:量子位

智谱 GLM-5.3-Flash上线,商汤大装置提供国产算力支持

智谱于8月26日上线并开源GLM-5.3-Flash(320B-A18B),系GLM-5系列首个原生多模态模型,总参数320B,性能超越GLM-5.2。该模型在Artificial Analysis Intelligence Index中获57分,与Claude Opus 4.8持平,进入全球前沿模型区间。其架构专为低成本设计,结合30T Token多模态预训练语料,以更少算力实现更强性能。商汤大装置依托国产异构混推技术,为该模型提供大规模国产算力支持与Token服务。发布前,该模型以匿名身份在OpenCode和OpenRouter测试,Token调用量达62T,全部由国产芯片支撑,端到端服务性能较基线提升3倍,硬件效率及单Token成本已接近英伟达GPU水平。商汤大装置通过异构混合推理技术,使推理性价比达NVIDIA H系列1.25倍,同等成本下Token产能扩大约2.5倍。其Token Factory日均服务量已达2.42万亿,预计2026年底突破日均10万亿。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(量子位)→