跳到主内容

行业资讯

摩尔线程完成智谱GLM-5.3-Flash极速适配

行业资讯
www.ithome.com 原文配图:Day-0 支持:摩尔线程官宣完成智谱 GLM-5.3-Flash 极速适配 - IT之家

摩尔线程官方今日宣布,基于AI训推一体智算卡MTT S5000及MUSA软件栈,实现对智谱GLM-5.3-Flash模型的Day-0支持,完成极速适配与高效运行。该模型为GLM-5系列首个原生多模态模型,总参数达320B,激活参数仅18B。

在性能表现上,GLM-5.3-Flash于全球权威的Artificial Analysis Intelligence Index中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现亦与Claude Opus 4.8相当。

此前,该模型以代号Ox-Alpha(社区昵称“牛来”)在OpenCode和OpenRouter进行匿名公测,凭借出色的推理速度与智能表现,迅速成为当周最受欢迎的模型,创下双平台调用量新高。

针对GLM-5.3-Flash的混合架构中线性注意力采用的KDA机制,摩尔线程工程团队在发布当日完成模型架构拆解、核心技术分析与典型算子梳理,基于MATE算子优化引擎快速实现状态矩阵更新、分块并行扫描等全新算子形态的定制与深度调优,并与SGLang-MUSA缓存管理体系深度协同、无缝打通,充分释放KDA在长上下文推理中的效率优势。

GLM-5.3-Flash开源地址:https://huggingface.co/zai-org/GLM-5.3-Flash

来源链接:https://www.ithome.com/0/995/237.htm

来源: 据www.ithome.com发布的信息整理。

标签: AI

摩尔线程完成智谱GLM-5.3-Flash极速适配 | 数字科技 | 星之燧集团