商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > Day-0支持|摩尔线程完成智谱GLM-5.1极速适配

Day-0支持|摩尔线程完成智谱GLM-5.1极速适配

  发布于2026-08-24 阅读(0)

扫一扫,手机访问

摩尔线程最新动作来了——在其旗舰级AI训推一体全功能GPU MTT S5000上,成功实现了对智谱新一代旗舰模型GLM-5.1的Day-0极速适配。所谓Day-0,就是模型发布当天就能跑起来,这次不仅支持推理部署,还覆盖了训练复现的全流程。

能做到这一点,靠的是MUSA软件栈的生态兼容性。摩尔线程技术团队基于高性能SGLang-MUSA推理引擎和TileLang-MUSA算子编程语言,采用PD分离架构(Prefill/Decode分离)做了深度调优,在MTT S5000上实现了GLM-5.1的高效、高精度推理。换句话说,国产算力基础设施对前沿SOTA模型的响应速度,已经可以做到与模型发布同步。这背后是软硬协同应对复杂AI推理场景的能力,也是行业的一个新标杆。

说到GLM-5.1,智谱这次拿出的确实是迄今为止最智能的旗舰模型,也是目前全球最强的开源模型。最大的亮点在代码能力上——在最接近真实软件开发的SWE-bench Pro基准测试中,它直接超过了GPT-5.4和Claude Opus 4.6,刷新了全球最佳成绩。这还不算完,模型整体性能大幅提升之外,GLM-5.1在长程任务(Long Horizon Task)处理能力上实现了显著突破。和当前大多数只能做分钟级交互的模型不同,GLM-5.1可以在一次任务中独立、持续工作超过8小时,期间自主规划、执行、自我进化,最终交付完整的工程级成果。这就意味着,它已经不再是那个聊几句就忘上下文的“聊天助手”了,而是能真正干活的“工程伙伴”。

针对GLM-5.1的长程任务与代码生成特性,摩尔线程基于自研MUSA架构,以及SGLang-MUSA、TileLang-MUSA这些关键技术,完成了系统性的算子适配与推理性能调优。直接说硬件底子:MTT S5000单卡AI算力(稠密)能达到1000 TFLOPS,支持从FP8到FP64的全精度计算。原生FP8加速直接提升了推理效率,加上高效的KV Cache管理,可以有效支撑极长上下文的显存需求。PD分离架构进一步把Prefill和Decode阶段解耦,降低了长序列生成中的相互干扰,保证持续任务的高吞吐与低延迟。此外,MTT S5000提供784GB/s的卡间互联带宽,大规模部署时弹性扩展能力也不错。通过这一套软硬协同优化,MTT S5000能够稳定承接GLM-5.1的长程任务吞吐与工程级代码推理表现。

回顾一下,从GLM-4.7到GLM-5.1,摩尔线程已经连续实现了发布当日极速适配。这既说明了MUSA架构对主流AI生态的深度兼容,更标志着国产全功能GPU已经具备了大模型“从适配到部署”的全链路支撑能力。下一步,摩尔线程会继续夯实算力底座,帮助开发者快速应用前沿模型,共建更成熟的国产AI生态。

本文转载于:https://www.163.com/dy/article/KVNGOTUV0511RIVP.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

产品推荐

热门关注