商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 海光DCU率先完成GLM-5.2 Day-0适配 长程任务国产底座就绪

海光DCU率先完成GLM-5.2 Day-0适配 长程任务国产底座就绪

  发布于2026-06-17 阅读(0)

扫一扫,手机访问

6月17日,大模型圈迎来一个重磅消息——新一代旗舰开源模型GLM-5.2正式发布,而海光DCU在第一时间就完成了Day 0适配。这意味着国内开发者无需再经历漫长的等待和代码重构,直接就能在国产算力平台上体验它的完整性能与满血实力。

GLM-5.2是智谱针对Coding与长程任务专门打造的旗舰开源模型,代码能力目前在开源模型里直接登顶。在全球百万开发者参与的Code Arena前端盲测中,它甚至排在全球所有可用模型的第一位。再来看几个硬核指标:在Terminal-Bench 2.1(AI Agent命令行操作评测)上,比Claude Opus 4.8只低4%,比上一代GLM-5.1提升了17.5%;在MCP-Atlas(工具使用评测)上距Opus 4.8仅差0.8%。综合来看,它的代码实力大致处于Opus 4.7到4.8之间,主流编程基准保持开源SOTA。

本次适配最值得关注的核心亮点,在于对Solid1M(100万)无损上下文的完美支持。过去,长上下文常常因为算力带宽和显存管理效率不足,实际应用中性能明显劣化。而海光DCU凭借其高带宽内存访问能力和针对长序列推理的优化指令集,成功实现了1M上下文窗口下的稳定表现——这给长程任务提供了坚实的物理基础,也让AI从“辅助对话”进化到了“自主执行”的层面,开发者的生产力被进一步释放。

海光DCU针对GLM-5.2的两个核心场景做了深度优化。在长上下文推理方面,通过改进内存调度机制并引入IndexShare技术(在每四层稀疏注意力层之间复用索引器),1M上下文下单位Token的FLOPs消耗明显降低,保证了超大规模序列处理的稳定性与效率。在代码生成方面,则对关键算子进行了专项调优,确保复杂系统工程下的推理性能。

在实际长程任务中,海光DCU为GLM-5.2提供了持续稳定的算力底座。模型可以在平台上连续完成覆盖Web、移动端和小程序的多端应用开发,累计处理超过88万tokens。再加上IndexShare架构与海光DCU硬件特性的深度契合,双方在有限算力资源下实现了超大规模任务的处理。这不仅意味着国内开发者无需等待就能在国产平台上体验到媲美国际顶级的模型性能,更意味着核心数据与关键业务逻辑可以在完全自主可控的算力底座上安全运行。

海光信息与智谱正在持续推进GLM-5.2的深层优化,进一步释放硬件潜力。接下来,双方将围绕长程任务和代码能力展开更多场景化验证,推动模型在真实软件开发与系统优化中的规模化落地。

本文转载于:https://www.techweb.com.cn/it/2026-06-17/2976665.shtml 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注