单节点40张GPU 中科曙光发布无线缆箱式超节点scaleX40
中科曙光联合上海人工智能实验室推出面向科学智能的算力架构DeepLinkFabric,并发布全球首款无线缆箱式超节点scaleX40。该节点单机集成40张GPU,总算力超28PFLOPS,采用正交无线缆一级互连,互连功耗降低40%至70%,系统可用性达99.99%,运维效率提升约10倍。标准19英寸16U箱式设计适配现有数据中心,开箱即用。
中科曙光联手上海人工智能实验室,正式推出了一个面向科学智能的算力架构——DeepLink Fabric,同时发布了全球首款无线缆箱式超节点scaleX40。这个超节点单机就能集成40张GPU,总算力超过28PFLOPS,关键还采用了无线缆的一级互连设计。说白了,就是为AI for Science和大模型训练场景,提供了一个更高效、更易部署的算力底座。
ScaleX40作为DeepLink Fabric的核心计算单元,单节点集成40张GPU,总算力超过28PFLOPS(FP8),HBM总显存超过5TB,scale-up聚合带宽超过17TB/s。这些数字意味着什么?简单说,就是万亿参数级别的MoE模型训练和推理,它都能轻松应对。

架构设计上,scaleX40采用了正交无线缆一级互连方案。计算节点和交换节点直接对插,省掉了传统铜缆或光纤互联。直接带来的好处是什么?一是布线复杂度大幅降低,故障率也下去了;二是系统可用性提升到了99.99%,组装维护时间缩短到分钟级,运维效率提升了约10倍。更值得关注的是,相比光纤方案,互连功耗能降低40%到70%。在算力密度越来越高的今天,这个功耗优化很关键。
对于企业和科研机构来说,部署门槛也是硬指标。scaleX40采用标准19英寸箱式设计,单个超节点只占16U空间,适配现有数据中心机房,不需要额外改造供电、承重或液冷系统,开箱即用。一个标准机柜就能部署两个scaleX40超节点,共80张GPU。在兼顾算力密度的同时,明显降低了建设和部署的门槛。这才是真正的“开箱即用”。

除了硬件本身的创新,DeepLink Fabric在架构层面也做了不少文章。它支持拓扑可编程、异构资源调度,能根据不同科学计算任务动态优化GPU互联方式,从而提升集群整体利用率。中科曙光表示,未来会联合产业伙伴,推进拓扑描述、资源调度、互联验证及异构算力接入等标准建设,进一步完善国产科学智能算力生态。
随着AI大模型和科学智能应用的持续演进,算力竞争已经从单机性能转向集群互联效率。DeepLink Fabric和scaleX40的发布,意味着国产超节点技术正在从传统智算平台,迈向面向AI for Science的新一代超智融合基础设施。可以预见的是,这为科研创新和大模型应用提供了一个更高效、也更容易部署的算力支撑方案。
Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















