当前位置:

首页 > 硬件相关 > 中国算力的十万卡雄心

中国算力的十万卡雄心

全国产十万卡AI超集群建成一周即满载运行,日均处理作业超15万,单日峰值超50万。这背后是产业链协同、工程创新及市场需求爆发的合力。第二套系统已启动研制,标志着中国算力从技术突破迈向产业扩张。

当一套全国产十万卡AI超集群落成不到一周就满载运行,这背后不只是一个工程奇迹,更是中国算力生态从荒原走向雨林的生动注脚。

2026年7月9日,郑州,国家超算互联网核心节点。

当曙光8000(登峰)的系统指示灯次第亮起时,很多人心里都在打鼓:这台集成30亿颗电子元器件、互连线缆总长突破1600公里的“算力巨兽”,真的能扛住真实世界的考验吗?

答案来得比所有人预想的都快。

系统上线首周,直接进入满载运行状态。日均处理作业数突破15万个,单日峰值超过50万个——用户排队提交的计算任务,让这个十万卡超集群的每一块芯片都忙得热火朝天。

从中国算力史来看,这几乎是个破天荒的纪录。

照惯例,一套新算力集群从部署到真正形成战斗力,怎么也得几个月甚至更长的“预热期”——应用软件适配、编译器调试、用户熟悉,每一个环节都是看不见的沟坎。而今天,这些沟坎似乎一夜之间被填平了。

过去几年,各地智算中心密集建设,市场一度担忧算力会不会出现闲置。而曙光8000恰好完成了一次需求侧验证:市场并不缺算力需求,真正稀缺的是好用、稳定且能被便捷调用的优质算力。

但结论不应该停留在“优质算力缺口”上。真正的问题是:中国,这个曾经在信息时代前二十年奋力追赶的国家,为何能在算力这个数字时代“新石油”的角逐中,凝聚起“十万卡”级别的磅礴力量?又如何能在短短一周内,就把应用需求塞满这样一艘算力巨轮?

答案,藏在产业链的韧性里,藏在竞争范式的转移里,也藏在市场独特的生态协同与这个国家清醒的战略布局中。

01 产业链的集体冲锋

十万卡算力高地拔地而起,不是某个天才的灵光一现,也不是一家企业的单兵突进。它是一场有最完备产业链、最广阔应用市场、清晰政策谋划和深厚人才储备的系统性“会战”。

第一,是产业链的“扎硬寨,打呆仗”。

把目光投向整个算力产业链。在安徽合肥,长鑫存储的工程师们用了数年时间死磕一个任务——突破DRAM内存芯片的垄断。在极度苛刻的洁净室里,他们与纳米级的物理极限搏斗,从19纳米到17纳米,每一步微缩,都意味着天文数字般的研发投入和难以想象的工艺挑战。

在产业链下游,是DeepSeek这样的新锐力量。他们向世界证明:大模型的奇迹,不只有堆砌算力这一条路,极致的算法优化,同样能让更少的“卡”迸发出更强的智能。这本质上是一种更聪明的算力使用方式,对缓解算力饥渴意义深远。

从芯片设计、制造、封装,到服务器整机、高速互连网络,再到操作系统、数据库、大模型……中国正在艰难但坚定地,一段一段地补齐产业链的拼图。这就像建一座通天塔,每一块砖都必须自己烧制,其艰辛可想而知,可一旦建成,其根基之牢固也非比寻常。

第二,是市场的“大海里练游泳”。

任何技术,如果脱离了应用的土壤,最终都会枯萎。而中国,恰恰拥有全球最复杂、最庞大、最饥渴的算力应用试验场。

当具身智能在工厂车间里学着像人一样拧螺丝时,背后需要进行海量的实时感知、决策与控制训练。当无数辆新能源汽车在路上飞驰,每一公里的自动驾驶数据,都要汇入后台的算力中心进行循环学习。更不用说智能制造、金融风控、药物研发、气象预测……几乎每一个行业的数字化、智能化转型,都在催生对算力的无尽需求。

有一个数据更加直观:我国日均Token调用量,已从2024年初的约千亿飙升到2026年的百万亿级别。这种需求不是渐进增长,是指数级爆发。

这种“拿来就用、用了就反馈、反馈了就迭代”的极速闭环,是中国市场给予本土算力企业最慷慨,也最残酷的馈赠。能活下来的,都是能打硬仗的。

第三,是顶层战略的“一张蓝图绘到底”。

“东数西算”工程启动,让西部充裕的清洁能源,化为东部的数字生产力,针对中国算力失衡的战略布局也随之展开。而政策的远见,不仅在于给钱给地,更在于构建一个庞大的人才底座。

过去十年,中国培养了全球规模最大的理工科人才队伍。那些在曙光8000监控屏幕后的年轻面孔,那些在无尘车间里一待十几个小时的工艺工程师,那些为DeepSeek通宵达旦优化模型的算法天才……他们或许面容稚嫩,但眼神都一样坚定:在核心技术上挺直腰杆,就是我们这一代人的长征。

02 十万张卡的工程噩梦

但十万卡超集群不是有了十万张卡就能建成的。

难的不是数量,是规模带来的工程难题。行业里有个说法:一千张卡是算术题,一万张卡是代数题,十万张卡是玄学题。

这道玄学题,海外的顶级玩家也刚刚摸到门槛。

2024年,马斯克的xAI在美国孟菲斯建起Colossus超算,122天塞进十万张英伟达H100,速度震惊行业。但建起来之后的麻烦才是真正的难题。当地电网供不上电,马斯克直接拉来数十台移动燃气轮机现场发电,因为排放问题还被当地居民抗议了一年多。

Meta为训练Llama囤了几十万张GPU,但它自己发布的技术报告却显示:1.6万张H100的集群上,一次54天的大模型训练,意外中断了419次,相当于每三个小时坏一次,大部分故障来自GPU和显存。

至于OpenAI和微软的“星际之门”计划,规划投资以千亿美元计,至今仍在图纸和工地之间徘徊。

无限量的英伟达芯片、无限量的光模块、无限量的电——这些巨头想用钱把物理问题烫平。可即便如此,他们的万卡集群依然被故障率、供电和散热折磨得够呛。

而曙光8000的工程化难度直接拉满——英伟达的高端卡拿不到,海外成熟方案用不了,每一个环节都得自己造。但反过来,这也逼出了一套不一样的解法。

十万张卡要协同工作,节点之间每秒钟都在交换海量数据。海外集群的标准答案是光模块——一个十万卡集群要用掉数以十万计的光模块。

但光模块有三个毛病:贵,一个顶级光模块要几百上千美元,十万卡集群要吃掉几十万个;发热,本身就是耗电大户;最要命的是娇气,它是整个集群里最容易坏的零部件之一。

通过自研的scaleFabric网络架构和底层交换芯片,中科曙光极大地优化了互连效率,并用全新的冗余设计解决了大规模集群下光模块极易损坏导致训练中断的死xue。

由此,一条数据从这台机器传到那台机器,全程只要0.93微秒——一眨眼的功夫,够它跑三十多万个来回。即便某条线路出了问题,系统能在千分之几秒内自动切换到备用路径,训练任务根本感觉不到。Meta每三小时中断一次的那种噩梦,被从架构上拆掉了隐患。

但连起十万张卡,不代表你就能用好十万张卡。存储往往是一个容易被忽视的算力瓶颈——数据供不上,GPU就要空转,存储的性能直接决定了集群的数据吞吐能力。曙光8000配备的ParaStor分布式存储,在2026年IO500拿下生产型榜单双料全球第一,并大幅刷新世界纪录,代表了业内商用存储系统的性能天花板。

对十万卡规模而言,散热是又一大难题,传统风冷就像用电风扇吹炼钢炉。对此,美国人的解法是硬堆电力,而中科曙光的解法是不浪费。通过浸没相变液冷、湖水冷却等方案,曙光8000能把PUE(电能使用效率)压到1.04。而全球大型数据中心的平均水平在1.5上下,最先进的AI机房也普遍在1.1以上。同样一度电,中科曙光的机器能干更多的活。在“电力即算力”的时代,这就是竞争力本身。

一台机器背后,芯片、整机、互连、存储、液冷、供电、调度软件,这些环节没有一个能单独买来。这是比造出一块芯片更难的系统工程能力。



03 供需错配的破解密码

搞清了“如何造出来”,接下来更重要的问题就是“为何被抢着用”。

曙光8000能够首周满载,首要原因在于它精准命中了算力需求的结构性变革。

AI产业正经历两股巨浪的交汇。一是Token需求的指数级增长,百万亿级别的日均调用量要求算力基础设施必须“开箱即用”。二是科研范式正在发生深刻变革:AI for Science要求算力不能仅停留在低精度的大模型训练,还需要支撑高精度的科学计算与工程仿真。

这正是传统算力中心的软肋。过去,超算和智算往往分开建设:超算擅长双精度浮点运算,适合科学仿真;智算擅长低精度运算,适合AI训练。这种分裂导致算力供给与真实需求出现严重错配——科研用户苦于AI算力不足,智算中心又难以承接高精度仿真任务。用户在两边排队,两边都吃不饱。

曙光8000走了一条不同的路:原生超智融合。

它摒弃了传统的分区方式,在同一硬件平台上支持从FP64双精度科学计算到INT8低精度推理的全精度覆盖。十万卡不再只是大模型训练的“大力出奇迹”,而是能够同时承接大模型训练、高通量推理、蛋白质折叠模拟、万亿网格湍流仿真等复杂任务的“算力工厂”。

破解了一个关键的需求缺口——这才是曙光8000首周满载最深层的技术原因。它不是抢了别人的生意,而是填补了一个市场空白。



04 只要在路上,就没有到不了的地方

曙光8000证明了国产十万卡“能不能做”,也回答了“有没有人用”的疑问。同时,一个更具标志性意义的信号已经出现:中科曙光已与北京科学智能研究院启动第二套全国产十万卡系统的研制。

第一套建成是技术突破,第二套启动则标志着产业意义上的“产能扩张”开始出现。

当十万卡集群从“明星工程”变为“常规基建”,中国智算产业的真正考验才刚刚开始:能否持续产生高价值应用、不断优化成本结构、打破不同算力中心之间的“数据孤岛”,形成真正高效协同的全国一体化算力网络——这才是决定十万卡体系能走多远的关键变量。

我们在用别人意想不到的速度追赶,并且在追赶过程中走出了一条独特的路径:用系统效率弥补单点差距,用生态协同对抗技术封锁,用市场纵深消化创新成本。

中国算力的崛起之路,不是从胜利走向胜利的凯歌,而是从一代人解决“有无问题”,走向另一代人解决“好坏问题”的接力。

河南郑州的机房里,指示灯还在快速闪烁。30亿颗元器件在同一个节奏里脉动,1600公里线缆里流淌着这个国家最聪明的计算任务。

而这,只是第一道曙光。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
硬件相关
相关文章 更多
荣耀MagicOS 11发布计划与Agent Harness架构解析
荣耀MagicOS 11发布计划与Agent Harness架构解析

荣耀MagicOS 11定于9月15日发布,作为行业首个商用系统级Agent Harness架构的操作系统,Magic 9系列将首发搭载。新版YOYO支持最长上百步长程任务及40余项条件触发,10月开启Beta预览版招募。

华强北手机全线涨价:涨幅400-1500元,存储成本推高售价
华强北手机全线涨价:涨幅400-1500元,存储成本推高售价

华强北销售商反馈,年初以来主流手机品牌基本全线涨价,涨幅最低400元,最高达1000-1500元。涨价主因是全球存储芯片及电容等元器件成本上升,运行内存与机身存储价格涨幅超100%。尽管整体市场承压,国产折叠屏手机1-8月销量约450万台(新形态超135万台,同比增29%),AI手机成为厂商发力重点。

索尼WH-1000XM4C发布:复刻经典折叠设计并升级现代接口
索尼WH-1000XM4C发布:复刻经典折叠设计并升级现代接口

索尼发布WH-1000XM4C头戴式降噪耳机,复刻了XM4的经典四向折叠便携设计。该机型在保留QN1处理器和30小时续航的基础上,全面升级了USB-C高速充电、无损音频直连、蓝牙多点连接及AI降噪通话功能,旨在满足对便携性有极高要求的用户群体。

OpenAI GPT-6 Astra 自主通关《传送门》:技术原理与实验成本解析
OpenAI GPT-6 Astra 自主通关《传送门》:技术原理与实验成本解析

OpenAI GPT-6 Astra 模型通过 MCP 协议与 SourcePauseTool 控制《传送门》游戏,完成 3336 次工具调用并自主通关。实验耗时约 24 小时,API 成本约 571 美元,展示了多模态 AI 在 3D 解谜领域的突破性进展。

AI重构企业业务架构:超聚变“智企”范式核心解析
AI重构企业业务架构:超聚变“智企”范式核心解析

本文解析超聚变在2026数博会发布的“智企”范式,重点阐述如何通过Token生产平台(Token Factory)与企业业务本体建模,实现从简单AI工具调用到企业应用架构系统性重构的演进。文章详细拆解了智能体编排、数字孪生及生态协同等关键技术路径,为AI时代企业数字化转型提供可落地的参考方案。

南邮光擎智算团队:GaN基Micro-LED光计算芯片从理论到流片的突破
南邮光擎智算团队:GaN基Micro-LED光计算芯片从理论到流片的突破

南京邮电大学“光擎智算”团队联合南京大学,攻克GaN基Micro-LED器件技术,成功搭建实验室级光计算验证系统。团队自主研发的5×5 Micro-LED光电计算阵列芯片已进入流片封装阶段,实现了图像识别等算力任务验证,推动光计算技术从理论走向工程落地。

微软推出Project Zenith:面向Windows 11开发者的AI硬件加速方案
微软推出Project Zenith:面向Windows 11开发者的AI硬件加速方案

微软于9月5日推出Project Zenith,旨在为Windows 11开发者提供更高效的AI开发体验。该项目目前仅支持配备超过64GB统一内存及250GB/s内存带宽的特定硬件,首发适配AMD Ryzen AI Halo设备。通过此项目,开发者可在本地运行参数超过300亿的AI模型,后续将分阶段扩展至更多合作伙伴设备。

贵州省住建厅与贝壳集团签署旅居战略合作:五大维度落地方案解析
贵州省住建厅与贝壳集团签署旅居战略合作:五大维度落地方案解析

9月3日,贵州省住建厅与贝壳集团在贵阳签署《旅居产业发展战略合作框架协议》,旨在打造全国旅居样板。合作涵盖平台建设、标准共建、人才培育、存量资产盘活及品牌推广五大维度,依托贝壳近600家门店及4000余名经纪人资源,强化贵州旅居服务供给,促进房地产市场平稳健康发展。

上海链家安住APP:业主主动卖房功能与成交数据解析
上海链家安住APP:业主主动卖房功能与成交数据解析

本文解析上海链家推出的“安住APP”功能,该工具允许业主在贝壳/链家挂牌后主动管理房源。通过实时查看销售进展、发送看房邀约及获取AI策略,业主可缩短成交周期。数据显示试点期间平均成交7天,最短1天。适用于希望提高信息透明度、主动参与卖房过程的业主。

打破流量垄断,让平台经济释放普惠红利
打破流量垄断,让平台经济释放普惠红利

2026年6月工信部等七部门印发《促进平台经济大中小企业协同发展行动方案》,明确平台经济是数字技术赋能的实体经济。针对流量垄断与“数字租金”问题,专家主张治理重心应从静态整改转向推动平台能力向中小企业外溢,通过算法透明、接口开放及数据可迁移,打破封闭生态,实现创新与规范并重的高质量发展。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。