发布于2026-07-24 阅读(0)
扫一扫,手机访问
先说几个核心判断,这次国产TPU千卡集群的落地,不只是个技术事件,更像是一个信号——国产算力,正在从“能不能用”跨向“好不好用”的阶段。
2026年世界人工智能大会(WAIC)期间,中昊芯英、杭州电信、中兴通讯三方联合宣布,国产TPU千卡智算集群项目正式落地。这个项目,说实话,不是简单的硬件堆叠,而是芯片、通信、算力运营三个环节的一次深度协同,目标直指华东数字经济高质量发展的自主算力底座。
话说回来,现在的华东AI产业,正处于规模化落地的爆发期。大模型训练参数量一个劲地往上蹿,推理场景的并发需求也是指数级增长。传统算力架构在效能、能耗和成本上的瓶颈,是不是越来越明显了?这个千卡集群项目,恰好是国产芯片企业、通信龙头和运营商三方生态协同的一个标志性成果——三方各自在自研TPU芯片、全栈通信方案、算力运营领域深耕多年,这次把底层芯片设计、服务器集成部署到算力平台运营服务的完整闭环给打通了,打造出“自主芯片+全栈集成+智能运营”的新一代智算体系。

项目一期的核心算力底座,来自中昊芯英的“刹那®”TPU AI专用算力芯片,一共用了1024片,算力规模达到400P。这颗芯片,是中国首枚量产的高性能TPU架构AI专用大芯片,全自研的IP核、指令集和计算平台,前后研发了近5年。从数据来看,“刹那®”的AI算力性能比海外同期著名GPU产品高出近1.5倍,能耗却降低了30%,算上价格、算力和能耗,单位算力成本能降低将近一半。基于这颗芯片构建的“泰则®”1.0人工智能服务器与计算集群系统,支撑超千亿参数的AIGC大模型运算、高级无人驾驶模型训练、蛋白质结构预测之类的高强度场景,表现相当突出。
中兴通讯作为全栈通信方案提供商,这次的角色也不只是“搭个网络”。他们提供的是端到端的国产化集成与部署服务,从硬件适配、系统调优到部署实施,再到后续的运维保障,形成了一个完整的生命周期服务闭环。这种“集成部署+软件优化+持续运维”的一体化模式,是确保算力基础设施稳定输出的关键。
杭州电信作为建设主体,深度嵌入了区域AI算力产业的发展脉络。他们搭建的覆盖算力调度、模型服务、安全管控的一体化运营平台,构建起以异构融合、高速传输、统一调度、服务化供给为核心的新一代AI算力服务体系。这意味着,杭州电信正在从基础算力资源输出者,向“智算综合服务+生态协同枢纽”的角色跃迁,为华东区域提供“即取即用、随需而变”的智能算力服务体验。
中国电信杭州分公司副总经理王元昊提到一个细节:TPU芯片聚焦计算及推理场景,低功耗优势突出,很契合运营商打造普惠Token算力服务的方向。联合打磨的千卡集群,经过半年深度调优,Token输出效率提升了超过十倍,百万Token调用成本从百元降到了十元以内。后续还会持续优化,这个趋势值得关注。
一期还没完全消化,二期已经同步规划落地了。二期将搭载中昊芯英全新一代“须臾®”TPU芯片,规划总算力规模突破10000P,全面满足超大规模大模型训练、智能制造仿真、全场景AI应用开发等多元高算力需求。
“须臾®”芯片于2026年6月30日正式发布,作为一代芯片“刹那®”之后的架构革新,混合精度浮点算力达到896TFLOPS,性能是“刹那®”的3倍,8-bit推理算力达到1792TOPS,单芯片额定功耗600W,但相比算力性能持平的传统算力芯片,功耗降低了50%。在集群部署层面,单个超节点最高可实现2048片“须臾®”全光互联。这意味着,集群综合性能与能效水平还能持续迭代提升,为产业客户提供更强性能、更低能耗的国产TPU算力支撑。
经验表明,一个产业的生态共建,往往始于一个标杆项目。中昊芯英、杭州电信、中兴通讯这次以千卡集群为起点,后续还会持续深化国产TPU AI算力的技术攻坚与生态共建。中昊芯英方面也表示,将继续坚持自主创新,专注TPU架构技术路线,让硬核算力与产业需求深度融合,同时携手更多合作伙伴,完善从底层芯片到上层应用的全栈软件生态,让自主可控的国产TPU算力,更直接、更高效地服务于产业应用。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9