发布于2026-08-18 阅读(0)
扫一扫,手机访问
先说说这款芯片的背景。国内做AI专用算力芯片的企业不算多,而中昊芯英是其中最早押注TPU架构的一家。最近他们正式推出了新一代全自研高性能TPU芯片“须臾”,同时发布的还有搭载这颗芯片的软硬件一体化智算底座——泰则2.0 AI高性能智算平台。作为初代“刹那”芯片和泰则智算服务器的全面升级版,新品在底层架构、算力峰值、片上存储、集群互联、计算能效这几个关键维度上,都实现了跨越式的提升。

具体来看性能参数:单颗“须臾”芯片深度优化了大模型专属的张量计算逻辑,把寄存器扩容了,片上缓存也做得更大。单芯片混合精度浮点算力达到了896TFLOPS,这个数字是上一代芯片“刹那”的3倍;8-bit推理算力则到了1792TOPS,特别适合海量词元高并发推理的场景。功耗方面,单芯片额定功耗是600W,但要注意,它的算力已经和传统芯片持平,而功耗却降低了50%。核心的秘密在于多维张量计算单元与数据复用优化设计,这使得它在执行同等AI任务时,综合计算效能可以达到传统GPU架构的数倍。
“须臾”芯片延续了中昊芯英全自研的TPU技术路线,从芯片IP核、专属指令集到底层算子加速库、整机系统软件,全部是自主研发。换句话说,核心技术已经完整覆盖了芯片设计、电路开发、编译工具、模型适配这条全链条。同时推出的泰则2.0 AI高性能智算平台,最小计算单元由两路高性能CPU和8片“须臾”TPU协同构成,整机混合精度算力达到7.168P,而在同等任务下,整机能耗仅为传统GPU服务器的80%。
中昊芯英是国内最早投身TPU架构AI专用算力芯片研发的企业之一,2024年他们就成功流片了国内首枚高性能TPU芯片“刹那”并实现了量产。目前公司的产品已经在深圳联通、天津移动、太极股份等建设的多个超大规模智算中心部署,覆盖金融、传媒、教育、医疗等行业领域。
(受访单位供图)
下一篇:轨道电流首次直接用于信息读写
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9