我国企业自主研发TPU芯片“须臾”发布
中昊芯英发布全自研TPU芯片“须臾”,单芯片混合精度浮点算力896TFLOPS,8-bit推理算力1792TOPS,功耗600W但综合计算效能达传统GPU数倍。同步推出泰则2.0智算平台,整机算力7.168P,能耗仅为传统GPU服务器80%。芯片覆盖全自研技术链,已部署于金融、医疗等行业。
先说说这款芯片的背景。国内做AI专用算力芯片的企业不算多,而中昊芯英是其中最早押注TPU架构的一家。最近他们正式推出了新一代全自研高性能TPU芯片“须臾”,同时发布的还有搭载这颗芯片的软硬件一体化智算底座——泰则2.0 AI高性能智算平台。作为初代“刹那”芯片和泰则智算服务器的全面升级版,新品在底层架构、算力峰值、片上存储、集群互联、计算能效这几个关键维度上,都实现了跨越式的提升。

具体来看性能参数:单颗“须臾”芯片深度优化了大模型专属的张量计算逻辑,把寄存器扩容了,片上缓存也做得更大。单芯片混合精度浮点算力达到了896TFLOPS,这个数字是上一代芯片“刹那”的3倍;8-bit推理算力则到了1792TOPS,特别适合海量词元高并发推理的场景。功耗方面,单芯片额定功耗是600W,但要注意,它的算力已经和传统芯片持平,而功耗却降低了50%。核心的秘密在于多维张量计算单元与数据复用优化设计,这使得它在执行同等AI任务时,综合计算效能可以达到传统GPU架构的数倍。
“须臾”芯片延续了中昊芯英全自研的TPU技术路线,从芯片IP核、专属指令集到底层算子加速库、整机系统软件,全部是自主研发。换句话说,核心技术已经完整覆盖了芯片设计、电路开发、编译工具、模型适配这条全链条。同时推出的泰则2.0 AI高性能智算平台,最小计算单元由两路高性能CPU和8片“须臾”TPU协同构成,整机混合精度算力达到7.168P,而在同等任务下,整机能耗仅为传统GPU服务器的80%。
中昊芯英是国内最早投身TPU架构AI专用算力芯片研发的企业之一,2024年他们就成功流片了国内首枚高性能TPU芯片“刹那”并实现了量产。目前公司的产品已经在深圳联通、天津移动、太极股份等建设的多个超大规模智算中心部署,覆盖金融、传媒、教育、医疗等行业领域。
(受访单位供图)
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。















