中昊芯英发布新一代自研TPU芯片须臾,算力达896TFLOPS
中昊芯英发布新一代全自研TPU芯片须臾,单芯片混合精度算力达896TFLOPS,是上一代3倍,8-bit推理算力1792TOPS,功耗降低50%。配套泰则2.0智算平台算力7.168P,能耗为传统GPU的80%,兼容主流AI框架及数十款大模型,实现全栈自主可控。
中昊芯英今天正式亮出了新一代全自研高性能TPU AI专用芯片——「须臾」,同时配套的软硬件一体化智算底座「泰则2.0」也一并登场。这一波动作,直接瞄准了AI算力的核心战场。

先看芯片本身的硬实力。须臾的单芯片混合精度浮点算力达到了896 TFLOPS,这个成绩是上一代芯片「刹那」的整整3倍。而8-bit推理算力更是飙到了1792 TOPS——说白了,就是专门为海量词元高并发推理场景量身打造的。显存和芯片内部互联速率也都有了大幅提升,超长上下文的处理不再是瓶颈。单卡额定功耗600W,相比传统算力芯片功耗降低了50%,这对低碳数据中心建设来说是个实实在在的利好。
更值得关注的是,须臾从芯片IP核、专属指令集到底层算子加速库、整机系统软件,全部都是完整自主研发,完全没有海外核心技术依赖。这意味着在政务、金融、电网这些对安全合规要求极严的行业里,它可以直接进场。
再说「泰则2.0」——这是高性能智算平台中标准的最小计算单元。它搭载了两路高性能CPU处理器和8片高性能TPU处理单元,物理形态上就是一台通用的CPU服务器外接一台高性能TPU算力加速设备。算力呢?7.168P(混合精度)。而且同等任务下,整机能耗仅为传统GPU服务器的80%,这个能效比相当能打。
软件层面也没落下。泰则2.0实现了全主流AI框架的兼容,原生支持PyTorch、vLLM、SGLang等开发工具,训练场景可以直接对接DeepSpeed、Megatron-LM这些分布式套件。更关键的是,已经完成了Qwen全系列、DeepSeek、GLM、MiniMAX等数十款大语言和多模态模型的深度适配——开发者拿到手就能快速做模型迁移,省去了大量适配的功夫。
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。















