绕过EUV光刻、性能超英伟达A卡,全国产“软件定义近存计算3D芯片”发布
全球首颗软件定义近存计算3D芯片DF1000发布,无需EUV光刻机,基于全国产供应链,BF16算力达520TFLOPS,性能超越英伟达A系列。通过软件定义芯片与3D堆叠架构创新,访存带宽达6.4TB/秒,提供全栈自主软件栈,为中国AI芯片产业开辟自主可控新路径。
就在全球半导体行业还在为更小制程拼得头破血流的时候,一款不需要EUV光刻机、完全基于全国产供应链打造的AI芯片——DF1000,昨天在上海正式亮相。这款被定义为“全球首颗软件定义近存计算3D芯片”的产品,BF16算力达到520TFLOPS,性能直接对标英伟达A系列芯片,甚至还有所超越。
性能突破的根基,并不在先进制程,而在于架构创新和供应链的国产化。东方算芯DF1000系列走了一条完全不同的路:不依赖尖端制程、供应链稳定可控、可持续自主迭代。这为国内高端算力芯片提供了一条可落地、可规模化的新路径,而不是在别人画好的赛道里硬挤。

要理解DF1000的技术逻辑,得先弄明白传统芯片的核心困境在哪。传统2D芯片的架构,就像一座工厂和它的仓库:计算单元是生产车间,存储单元是远端的仓库,中间只有一条狭窄的马路连接。当AI计算需要海量数据来回搬运时,这条马路就成了瓶颈——数据搬运的速度跟不上计算速度,大量算力白白浪费在等待上。
东方算芯的解法,两个关键词:软件定义芯片和3D堆叠。所谓“软件定义芯片”,就是通过外部控制码来灵活调度计算任务,写入不同的软件就能让芯片拥有不同的功能。这条路不是突然冒出来的,东方算芯创始人魏少军从2006年起就开始研究可重构计算,这正是“软件定义芯片”的前身。DF1000聚焦底层计算架构的源头创新,通过软件定义芯片技术实现软硬件解耦与动态重构,用空间并行和时分复用,把硬件资源利用率提了上去。
3D堆叠则是在物理架构上动刀。DF1000采用了“中间计算层+上下双存储层”的三层堆叠结构,通过3D混合键合技术把计算层和存储层垂直堆叠集成,互连间距压缩到亚微米级别,互连密度和带宽密度有了数量级提升,访存带宽达到6.4TB/秒。这条技术路线精妙的地方在于,它绕开了对EUV光刻精度的依赖,用相对落后的制程工艺,实现了高性能——这才是关键所在。

魏少军强调,算力产业的竞争,最终是体系与生态的竞争。东方算芯同步打造了全栈自主底层软件栈,覆盖编译器、运行时、算子库、集合通信库、分布式训练框架以及一站式工具链,全面兼容主流深度学习框架,给用户提供简洁高效的迁移和部署方案。
弗若斯特沙利文咨询公司预测,到2029年,中国AI芯片市场规模将从2024年的1425.37亿元飙升至13367.92亿元,年复合增长率达53.7%。在这条万亿级赛道上,东方算芯的“换道”探索不仅让企业跻身独角兽之列,更给中国AI芯片产业提供了一条绕过EUV、实现自主可控的可行路径。据透露,目前已有数十家企业沿着这条技术路线持续探索,一个产业生态正在慢慢成型。
Shapr3D是一款面向工业设计、机械工程、建筑概念和三维打印工作流的CAD软件。Mac版采用Parasolid建模内核,支持草图约束、实体建模、工程图、可视化渲染及常见CAD格式交换,并可通过账户在多台设备之间同步项目。
REAPER是Cockos开发的数字音频工作站,提供多轨音频与MIDI录制、剪辑、处理、混音和母带制作工具。Mac版兼容Intel与Apple芯片,支持AU、VST、VST3、CLAP等插件格式,并提供高度可定制的工作流程。
Ableton Live 是面向音乐制作人与现场表演者的数字音频工作站,提供编曲视图、独具特色的现场视图、音频录制、MIDI创作、实时变速、乐器及效果器。Mac版原生支持Apple芯片,并可连接音频接口、MIDI控制器和第三方插件。
Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。
Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。














