阿斯麦、台积电、英伟达,该睡不着了。7月13日,上海,一家成立不到三年的公司用14nm工艺造出了一颗520TFLOPS的AI芯片,没用EUV,没用HBM。
这家公司名字叫东方算芯,窝在张江一栋不起眼的楼里,带队的是清华出来的魏少军,国内芯片圈的老炮儿,当年"核高基"的技术总师。
芯片代号DF1000,算力标到520T,卡和卡之间能连900G,一百二十八张卡的小集群已经跑得起来。
在此之前,整个全球芯片行业都被一套固有逻辑绑死了,所有人都默认,想要高端AI算力,就必须堆先进制程、用顶尖设备、配高端显存。
简单来说,就是想做顶级AI芯片,离不开阿斯麦的EUV光刻机、台积电的先进工艺,还有刚需HBM高带宽显存。
这也是为什么近两年国产AI芯片看似百花齐放,却始终难以真正突围的核心原因。大家都在跟着英伟达的赛道内卷,对方不断迭代新工艺、新架构,我们就只能被动追赶,永远慢半拍,根本没有弯道超车的机会。
但这次东方算芯的DF1000芯片,直接跳出了这套既定规则,打了所有行业巨头一个措手不及。最硬核的事实摆在眼前:全程14nm成熟工艺,完全不用EUV光刻机,舍弃行业标配的HBM显存,仅凭国产化成熟供应链,就跑出了520TFLOPS的强悍算力。
可能很多普通读者对这个数据没有直观概念,我给大家通俗拆解一下。以往行业共识是,14nm属于中低端成熟制程,只能做普通消费级芯片、工业芯片,根本扛不住大算力AI训练任务。高端AI芯片基本都是4nm、3nm制程起步,依赖极致工艺堆性能。
而东方算芯完全反其道而行之,不靠制程堆叠性能,而是靠架构创新突破上限。他们采用全球首创的软件定义近存计算3D架构,通过晶圆级混合键合3D堆叠技术,把计算层和存储层垂直整合,大幅缩短数据传输路径,从根源上解决了传统芯片算力浪费、传输延迟高的痛点。
这就好比别人还在靠加宽马路提升通行速度,东方算芯直接重构交通路网,用立体架构实现效率跃升。最终实现6.4TB/s的超高访存带宽,加上900GB/s的卡组互联带宽,让单卡算力利用率直接拉满,彻底颠覆了“制程决定算力”的行业铁律。
更让人惊喜的是,这款芯片并非只能单卡跑分的“纸面产品”,目前128张卡组成的算力小集群已经稳定运行,具备了实际AI训练、算力服务的落地能力。从单卡性能到集群适配,整套方案完整成熟,完全不是实验室概念产品。
能做出这样颠覆性的成果,核心离不开带头人魏少军的深耕布局。作为国内芯片行业的资深专家、昔日国家“核高基”重大专项技术总师,他深耕芯片底层技术数十年,见过国产芯片无数次被卡脖子的困境,也深知行业内卷的弊端。
不同于很多追逐热点、急于变现的创业团队,魏少军带领的东方算芯,从成立之初就瞄准底层架构自主创新,不走捷径、不跟风内卷。公司2024年成立,短短两年多时间,蛰伏张江低调研发,没有大肆宣传造势,直接拿出实打实的量产级成果,这份沉稳和硬核实力,在浮躁的科技圈尤为难得。
在我看来,DF1000的诞生,意义远不止一款国产高端AI芯片那么简单,它真正的价值,是撕开了全球芯片行业的垄断壁垒,给国产算力产业蹚出了一条全新的自主赛道。
此前阿斯麦、台积电、英伟达三家企业几乎掌控了全球高端算力的话语权。阿斯麦垄断EUV光刻机,卡住先进制程命脉;台积电垄断高端晶圆代工,把控制造核心;英伟达垄断AI芯片架构和生态,霸占全球算力市场。三者形成闭环,让后来者根本无从突破。
但东方算芯用实践证明,高端算力根本不是只有一条路可走。不用最先进的光刻机、不用最顶尖的制程、不用进口HBM,依托国内成熟的14nm产业链,依靠自主架构创新,照样能做出比肩国际中高端水平的AI算力芯片。
这也就意味着,西方企业靠设备、制程构建的技术壁垒,正在被我们的底层创新瓦解。过去他们靠技术封锁、设备限制打压国产芯片发展,如今我们跳出他们制定的游戏规则,开辟了完全自主的技术路线,彻底打破了“先进制程依赖症”。
我一直坚持一个观点:国产芯片的突围,从来不是靠简单的模仿追赶,而是靠颠覆性的自主创新。追赶只能永远被动,颠覆才能真正实现超越。东方算芯的DF1000,就是最典型的颠覆式突破。
成熟14nm工艺意味着极低的量产成本和极高的良品率,完全适配国内现有晶圆产线,不用依赖进口设备,能够快速实现规模化量产。
相比于英伟达高端芯片昂贵的价格、受限的供货,DF1000具备极强的性价比和供应链安全性,非常适配国内人工智能、大数据、云计算的算力需求。
可以预见,随着DF1000芯片持续落地迭代,国产AI算力将彻底摆脱外部桎梏。
往后,阿斯麦的EUV、台积电的先进制程、英伟达的芯片垄断,再也无法卡住中国算力产业的脖子。
这场来自张江的低调突破,终将改写全球AI算力的行业格局。
