東方算芯釋出DF1000:14nm成熟製程實現520TFLOPS算力
用架構創新繞過製程封鎖

7月13日,上海AI晶片創企東方算芯釋出了一顆不太按常理出牌的晶片——DF1000。它最反直覺的地方在於:沒有追先進製程,沒有堆HBM,用14奈米成熟工藝就跑出了520 TFLOPS的算力,還配了6.4 TB/s的訪存頻寬。在所有人都在卷3奈米、卷HBM的當下,這條路顯得有點「土」,卻戳中了一個真問題。
傳統高階算力有三道坎:先進製程被卡脖子、HBM產能緊俏、成本居高不下。DF1000的打法是「軟體定義近存計算」的3D架構——把計算和儲存貼得更近,用架構創新去 compensate 製程上的代差。它不依賴最尖的電晶體,也不依賴最貴的儲存,而是靠晶片內部的佈局把資料搬移的損耗壓下去。
更關鍵的是工程落地。東方算芯宣佈已經完成了128卡叢集的全功能穩定執行,這意味著它不是一顆實驗室裡的樣片,而是能真正組叢集、跑業務的晶片。同期央視也報道了同類架構晶片亮相,說明「以架構創新代替製程追隨」不是一家公司的孤例,而是在國產算力圈子裡正在形成的一股共識。
為什麼這件事值得放在檯面上講?因為過去兩年國產算力的敘事總繞不開一個焦慮:別人製程領先,我們是不是永遠差半代?DF1000這類晶片給出的回答是——算力不一定非得靠最細的線寬堆出來。當製程紅利見頂、先進裝置又受限,用體系結構和軟硬協同去榨乾成熟工藝的潛力,是一條更可控、也更不受制於人的路。
更現實的一層是成本。14奈米是早已攤薄的裝置與產能,良率和單價都遠好於先進製程,這意味著用「便宜且買得到的工藝」也能做出能用的高階算力,對預算敏感的場景尤其友好。DF1000把這點直接落到了產品裡。
當然,成熟製程的天花板也擺在那。520 TFLOPS放到全球頂尖陣營裡不算驚豔,14奈米的功耗和麵積也必然有代價。但方向對了,比一時的峰值更重要。國產高階算力真正要補的課,從來不只是「能不能造出來」,而是「能不能在受限條件下,穩定、便宜、成規模地造出來」。這條路,DF1000算是踩實了一腳。