元川微數億元 Pre-A,IDG 領投
押注LPU推理晶片

7月23日,投資界傳來訊息:國產 LPU(語言處理單元)創業公司元川微,完成 數億元 Pre-A 輪 融資,由 IDG 資本領投,孚騰資本、九坤創投、尚頎資本、順禧基金、徐匯科創投聯合投資。據元川微方面披露,這已經是公司年內完成的第四輪融資,資金將用於加快核心技術研發與工程化落地。
LPU 是什麼? 簡單說,它是和 GPU 思路不同的一種 AI 推理晶片。GPU 擅長大規模平行計算,但跑大模型推理時,很多算力花在了不是真正在算的開銷上。LPU 主打的,是確定性、低時延、低成本地把一個真實任務做完——而不是堆最高的理論峰值算力。元川微的創始人楊濱是華為處理器團隊的老兵,團隊把自研的「LPU+」架構總結成三大基因:大頻寬、確定性資料流、靜態排程。
這三點聽著抽象,落到體驗上很具體。大頻寬,是說晶片用扁平化的片上大 SRAM 直連計算單元,幹掉多級快取帶來的訪問延遲;確定性資料流,是讓資料像流水線一樣在晶片內自動流轉,每個時鐘週期的路徑在編譯時就定好;靜態排程,則是所有資源分配在編譯階段完成,執行時零動態開銷——沒有快取未命中,沒有排程等待。
元川微認為,隨著大模型從對話走向 Agent(智慧體),競爭的關鍵已經不再是誰的算力數字最好看,而是誰能用更低時延、更低成本、更高確定性完成真實任務。公司兩大系列產品 Mountain(算力)和 River(Agent),瞄準雲、邊、端全場景的推理基建。截至今年 4 月,其自研 LPU+ 架構已完成 FPGA 驗證,第一代推理晶片正在推進。
真正有意思的是國產替代的視窗。元川微稱,LPU+ 方案顯著降低了對先進製程和高階 IP 的依賴——在全球 AI 晶片供應鏈重構的背景下,這意味著即使拿不到最頂級的製程,也有可能做出有競爭力的推理晶片。
往後看,AI 推理晶片的戰場才剛開打。對普通使用者最實在的判斷是:當 Agent 真正普及,決定成本的不是訓練用的那幾張卡,而是每天億萬個推理請求背後,誰把每筆任務的代價壓到了最低。國產 LPU 這條線,值得盯著。