深度報告
-
「科大訊飛 星火 6」是產品速遞裡收錄的一個條目,但需要先把一件事說清楚:截至 2026 年 7 月 18 日,科大訊飛官方並沒有釋出過名為「星火 6」或「星火 V6」的版本。官網與百度百科可查證的版本譜系是 V1.0→V1.5→V2.0→V3.0→V3.5→V4.0→V4.0 Turbo,之後轉向深度推理大模型「星火 X1」及其升級版,以及 2026 年 6 月釋出的原生多模態大模型「星火 X2-VL」。也就是說,官方命名體系裡沒有「6」這個代際。本報告以可核實的當前主力模型(星火 X1 升級版 + X2-VL 多模態 + 星火 4.0 Turbo 底座)為基準撰寫,「星火 6」更可能是媒體或渠道對下一代的預期性稱呼,最終命名與分類留給人工在後臺稽核確認。拋開名字,訊飛星火真正的底色是三點:全國產算力訓練、語音與教育兩大主場極強、政企落地訂單國內領先;短板同樣明確,通用對話、寫作創意與程式碼能力在國產第一梯隊裡偏中下。
-
科大訊飛成立於 1999 年,是國內智慧語音領域的老牌龍頭,2008 年就在國際語音合成大賽拿到接近真人的聽感評分,後來把技術版圖從語音識別、語音合成擴充套件到認知智慧、通用大模型。星火大模型 2023 年 5 月 6 日正式釋出 V1.0,此後保持高頻迭代,是國內最早對標 ChatGPT 的一批國產大模型之一。 這家公司最鮮明的戰略標籤是「全棧自主可控」。它聯合華為構建了基於昇騰生態的國產萬卡算力平臺「飛星一號」,2024 年又啟動更大規模的「飛星二號」,2026 年進一步基於昇騰 950 推進全國產算力訓練。董事長劉慶峰有句話被反覆引用:「假如我們現在不是用國產平臺,而是用已經成型的國外平臺,今天星火大模型的效果可能會更好。但這一步你非走不可,除非你不想自立自強。」在美國持續收緊 AI 晶片出口的背景下,「用國產算力完成訓練」而不僅僅是「在國產算力上跑推理」,成了訊飛區別於多數同行的護城河。經營層面也撐得住這套敘事:2025 年上半年公司整體營收 109.1 億元,全年大模型相關招投標拿下 210 個專案、金額約 23.16 億元,在國內通用大模型廠商裡排第一,客戶多為教育局、公立醫院、能源國企這類政企主體。
-
星火採用 MoE 混合專家架構,官網口徑是推理效率提升 100%,主打七大核心能力:文字生成、語言理解、知識問答、邏輯推理、數學能力、程式碼能力、多模互動。圍繞底座,產品線鋪得很開。 面向個人的一側,有星火 App、星火電腦版、SparkDesk 桌面版,2025 年 9 月升級後重點做「AI 寫作、解題答疑、AI 閱讀、深度研究」四件事,深度研究能把「搜資料到出 PPT」這條鏈路一次打通。語音是它的看家本領:多語種語音識別覆蓋 37 個語種、130 多種語言能力,方言識別在國內幾乎無對手;「小星暢聊」支援全語音、視覺、數字人多模互動,1.5 秒內響應、可隨時打斷、能感知情緒。多模態方面,2026 年 6 月釋出的 X2-VL 是當前唯一基於全國產算力訓練的主流多模態模型,看圖、讀文件、分析圖表、理解畫面樣樣能做,在高考模擬多模態試題裡全學科準確率接近 95%。 面向企業的一側,2026 年 6 月訊飛集中釋出了四款企業級新品:星火營銷助理(AI 營銷數字員工,支援「1 名真人座席+5 個 AI 分身」協同)、星火 AI 企業風控官(風險體檢、一鍵出風險報告,效率提升 5 到 8 倍)、星火智慧語音 VoiceWise(高效能 CPU 版 ASR 免 GPU、全雙工互動)、星火智慧推理平臺 SparkInfer(四級模型路由、語義快取、Token 治理,綜合可省 30% 到 60% Token)。生態落地相當密集,華為 Mate70 的通話摘要、比亞迪智慧陪練、長虹 AI 電視、海康威視的 iFlyCode 程式碼助手、中石油崑崙大模型都用到了星火能力。 真實體驗上口碑兩極。數學、教育、語音這幾個場景確實亮眼——2026 年高考多家媒體實測,星火在新高考 I 卷數學拿到 148/150 分位列第一,上海卷作文 65.5 分居首。但通用對話和寫作是公認的弱項,多篇橫評把它排在國產第一梯隊末尾,程式碼能力更是被吐槽「寫個排序都能出錯」。
-
個人端整體走「免費引流」路線,App 與網頁版免費使用,寫作類免費版每天約 5000 字額度。API 端是訊飛打價格戰最狠的地方:2024 年 5 月宣佈星火 Lite API「永久免費」,是業界首個把基礎版本永久免費的公司;Pro/Max 版低至 0.21 元/萬 tokens,按訊飛「1 token≈1.5 漢字」的口徑,約 2.1 元就能生成一部《活著》體量的內容,價格約為當時百度文心 ERNIE-4.0、阿里通義 Qwen-Max 的五分之一。 商業邏輯很清楚:基礎能力免費換流量和開發者規模,高價值的定製、私有化部署、行業微調收費。這套「漏斗式」打法在訊飛開放平臺已被驗證過,連結了超過 800 萬開發者。真正賺錢的是政企整體解決方案——2026 年上半年,訊飛大模型收入裡整套行業方案佔比已超過六成,單筆合同金額持續走高,賣的不再是模型本身,而是「場景+能力+平臺」的成套交付。
-
正面評價高度集中在兩塊。一是語音,「語音轉文字是王炸」「開會時口頭禪都能自動過濾,準確率比手機自帶高 30%」「方言區能聽懂」,這是二十年積累換來的口碑。二是教育,專門的教育版能批改作文、輔導作業、生成練習題,老師和家長覺得實用;對話風格也被認為比 DeepSeek 的「學霸腔」更接近普通人說話。 負面反饋同樣直白。多篇實測把星火的通用能力排在國產末位:「寫東西邏輯亂成麻,讓它寫議論文論點能跑偏到姥姥家」「推薦 10 本書理由全是複製貼上」「複雜任務容易崩,程式碼能力弱」「UI 太醜」。更扎心的是「存在感」問題,有銳評直接說「要不是寫這篇文章,我都快忘了還有這號人物」「做 PPT 挺好,其他時候就是個擺設」。綜合來看,使用者的共識是:幹語音和教育的活它是首選,讓它做通用創作和寫程式碼就是選錯了工具。
-
行業視角對訊飛的評價,比 C 埠碑要正面得多,因為看的是不同維度。媒體和分析機構普遍認可它「全國產算力底座+通用大模型能力+行業場景深耕」這條路線的確定性——中國日報稱其為「最懂中國的全國產底座大模型」,邏輯是高考這種高度中國化、標準化、可評價的任務場景,恰好能檢驗模型是否真正理解中國語境和評價標準。技術側,訊飛把長思維鏈強化學習訓練效率從 30% 提升到 84%,MoE 全鏈路訓練效率提升到 93%,這些工程數字指向的是「國產算力從能用走向好用」。 競品格局裡,訊飛的位置比較特殊。綜合能力橫評裡它常排在 DeepSeek、通義千問、智譜、文心、豆包之後;但在「語音互動」這個細分維度,幾乎所有橫評都把它列為首選。這說明訊飛不是在通用榜單上跟人硬碰硬,而是靠語音、教育、政企這些差異化場景和自主可控敘事立足。
-
第一個也是最需要標註的,是命名爭議。「星火 6」並非官方已釋出版本,當前可用的是星火 X1 升級版與 X2-VL 多模態,後臺展示時需要人工確認是沿用「星火 6」這個名字、還是改為準確的官方型號,避免誤導使用者。 第二是通用能力的真實短板。剝離宣傳話術,星火在通用對話、創意寫作、程式碼這三塊被反覆證明偏弱,「一本正經胡說八道」的幻覺問題也被點名(儘管 X1 升級版宣稱在幻覺治理上領先業界,實際體驗仍有落差)。把它當全能選手用,大機率會失望。 第三是「高分」與「日常」的落差。高考數學 148 分、多模態 95% 這類成績是標準化測試場景下的表現,和使用者日常隨手一問的體驗並不完全對應——榜單強不等於手感好,這是所有靠 benchmark 敘事的模型都要面對的質疑。 第四是 C 端存在感和產品打磨。多位評測者提到星火 UI 審美、互動細節、更新節奏偏弱,「感覺像被遺棄的專案」雖屬情緒化表達,但反映出訊飛的資源明顯更偏向政企而非大眾消費市場。
-
適合的人很清晰:需要高精度語音轉寫、方言識別、會議記錄、實時翻譯的使用者;教育工作者、學生和家長(作文批改、解題輔導、口語陪練);有自主可控、私有化部署、資料不出域硬性要求的政務、金融、能源、司法、醫療類政企客戶;以及看重 API 價效比、想用永久免費 Lite 或低價 Pro/Max 做輕量整合的開發者。 不太適合的人也同樣清晰:追求頂級通用對話、深度創意寫作的重度內容創作者,程式碼為主的開發者,以及想要極致 C 端互動體驗的普通使用者——這幾類需求,DeepSeek、通義千問在當前口碑裡是更穩的選擇。合理的用法是「場景化混搭」:語音和教育交給星火,通用問答和寫程式碼交給別家。
-
訊飛星火是一個「主場極強、通用偏弱」的選手:靠全國產算力訓練、語音教育兩大王牌和密集的政企落地站穩腳跟,但通用對話、寫作、程式碼這些大眾最常用的能力仍在第一梯隊末尾。所謂「星火 6」目前更像是對下一代的期待而非官方現實,真正在跑的是 X1 升級版和 X2-VL。對政企和特定場景使用者,它是有確定性的國產底座選擇;對普通 C 端使用者,它更像一件「專用工具」而非「全能助手」。
使用者評論
-
Jonathan_Perry_2021262—語音轉文字是真的王炸,開會開著它,老闆那些嗯啊的口頭禪都能自動過濾掉,準確率比手機自帶的高一大截,這塊訊飛做了二十年不是白做的。 -
LarryMiller—先說一句,官網壓根沒有什麼星火6,最新的是X1升級版和那個X2-VL多模態,別被名字忽悠了。 -
MarkHendersonSr511—方言識別yyds。 -
Susan_Phillips_7—讓它寫議論文,論點能給你跑偏到姥姥家,邏輯亂成一團麻,寫東西真別指望它。 -
DeFiWav_e—高考數學148分這個是真牛,新京報請了兩位特級老師閱卷打的分,六款模型裡第一,這推理能力放數學場景確實能打。 -
Frances_PerezSr—作為老師說句公道話,星火的教育版是真好用,批改作文、輔導作業、生成練習題一條龍,家裡有娃的可以衝,比通用大模型貼合教學多了。 -
grxxtvrd—免費的誰不愛啊。 -
Brian.Wood—程式碼能力屬實拉胯,讓它寫個排序都能給我整出bug,搞開發的還是老老實實用DeepSeek吧。 -
浮生_8—UI真的醜,個人審美接受無能。 -
Henry_Evans_X—永久免費的Lite API是真香,做個小專案整合完全夠用,Pro/Max也才0.21一萬token,比文心通義便宜太多了。 -
FNX816758—我一直覺得訊飛最被低估的點是全國產算力訓練,不是拿國產卡跑推理那種,是從頭訓出來的。中美晶片這麼卡的當口,能自己訓才是真自主可控,這一步政企客戶其實很看重。 -
TerriLowe—怎麼說呢,存在感是真的低。 -
heavypanda424—X2-VL那個多模態還行,扔張帶圖表的試卷進去它能讀懂,文件分析也可以,比之前圖文分離強多了。 -
MsMilleRasmussen_pro—有沒有人知道教育版單獨怎麼收費啊,看著功能不錯但價格好像不便宜。 -
MHughes_995—綜合能力橫評裡它基本墊底,DeepSeek通義智譜文心豆包排完才輪到它,但語音那一欄永遠是它第一,這畫風也是很割裂了。 -
梁宇勇—做PPT挺好,其他時候基本就是個擺設,我手機裡裝著但一個月打不開幾次。 -
EAbak—口語化這點我給好評,比DeepSeek那種學霸腔聽著舒服,更像正常人說話。 -
Christine_Alvarez_2020—實測一圈下來我的結論就是:語音和教育交給星火,通用問答和寫程式碼交給別家,各幹各擅長的活最省心,非要拿它當全能選手用的遲早失望,這不是一款讓你驚豔的通用模型,但在它的主場幾乎無對手。 -
Bobby.HillX—深度研究那個功能試了下,搜資料到出PPT一條龍,摸魚黨狂喜。 -
RonaldDiaz168656—幻覺還是有的,別看官方說X1升級版幻覺治理領先,實際用起來一本正經胡說八道的時候也不少,重要資訊還是得自己核。 -
杜燕—訊飛2025年招投標拿了210個專案、23個多億,國內通用大模型廠商裡排第一,客戶全是教育局醫院能源國企。它根本沒打算跟你在C端卷,人家悶聲在政企賺錢,這商業模式其實很穩。 -
Sarah_TurnerZ—翻譯耳機裡用的就是它的技術,出國實測面對面翻譯挺順的,這種軟硬一體的場景訊飛是真有積累。 -
DPatelII—醫療V3.5那個版本據說評測榜第一,能多人錄音自動生成病歷,這種垂類深耕才是訊飛的護城河吧。 -
葉珍英—栓Q,充了會員寫作質量也沒見漲多少。