京東 言犀 3
京東自研的產業級 AI 平臺第三代,以言犀大模型與數字人 3.0 深耕電商、客服與供應鏈場景
深度報告
-
京東 言犀 3 是京東集團自研產業 AI 平臺的第三代形態,根植於言犀大模型、數字人 3.0 與 2025 年升級後的 JoyAI 品牌矩陣。它把京東十餘年的供應鏈、客服與電商資料沉澱,轉化為語言、語音、影象、影片、數字人等多模態能力,主攻零售、金融、政務、物流等嚴肅商業場景。 和通義、文心、豆包等面向消費者的通用大模型不同,言犀的差異化在於「貼著產業走」——用 70% 通用資料加 30% 京東數智供應鏈資料訓練,在電商、客服、直播帶貨這類高知識密度任務上表現突出。
-
言犀的前身是京東 2009 年組建的人工客服團隊,2020 年正式釋出智慧客服品牌,2022 年升級為 2.0 平臺。2023 年 7 月,京東在探索者大會推出千億級引數的言犀大模型,並公佈「三步走」產業落地規劃。2024 年,京東雲釋出言犀智慧體平臺與言犀數字人 3.0 平臺。2025 年 2 月,言犀全系產品接入 DeepSeek R1/V3;同年 7 月,在世界人工智慧大會上,言犀大模型品牌升級為 JoyAI,形成從 3B 到 750B 的全尺寸模型矩陣。 進入 2026 年,京東明顯加快了 AI 商業化節奏。1 月,京東成立「變色龍」業務部,把原先散落在各業務的 AI 專案整合成獨立業務單元,並升級消費者端大模型助手 JoyAI App、推出京犀購物助手。3 月,京東雲釋出「言犀」政務大資料大模型 3.0,強化城市治理海量異構資料的關聯分析,支援語音一鍵生成社會治理分析圖表,已在北京、蘇州等智慧城市專案落地。同月 24 日,京東開源基礎大模型 JoyAI-LLM Flash 的 Instruct 版本,主打「Token 效率」,在同等任務正確率下消耗的 Token 僅為同類模型的四分之一到五分之一,專門配合 OpenClaw 這類智慧體應用。
-
言犀 3 的核心是一整套多模態大模型。語言大模型支援模型自進化與低位元高精度量化推理,視訊記憶體可節約 70%;語音大模型基於 20 萬小時語音資料訓練,支援零樣本與跨語種語音合成,能識別中、英、泰、印尼、越南等外語及中國 20 種方言;影象大模型提供中文原生的文生圖能力,支援 4K 以上超高解析度與定製風格;影片大模型採用自研 4D 並行框架,可生成最長 32 秒的 1080p 高畫質影片;數字人大模型主打「零幻覺、零樣本實時推理」,可在直播間實時應答。 應用層最成熟的是數字人直播。2024 年釋出的言犀數字人 3.0 平臺支援雲端一鍵開播、無需本地電腦配置,上千個直播間可同時線上,開播成本較此前降低 30%。到 2026 年一季度,京東數字人已服務超 7 萬商家,開播量同比增長 10 倍,帶動數百億 GMV。2026 年 4 月的京東商家大會上,京東進一步釋出以「互動 Agent」為核心的數字人直播智慧互動體系,引入電商知識增強問答、場控動態響應與多智慧體協同,並提出「快慢雙驅」演進方向:快思考負責毫秒級基礎互動,慢思考深度融合供應鏈、庫存、價格等全鏈路資料做經營決策,讓數字人從「聽指令的提線木偶」走向能自主排品、自動補貨、智慧促單的零售 Agent。 另一端,京東在 2025 年底上線獨立 App「京東 AI 購」,底座為言犀大模型,主打對話式購物。2026 年 5 月多家媒體實測發現,它在產品推薦、AI 試穿、外賣推薦上「能用,但代替不了人」:試穿圖無法還原真實體型,外賣推薦常不理解「附近」,定期復購功能還不夠穩定。不過在比價與低價監控上,京東 AI 購表現優於對手。
-
數字人是言犀目前跑得最順的變現路徑。2025 年 12 月,京東數字人全面免費開放,軟體系統免費、日均成本低於百元,中小商家幾乎零門檻即可開播。企業側還有 JoyAI 企業智慧體(JoyAgent)、商用授權,以及按訓練與推理計費的言犀 AI 開發計算平臺。 面向智慧體落地,京東雲推出基於國產晶片的 OpenClaw 一體機,開箱即用,配套 Token 套餐壓降算力成本。總體看,言犀的商業化以「免費工具引流、企業服務與算力收費變現」為主。
-
真實使用者與開發者對言犀的反饋比較分化。在電商與客服場景,言犀被普遍認為「接地氣」:有人把京東言犀和 DeepSeek 各用一週後總結,言犀對中文電商髒字串(SKU、訂單、評論)更挑得動,京東雲全家桶的許可權、計費、監控、私有化部署都是現成的,企業合規鏈路也順。數字人直播的降本效果最被認可——成本僅為真人團隊的十分之一,閒時轉化率能超過 30%。 但短板同樣明顯。非京東雲使用者接入言犀生態摩擦較大;通用程式碼任務不算頂尖,和 DeepSeek 的差距主要集中在電商場景之外;文件比通義千問散,社群案例不夠多;部分高階功能需單獨申請;純個人使用者會覺得價格不夠便宜。AI 購物助手則被多家媒體點名「穩定性、信任度、使用者習慣都還沒建立起來」。
-
在產業大模型的格局裡,言犀常和通義千問、文心一言、華為盤古並列。通義多模態生成領先、盤古工業質檢精度高、文心政務資源整合優,而言犀的強項在供應鏈最佳化。2025 年京東財報會上,管理層披露自研言犀大模型呼叫量一年內激增近百倍,京東雲 Token 呼叫量曾創周增長 455% 的紀錄。 不過也有分析認為京東 AI 佈局整體「滯後且保守」:當阿里把千問全面接入淘寶、位元組豆包日活破千萬時,京東直到 2026 年 1 月才成立獨立 AI 業務部,C 端產品投入明顯不足。
-
最大的爭議是「數字人會不會取代真人主播」。京東自己的定位很剋制——數字人是真人團隊的補充,做的是挖掘真人下播後的長尾流量,平均閒時轉化率超過 30%,而非正面競爭。 另一個風險來自 AI 購物的現實表現:推薦不精準、標價與實際成交價不符、平臺渠道壁壘森嚴、時常混入無關商品。這些短板讓言犀在 C 端離「貼心管家」仍有距離。此外,京東雲產品深度繫結自家生態,對想多模型混用的企業不夠友好。
-
言犀 3 最適合有嚴肅商業場景的 B 端客戶:零售品牌做數字人直播與智慧客服、金融機構做風控數字員工、政務部門做 12345 熱線與城市治理、物流與製造企業做流程自動化。對京東平臺上的中小商家,數字人直播是當下價效比最高的切入點,免費且能補閒時增量。 普通消費者可以試用京東 AI 購做比價和復購,但別指望它完全替代人工挑選。如果追求通用程式碼能力或最低價格,DeepSeek 這類開源模型會更划算;若深耕供應鏈與電商場景,言犀仍是更對路的選擇。
-
京東 言犀 3 不是又一個追熱點的通用聊天模型,而是把京東的供應鏈與交易場景當作護城河的產業 AI 平臺。它在 B 端(數字人直播、企業智慧體)已經跑通商業閉環,在 C 端(AI 購、JoyAI App、JoyInside 硬體大腦)還在培育期。對想用 AI 真正「幹活」而非「聊天」的企業來說,言犀是當下最貼產業的選項之一。
使用者評論
-
毛雪素—京東數字人真的省,我們小店開播成本一天不到一百塊。 -
VWalker_77—我拿京東言犀和 DeepSeek 各用了一週做對比,結論是各有所長、談不上誰吊打誰。言犀對中文電商業務細節明顯更敏感,SKU、訂單、評論這些髒字串它吃過見過;DeepSeek 在通用程式碼和複雜推理上更穩,價格也更低、還開源。落地選哪個,最終還是看你的場景是不是貼著電商走。 -
韓麗—言犀文件比通義散,踩坑只能自己翻。 -
realSuzannaLucas_x—JoyInside 接進玩具裡,我媽現在不催我電話了。 -
海浪_11—我們公司是京東雲老使用者,上 JoyAgent 做售後工單處理,原本要人工分類回覆的內容現在智慧體自動識別、自動派單,效率提升非常明顯。但說實話,如果不是京東雲體系內的企業,光是許可權、計費的接入摩擦就夠喝一壺,言犀這套生態綁得確實緊,好處是合規鏈路現成,壞處是遷移成本高。 -
史妍晴—做電商客服的,言犀對訂單、評論這些中文髒字串確實挑得動,比通用模型接地氣,工單分類順手多了。 -
JesusScott—京東 AI 佈局晚了半拍吧。 -
Billy_Reed—我們做家電的,之前請真人主播一場下來成本好幾萬,還得排班。換成言犀數字人後雲端一鍵開播,上千個直播間同時跑,單店成本降到兩位數,閒時轉化反而比真人高。現在數字人已經是我們標配了,但複雜場景的互動還得運營盯著,離「完全自主經營」還差口氣。 -
Jennifer_LeeK—我們品牌用言犀數字人做了「直播間復刻」,上傳一段真人直播影片就生成了形象聲線高度一致的數字分身,不用再請主播熬夜播。上線後公域流量提升超六成,人均停留時長接近兩分鐘,對人力有限的中小商家而言,這套工具的價效比確實沒話說。 -
KathleenKim_2022—用言犀做智慧外呼,私域加粉效率高了不少。 -
EugeneBaileyK913—實事求是講,京東 AI 購現在還是「能用但別指望替代人」。我讓它推薦減脂期附近的輕食外賣,它推的品類單一,門店還都在五公里開外,明顯沒吃透「附近」這個需求;定期復購功能我也測了,到點經常不觸發。整體體驗離貼心管家還有距離。 -
PaulBrownZ—京東 AI 購試穿圖根本看不出我梨形身材,參考價值不大。 -
Cebai—數字人直播適合標品和閒時增量,凌晨那種沒人播的時段反而能出單,我們農產品店凌晨 GMV 佔比直接從 3% 拉到 27%。 -
JerryKruger—東哥數字人首秀那場太魔幻了。 -
Joseph_Smith_Max—安踏那場數字人直播間 GMV 破兩千萬、轉化率三十多,基本每三個進直播間就有一個下單,這資料確實能打。 -
Kevin.Torres—政務大模型 3.0 那個語音生成社會治理圖表的功能挺實用,我們街道試點後報表時間省了一大半,比人工整理強太多。 -
NFlores_X—看過京東 JoyAvatar 的論文,長時長、自由態數字人這次確實突破了「站樁播報」,複雜指令能絲滑做全身動作,唇形還能和音訊完美同步,GSB 評分超過 omnihuman 和 KlingAvatar,技術上是代差級優勢,做直播短影片的想象空間一下就開啟了。 -
DWard_6632—價格不算最便宜,個人開發者用言犀會有點心疼,開源的 Flash 版才更香。 -
Kenneth.Gonzalez_356—言犀這波開源挺良心,Flash 模型消耗的 token 才別家的五分之一。