Qwen3.6-Plus
阿里巴巴通義實驗室釋出的旗艦級大語言模型,以智慧體程式設計為核心定位,程式設計能力接近Claude Opus 4.5水平
深度報告
-
Qwen3.6-Plus是阿里巴巴通義實驗室於2026年4月2日釋出的旗艦級大語言模型,是通義千問3.6系列的閉源旗艦版本。該模型以「智慧體程式設計(Agentic Coding)」為核心定位,在100萬token超長上下文、程式設計能力、智慧體任務執行和原生多模態理解等方面實現了全面升級。根據官方評測資料,Qwen3.6-Plus在SWE-bench Verified基準測試中獲得78.8分,程式設計能力已接近全球頂級模型Claude Opus 4.5水平,同時引數量僅為後者的1/2至1/3。在API定價方面,Qwen3.6-Plus輸入價格為2元/百萬tokens,輸出價格為12元/百萬tokens,價效比優勢顯著。Qwen3.6-Plus的釋出標誌著國產大模型在程式設計能力賽道正式躋身世界前列,成為2026年上半年最具競爭力的國產AI產品之一。
-
通義千問(Qwen)是阿里巴巴集團於2023年推出的自研大語言模型品牌,由阿里雲通義實驗室主導研發。作為阿里巴巴在AI大模型領域的核心產品線,通義千問在過去兩年間保持了高頻迭代節奏,從Qwen1.0到Qwen3.6-Plus,歷經數十次版本更新,形成了覆蓋通用對話、程式碼生成、推理和多模態的完整產品矩陣。阿里巴巴對通義千問的投入力度在國內AI企業中處於第一梯隊,僅2024年至2025年間就釋出了Qwen2.0、Qwen2.5、Qwen3.0、Qwen3.5等多個重要版本,並在開源領域陸續放出了Qwen2.5-Instruct、Qwen2.5-Coder等系列模型。 2026年4月2日,通義千問團隊正式釋出Qwen3.6-Plus,這是繼2026年2月釋出Qwen3.5系列後僅過了約45天的新一代旗艦模型。從釋出時間節點來看,阿里巴巴正在加速大模型的迭代節奏,以應對來自DeepSeek、智譜AI、MiniMax、月之暗面等競爭對手的激烈競爭。Qwen3.6-Plus的定位非常明確——打造國產最強程式設計智慧體模型,在軟體工程、程式碼生成、工具呼叫等場景對標全球頂尖產品。值得注意的是,與Qwen3.6-Plus同期釋出的還有開源版MoE模型Qwen3.6-35B-A3B,以及後續於4月20日釋出的Qwen3.6-Max-Preview預覽版,形成了完整的閉源+開源產品組合。 從市場背景來看,2026年全球AI大模型競爭已進入白熱化階段。OpenAI的GPT-5系列、Anthropic的Claude 4系列、Google的Gemini系列構成了國際第一梯隊;國內則有DeepSeek V3/R1、智譜GLM-5、MiniMax M2.7、月之暗面Kimi K2.5等強勁對手。在這一背景下,Qwen3.6-Plus的釋出承載著阿里巴巴在國產大模型競爭中保持領先地位的戰略意圖,尤其是在程式設計和智慧體這兩個當前最熱門、也是商業價值最高的應用場景中建立技術壁壘。
-
Qwen3.6-Plus採用了先進的混合稀疏MoE(Mixture of Experts)架構,這是一種在保持高效能的同時顯著降低推理成本的技術方案。與傳統稠密模型相比,MoE架構在處理每個輸入token時只啟用部分專家網路,從而實現了「大模型的能力,小模型的成本」。根據官方資料,Qwen3.6-Plus的引數量僅為Claude Opus 4.5的1/2至1/3,但效能表現卻能達到後者的同等水平,這在技術上體現了阿里巴巴在大模型效率最佳化方面的深厚積累。 在協議相容性方面,Qwen3.6-Plus同時支援OpenAI格式和Anthropic格式,這意味著開發者可以幾乎無縫地將現有基於GPT或Claude的應用遷移到Qwen3.6-Plus上。此外,模型還支援一個特色功能——preserve_thinking,該功能可以保留前序輪次的思維內容,對於需要長程記憶的智慧體任務尤為實用。 百萬token超長上下文:Qwen3.6-Plus將上下文視窗從上一代的256K直接擴充套件至100萬token,是目前國產大模型中最頂級的上下文規格。這一突破意味著模型可以一次性處理約8本長篇小說、完整的中等規模程式碼倉庫、數十份行業研報或大型合同文件。在實際應用中,超長上下文解決了大模型領域長期存在的「長任務中斷」痛點,使用者無需分段處理即可完成複雜的長程任務。 頂尖程式設計能力:在程式設計能力方面,Qwen3.6-Plus實現了多項突破:支援全棧程式碼生成,覆蓋前端、後端、移動端和資料庫等主流開發場景;創新性地支援Vibe Coding模式,使用者只需用自然語言描述需求,即可自動生成可互動的前端應用;具備精準的程式碼智慧修復能力,能夠識別並修復安全漏洞、自動最佳化程式碼效能;支援終端程式設計自動化,可直接操作命令列完成環境配置、指令碼執行和專案部署;還支援視覺程式設計,使用者上傳設計稿或原型圖後,模型可自動復刻為高保真前端頁面。 強智慧體(Agent)能力:Qwen3.6-Plus被官方明確定位為「智慧體程式設計」模型,其智慧體能力相比前代實現了質的飛躍。模型內建強制推理機制(Chain-of-Thought),在生成回答前必須完成完整的推理過程,這大大提升了複雜任務的分析質量;精準的工具呼叫能力使其能夠穩定地呼叫各類API、資料庫和檔案系統;支援長程任務持久化,可實現任務斷點續傳和記憶儲存;還支援多智慧體協同工作,可與其他AI智慧體聯合完成複雜任務。 原生多模態能力:Qwen3.6-Plus基於原生多模態資料訓練,在影象理解和影片分析方面表現突出。根據官方評測資料,模型在OmniDocBench 1.5文件理解測試中獲得91.2分的高分,能夠精準理解複雜排版的PDF檔案、掃描件和表格;在影片理解方面,模型支援逐秒拆解,上傳影片後可自動生成逐秒指令碼、分鏡和臺詞。此外,模型還支援文字、圖片、影片的混合輸入,實現了真正的多模態互動。 極低幻覺率:幻覺率(Hallucination Rate)是評估大模型可靠性的關鍵指標。Qwen3.6-Plus在事實核查和知識摘要場景中的幻覺抑制能力表現優異,內建多重事實校驗機制,對於不確定的資訊會主動標註而非強行生成。這一特性使Qwen3.6-Plus特別適合金融、法律、醫療、學術等對準確性要求極高的專業領域。 超高價效比:在保持頂級效能的同時,Qwen3.6-Plus實現了極高的價效比。模型引數量僅為Claude Opus 4.5的1/2至1/3,大幅降低了推理成本;API定價極具競爭力,限時優惠後輸入價格僅為2元/百萬tokens,輸出價格為6元/百萬tokens(Batch模式),這一定價僅為國際同類頂級模型的1/9左右。根據第三方測算,Qwen3.6-Plus的價效比指數是Claude的8.5倍。
-
根據官方公佈的評測資料,Qwen3.6-Plus在多個權威基準測試中取得了優異成績:SWE-bench Verified得分78.8分,代表軟體工程任務解決能力,超越Claude 3.7 Sonnet;Terminal-Bench 2.0得分61.6,代表終端命令理解與執行;HumanEval得分87.2%,代表程式碼生成能力;OmniDocBench得分91.2,代表複雜文件理解;Video-MME得分87.8,代表影片內容推理。
-
Qwen3.6-Plus提供多種使用渠道以滿足不同使用者的需求。官方渠道包括:阿里雲百鍊平臺提供API呼叫服務,適合企業級應用和開發者整合;Qwen Chat網頁端(chat.qwen.ai)提供直接對話服務,對普通使用者更加友好;千問APP和悟空應用支援移動端使用,支援語音、圖片和影片輸入。第三方渠道包括:OpenRouter提供免費預覽版,使用者可在不付費的情況下體驗模型基礎能力;OpenCode等開源程式設計智慧體已整合Qwen3.6-Plus;主流程式設計助手如OpenClaw、Qwen Code、Claude Code等均已適配Qwen3.6-Plus。
-
Qwen3.6-Plus採用閉源商業化模式,透過API呼叫進行變現。在阿里雲百鍊平臺上的詳細定價如下:標準輸入2元/百萬tokens,Batch File輸入1元/百萬tokens,Batch Chat輸入1元/百萬tokens(原價2元,5折優惠),標準輸出12元/百萬tokens,Batch File輸出6元/百萬tokens,Batch Chat輸出6元/百萬tokens(原價12元,5折優惠),顯式快取建立2.5元/百萬tokens,顯式快取命中0.2元/百萬tokens。新使用者可免費領取7000萬tokens用於體驗。對於批次處理任務,Batch模式可享受5折優惠,這一定價策略顯著降低了大規模應用的門檻。 與競品對比,Qwen3.6-Plus的價格優勢非常明顯。以Claude Opus 4.6為參照,其輸入價格約為18元/百萬tokens,Qwen3.6-Plus的價格僅為其1/9;與GPT-5相比,Qwen3.6-Plus的價效比優勢同樣顯著。這種「高效能+低價格」的組合策略,使Qwen3.6-Plus成為2026年上半年價效比最高的國產頂級模型之一。 在商業模式方面,Qwen3.6-Plus主要透過阿里雲百鍊平臺變現,同時在OpenRouter等第三方平臺提供免費預覽版以擴大使用者基礎。這種「免費增值」(Freemium)模式兼顧了使用者增長和商業變現的雙重目標。
-
正面評價:來自開發者社群和科技媒體的正面評價主要集中在以下幾個方面:程式設計能力突出——眾多開發者實測後表示,Qwen3.6-Plus的程式碼生成質量已接近Claude水平,尤其是在前端開發、Python指令碼編寫和程式碼修復場景中表現優異。有開發者分享使用Qwen3.6-Plus獨立完成複雜專案的案例,證明其具備獨立承擔軟體工程任務的能力。超長上下文實用性強——100萬token的上下文視窗獲得了廣泛好評,開發者表示可以一次性上傳完整程式碼倉庫進行跨檔案分析,大大提升了程式碼審查和技術債務清理的效率。價效比無可匹敵——相比動輒數十元/百萬tokens的國際頂級模型,Qwen3.6-Plus的定價讓中小開發者和初創企業也能負擔得起高質量的AI程式設計服務。多模態能力實用——影象理解和影片分析功能在文件處理、UI設計稿轉程式碼等場景中表現出色,被認為是「真正能幹活的多模態模型」。 負面反饋:當然,Qwen3.6-Plus也存在一些需要改進的地方:知識時效性有限——訓練資料存在截止日期,對於最新技術棧和2026年後的新知識覆蓋不足,需要配合聯網搜尋獲取最新資訊。複雜推理偶有失誤——在極少數高度複雜的數學推理和邏輯分析場景中,模型仍可能出現推理鏈斷裂的情況。對比頂級模型仍有差距——雖然已接近Claude Opus 4.5水平,但在某些特定領域的深度推理能力與全球最強模型相比仍存在微小差距。
-
媒體觀點:國內科技媒體對Qwen3.6-Plus的評價整體積極。36氪等媒體認為,Qwen3.6-Plus的釋出標誌著國產大模型在程式設計能力這一最核心的賽道上實現了從「追趕」到「並跑」的跨越。IT之家、量子位等媒體也對模型的技術創新給予了高度評價,認為100萬token上下文和強智慧體能力是當前大模型應用落地的關鍵技術突破。 競爭格局:從競爭格局來看,Qwen3.6-Plus的主要競爭對手包括:國際競品——Claude Opus 4.5/4.6、GPT-5系列、Google Gemini系列。在程式設計能力維度,Qwen3.6-Plus已接近Claude Opus 4.5水平,但在品牌認知度和全球開發者生態方面仍有差距。國內競品——DeepSeek V3/R1、智譜GLM-5、MiniMax M2.7、月之暗面Kimi K2.5。Qwen3.6-Plus在程式設計基準測試中的表現優於GLM-5和Kimi K2.5,與DeepSeek R1形成直接競爭;在價效比方面則與DeepSeek形成雙雄格局。差異化定位——相比DeepSeek的「極致價效比」路線和MiniMax的「自我進化」概念,Qwen3.6-Plus更強調「智慧體程式設計」這一具體應用場景的深度最佳化,形成了差異化的產品定位。
-
技術風險:長上下文幻覺問題——雖然Qwen3.6-Plus在短文字場景下的幻覺率控制良好,但在超長上下文(接近100萬token)的邊緣情況下,仍可能出現資訊丟失或誤解的情況。這一問題在處理大型程式碼倉庫或長篇文件時需要特別關注。智慧體自主性邊界——Qwen3.6-Plus雖然具備較強的工具呼叫能力,但其「自主決策」仍建立在人類設定的框架內。在完全開放的環境中執行敏感操作時,需要人工監督以避免潛在風險。 商業風險:閉源策略的侷限性——與DeepSeek的全面開源策略不同,Qwen3.6-Plus選擇閉源商業模式。雖然這有助於保護技術機密和商業變現,但也限制了開發者社群的參與度,可能影響產品生態的長期發展。定價壓力——國內大模型市場價格戰愈演愈烈,DeepSeek的極低定價已對市場格局產生顯著影響。Qwen3.6-Plus雖已具備價格優勢,但面對競爭者的進一步降價,可能面臨利潤壓縮的壓力。迭代節奏挑戰——從Qwen3.5到Qwen3.6-Plus僅間隔約45天,如此高頻的迭代對研發團隊的資源調配和質量管理提出了極高要求。長期保持這一節奏可能帶來產品質量波動的風險。
-
適合人群:軟體開發者和工程師——Qwen3.6-Plus在程式設計程式碼生成、bug修復、程式碼審查等方面表現突出,是開發者的強力效率工具。尤其是需要處理複雜專案、進行跨檔案分析的開發者,100萬token上下文提供了極大便利。需要長文字處理的職業——如法律顧問、學術研究員、金融分析師等,需要處理大型文件、合同、研報的專業人士,Qwen3.6-Plus的超長上下文和低幻覺率特性非常實用。企業AI應用開發者——需要在自有產品中整合高質量AI能力的開發團隊,Qwen3.6-Plus的高價效比和協議相容性使其成為理想選擇。追求價效比的使用者——相比國際頂級模型,Qwen3.6-Plus以1/9的價格提供了接近同等的效能,適合預算有限但對質量有要求的使用者。 不適合人群:對多模態生成有強需求的使用者——Qwen3.6-Plus是多模態理解模型而非生成模型,如需影象生成能力,應考慮DALL-E、Midjourney、通義萬相等產品。需要最新知識的場景——模型訓練資料存在時效限制,對於需要實時最新資訊的場景,建議配合聯網搜尋功能使用。對開源有硬性要求的專案——Qwen3.6-Plus為閉源模型,如專案必須使用開源模型,可考慮Qwen3.6-35B-A3B或其他開源替代品。 最佳實踐建議:智慧體任務——開啟preserve_thinking: true選項,以保留推理過程,提升複雜任務的完成質量。程式碼開發場景——充分利用視覺程式設計功能,上傳設計稿或截圖可加速前端開發效率。長文件處理——直接上傳完整文件或程式碼倉庫,利用100萬token上下文實現一次性整體分析。成本最佳化——對於非實時性任務,使用Batch模式可節省50%成本;利用快取命中功能(僅0.2元/百萬tokens)可進一步降低成本。
-
Qwen3.6-Plus是阿里巴巴通義實驗室在2026年釋出的一款具有里程碑意義的國產大模型產品。它以「智慧體程式設計」為核心定位,在100萬token超長上下文、程式設計能力、智慧體任務執行和原生多模態理解等方面達到了國產最高水平。根據官方評測資料,Qwen3.6-Plus在SWE-bench Verified基準測試中獲得78.8分,程式設計能力已接近全球頂級模型Claude Opus 4.5,同時引數量僅為後者的1/2至1/3,體現了阿里巴巴在大模型效率最佳化方面的深厚技術積累。 在市場定位上,Qwen3.6-Plus選擇了「高效能+合理定價」的差異化路線。輸入2元/百萬tokens、輸出12元/百萬tokens的定價僅為國際頂級模型的1/9左右,使高質量AI程式設計能力不再是大公司的專利。配合阿里雲百鍊平臺的成熟商業化基礎設施和多種第三方接入渠道,Qwen3.6-Plus正在快速擴大其使用者基礎和生態影響力。 當然,作為一款新產品,Qwen3.6-Plus也存在一些需要持續改進的地方:知識時效性、複雜推理能力的進一步提升、以及在極端長上下文場景下的穩定性等。但總體而言,Qwen3.6-Plus的釋出標誌著國產大模型在程式設計能力這一核心賽道上正式躋身世界前列。對於國內開發者和企業使用者而言,Qwen3.6-Plus提供了一個效能卓越、價格合理、接入便捷的優質選擇。隨著後續版本(如Qwen3.6-Max-Preview)的推出,通義千問系列有望在國產大模型競爭中保持領先地位。
使用者評論
-
AWhite_X—Qwen Code、Claude Code、Cline 這些框架都適配了,接 OpenClaw 跑多步任務絲滑,但 Looping 的問題還在,複雜活還是得盯著點。 -
EHall520—阿里把通義升格成事業部了,吳泳銘親自掛帥,這架勢是要 All in 大模型。 -
Lauren.Gray140—說點不好聽的,獨立評測裡它的準確率 71.6%,比前代 Qwen3.5-Plus 反而掉了 3 個百分點,單次呼叫成本還漲了 82%——ATH 那套「生成→執行→修復」閉環要吞 3 到 5 倍 token。不過從絕對值看還是便宜,最後交付質量反而因為會自己修而更穩,算是個更謹慎的程式設計師吧。 -
XP79XTBE—8 分鐘讓它照著 Claude 前端 Skill 做了個 AI 眼鏡獨立站,三輪對話完事,就是字型選擇還是偏套路,沒跳出現在常見的那幾款。 -
林丹華—不過它不是開源權重了,純託管 API,本地部署黨有點難受。 -
mARKbERG—踩了個坑,免費預覽版 API 頻率限制挺嚴的,高頻 Agent 自動化跑長流程動不動觸發 Rate Limit 把任務打斷,真要上生產得買付費檔或者自己做好重試和退避,不然半夜跑批能給你卡死。 -
Miranda717—價格確實沒得說,百鍊平臺每百萬輸入才兩塊錢、輸出十二塊,約等於 Claude 的十分之一。我用它生成一整個官網只花了 0.15 元、燒了兩萬五千 token,對中小團隊來說這個成本真的能放開手腳造,不用每次調介面都心疼。 -
夏風769—百萬 token 上下文是真香,整個中型專案程式碼庫直接丟進去讓它梳理技術債。 -
JDiaz—吐槽一個,複雜任務偶爾會陷入迴圈輸出,同一段程式碼反覆生成,遇到高安全級的需求(許可權管理、加密實現)官方自己測的成功率才 43.3%,這種場景我是絕對不敢單獨丟給它跑的。 -
秦軒傑—Terminal-Bench 2.0 拿了 61.6,比 Claude Opus 4.5 的 59.3 還高,shell 操作、檔案管理這種硬核終端任務確實能扛,國產模型頭一回站到這位置。 -
Doris.Kim_88—國產程式設計第一梯隊了。 -
Abigail_Jones_X—我們團隊把 Qwen3.6-Plus 塞進了日常工作流,晨會紀要做行動項、客戶郵件做語氣校準、實習生指令碼逐行註釋,97 天兩千多次互動用下來,128K 下處理帶表格和 YAML 的混合文件,跨段落指代消解基本不出錯,長上下文穩定性是真能打。 -
NoahBennett—拿它跑了一次 Vibe Coding,一句話生成了個 AI 資訊日曆網站,月曆檢視加詳情頁,前後翻月都支援,兩分鐘出活,前端審美比很多模型強。 -
Anna_Ward_2021—首字延遲有點狠,免費版偶爾卡 11 秒才出字。 -
Jacqueline.PatelX—OpenRouter 上預覽版能免費用,先搭個內部小工具練手,體感比上一代順。 -
SOtho—免費的先衝了。 -
1r6ya4m—Qwen3.6-Plus程式設計能力確實強,之前用DeepSeek寫Python,現在換成Qwen3.6-Plus,程式碼質量明顯上一個檔次。 -
傅昊欣—100萬token上下文太香了,直接上傳整個程式碼倉庫讓它分析,效率提升明顯。 -
李傑—已對比Claude Opus 4.5,程式設計能力確實接近了,價效比卻高出好幾倍,這波支援國產。 -
Christian_Ortiz_Plus475—阿里雲百鍊平臺呼叫很穩定,比之前用DeepSeek的高峰期502體驗好很多。 -
PFloresIII—價格是真心便宜,輸入2元/百萬tokens,比Claude便宜太多了,學生黨也能用得起。 -
淡然_11—Vibe Coding模式太牛了,只需用自然語言描述需求,前端程式碼直接生成,太省心了。 -
JunoJet73—智慧體程式設計能力確實強,工具呼叫比之前版本穩定多了,基本不會出現幻覺呼叫。 -
宋磊剛—多模態能力很實用,上傳設計稿直接生成程式碼,UI開發效率翻倍。 -
Bitcoiner360—preserve_thinking功能對長程任務太友好了,之前的思考過程可以保留。 -
EllaJohansen—支援OpenAI和Anthropic兩種協議,遷移成本幾乎為零,好評。 -
Joseph.Reed—和Qwen3.5對比,3.6版本的程式設計能力提升感知明顯,程式碼更加規範了。 -
R_yan619—影片理解功能測試了一下,能準確提取影片內容並生成指令碼,效果超出預期。 -
AmyCampbell55—BUG修復能力有提升,但複雜場景下偶爾還是會出現理解偏差,需要人工稽核。 -
雲煙_18—視覺程式設計功能很驚豔,給一張截圖就能生成對應程式碼,前端開發者福音。