阿里巴巴發佈Qwen 3.8-Max:迄今規模最大、能力最強的旗艦模型
阿里巴巴正式宣佈推出Qwen 3.8-Max,這是迄今為止千問(Qwen)系列中最強大的模型。 Qwen 3.8-Max擁有 2.4 萬億參數,支持多達 100 萬Token的上下文窗口,在權威的第三方榜單Text Arena 中排名第五,Vision Arena 排名第二,並在編程、辦公、科學研究及長週期任務中展現出卓越的能力。 作為多模態基座模型,Qwen 3.8-Max 支持視覺智能。
目前,全球開發者可透過阿里雲國際百煉平台的API調用該模型。 模型權重預計將於下週公佈。 用戶也能在阿里巴巴最新推出的一站式 AI 辦公智能體平台「千問辦公」(Qwen Work)上體驗此模型。
- Qwen 3.8-Max 在Text Arena排名第五
- Qwen 3.8-Max 在Vision Arena排名第二
創新架構:兼顧超大規模與高效推理
基於 Qwen 3.5,Qwen 3.8-Max 採用前沿稀疏混合專家(MoE)架構,並結合混合注意力機制。 此設計成功平衡模型規模與推理效率。 儘管總參數達2.4萬億,Qwen 3.8-Max 在實際推理時僅啟動 950 億參數。 此創新架構使模型在處理複雜任務時能提供前沿的智能表現,並且相較於同等規模的傳統密集模型大幅降低計算成本與延遲。
自主編程、辦公及長週期任務的尖端能力
Qwen3.8-Max 在 Frontend Code Arena 排名第四,擅長自主編程與長週期執行,能較長時間獨立運行而無需人工干預。 在內部測試中,該模型自主完成了一個為期16天的真實軟件工程項目開發。 在被指派從零開始建立一個自進化智能體框架後,Qwen3.8-Max 建立了一個工程閉環 — 能夠整合用戶反饋、社區最佳實踐與自測數據,並透過持續的程式碼生成、測試、預覽與日誌分析迭代,最終產出名為「oh-my-cli」的自進化智能體框架,該框架已完全開源於 GitHub。

Qwen3.8-Max 在 Frontend Code Arena 排名第四
除了編程自動化外,Qwen 3.8-Max 還在高度專業領域推動創新。 例如,該模型不僅能復現已發表的研究實驗,還設計出優於原始論文的新方法。 在WWW2025多模態對話意圖識別挑戰賽中,Qwen 3.8-Max 表現優於人類參賽者,展現其在分析客服對話紀錄及準確理解複雜用戶需求方面媲美人類的能力。
此外,Qwen 3.8-Max 專為處理複雜的真實工作情境而設計,涵蓋應用設計、法律文件審查、體育數據分析、金融研究、餐飲概念開發、康復進度可視化及建築 3D 建模等領域。 透過聯合擴展強化學習環境與算力資源,該模型在主流智能體框架中的通用操作能力顯著提升。 面對高度複雜、存在眾多約束且週期長的任務,Qwen3.8-Max 同時展現出卓越的系統級自主規劃能力及端到端的閉環自適應學習能力。
視覺智能與多模態智能體能力
作為多模態基座模型,Qwen3.8-Max 支持視覺智能,能將靜態輸入轉換為動態且可交互式的知識結構。 此模型能無縫處理過百頁文件、整部電視劇集或長達100小時的直播內容,將其轉化為可搜尋且可交互的知識庫。
Qwen3.8-Max 擅長基於即時視覺反饋進行持續執行與創作。 其多功能能力包括:將原始個人素材剪輯成專業Vlog、根據文字提示生成沉浸式教育動畫、從單一UI介面截圖重建完整的前端網頁項目、將 2D 平面圖轉換為詳細的 3D 室內效果圖,以及根據自然語言需求直接打造交互式遊戲。
為驗證這項能力,團隊推出了長週期應用重構的基準測試RecreationBench。 在完全黑箱、無法上網且無法查看原始程式碼情況下,Qwen 3.8-Max 能夠透過僅與實際應用程式的互動與反饋,自主從零重構應用程式。 結果顯示,僅依靠互動式評估與視覺反饋,該模型仍展現出尖端的混合型智能體能力。
立即訂閱阿里足跡,緊貼阿里巴巴集團最新發展動向,通過新聞故事及專題文章了解創新科技、電子商務及智能物流等新興議題的嶄新趨勢。
分享