阿裏正式發佈新一代旗艦大模型Qwen3.8。
8月3日,阿裏巴巴正式發佈新一代基座大模型Qwen3.8,總參數量2.4萬億,在編程(Coding)和專業辦公(Cowork)方面能力大幅提升。今日放榜的權威三方榜單Arena中,阿裏Qwen模型僅次於Anthropic的Claude系列,整體性能處於全球大模型第一梯隊。
目前,Qwen3.8的API已上線千問AI平臺,並接入阿裏今日同步推出的Agent產品“千問辦公”。Qwen3.8-Max預計下周開源,同時還將開源Qwen3.8-27B。
今日起,全球開發者都可通過千問AI平臺獲得Qwen3.8的API服務,國內每百萬Tokens輸入12元、輸出36元,隱式緩存命中僅1.5元,而輸入與輸出的國際價格僅為Opus5的40%與24%,實現相近智能更高性價比。
8月3日,港股阿裏巴巴(9988.HK)早盤股價持續拉升,截至發稿漲近6%。

權威三方榜單Arena中,阿裏Qwen模型僅次於Anthropic的Claude系列。來源:阿裏雲
據介紹,此次發佈的是千問大模型系列中尺寸最大、性能最強的旗艦模型Qwen3.8-Max,它支持視覺理解,上下文長度達1M Tokens。在模型架構上,Qwen3.8通過稀疏MoE架構與混合注意力機制的聯合優化,首次將千問大模型的總參數量拓展至2.4T,啟動95B,獲得了更高的推理效率、更快的推理速度,整體性能也迎來新突破。
同時,Qwen3.8在指令遵循IF Bench評測中斬獲82.8分,科學推理GPQA Diamond取得92.6分,系列通用能力均位居前列;在視覺推理BabyVision評測中,Qwen3.8-Max在無工具條件下取得82.0分,超出部分主流模型近兩倍,在評估智能體電腦操作能力的OSWorld-Verified評測中,Qwen3.8-Max以86.1分位居主流模型首位。
阿裏雲方面表示,編程能力(Coding)是前沿大模型的核心能力之一,Qwen3.8實現了自主編程的新突破。在權威CodeArena榜中,Qwen3.8位居全球第四。2年前的前沿模型能寫好函數、補全代碼,成為程式員的有力幫手,而如今,Qwen3.8可以從一個空文件夾出發,自主完成一個十數天的真實專案交付,全程無需人干預。
此外,Qwen3.8可勝任廣泛的、真實的專業工作任務(Cowork)。面對完全不同的專業任務、評判標準和計算需求,Qwen3.8通過真實環境和算力的聯合強化學習(RL)擴展,實現了數百種高價值、高頻專業任務的真實表現提升,在主流的智能體框架中均可穩定可靠地交付生產級成果。
除了擁有強大的文本和推理能力,Qwen3.8還提高了AI視覺理解能力的極限。在權威Vision Arena榜單中,Qwen3.8-Max排名全球第二。在千問團隊構建的“應用複刻”基準RecreationBench長程任務中,模型沒有源代碼,也無法聯網,只通過交互與回饋去理解這個應用,卻能從零複刻出整個應用。這表明,Qwen3.8已經展現出前沿水準的混合多模態智能體能力,通過“迭代編程—交互回饋”的反復迴圈,將視覺編程(Visual Coding)推向新的高度。
此前,阿裏千問大模型官方帳號7月19日下午發文稱,Qwen3.8-Max預覽版模型已首發上線阿裏Token Plan、Qoder及QoderWork。Qwen3.8很快將發佈並開源,新模型參數達到2.4T,可能是除了Fable 5外最強大的模型。
來源:中國澎湃新聞