阿里巴巴Qwen3.8正式發布:2.4萬億參數國產大模型編程能力突破
![]()
阿里巴巴于8月3日正式發布新一代基座大模型Qwen3.8,總參數量高達2.4萬億,是繼Kimi K3之后國產大模型"兩萬億俱樂部"的第二位成員。在權威榜單Arena中,Qwen模型僅次于Anthropic的Claude系列,整體性能穩居全球第一梯隊。
核心能力突破與自主編程里程碑
阿里巴巴Qwen3.8在編程(Coding)和專業辦公(Cowork)兩大核心維度實現關鍵突破,標志著國產大模型從"輔助工具"向"自主工程師"的角色演進。在編程領域,CodeArena榜單顯示Qwen3.8位居全球第四,超越多數國際旗艦模型。更值得關注的是,Qwen3.8實現了從"寫函數補代碼"到"從零交付完整項目"的質變。在一個真實演示中,僅需一句"創建一個自進化的智能體Harness"指令,Qwen3.8從空文件夾出發,自主搭建循環工程框架,編排智能體自動領取和執行任務,整個過程無需人工干預,連續運行約16天后,獨立交付了一個真實可用的自進化智能體框架項目。整個開發過程代碼與流程完全開源至GitHub,供全球開發者查閱。這一突破意味著大模型正在從代碼輔助工具進化為具備系統級規劃能力的智能體引擎,為軟件工程領域帶來范式級變革。
技術架構與推理效率優化
Qwen3.8采用稀疏MoE(混合專家)架構,總參數量2.4萬億,單次激活參數僅95B,相當于擁有2400名員工的超級工廠精準調度95名骨干員工。架構層面實現了推理效率與模型容量的最優平衡,單次推理速度顯著提升。在專業辦公場景中,Qwen3.8支持1M Tokens超長上下文,可完整讀取200頁財報PDF或分析超100小時視頻內容。技術評測數據顯示,Qwen3.8在科學推理GPQA Diamond評測中取得92.6分,指令遵循IF Bench評測中取得82.8分,視覺推理BabyVision無工具條件下取得82.0分,超出部分主流模型近兩倍。在OSWorld-Verified智能體電腦操作能力評測中,Qwen3.8以86.1分位居主流模型首位。阿里巴巴真武M890超節點已成功適配Qwen3.8,通過芯片、云平臺與千問大模型的全鏈路優化,在Agentic推理場景中最多實現1.5倍性能提升。
商業定價與企業級應用前景
Qwen3.8的API已上線千問AI平臺,國內定價為每百萬Tokens輸入12元、輸出36元,隱式緩存命中僅1.5元,國際價格分別為Opus5的40%和24%,實現相近智能更高性價比。同日,阿里巴巴同步推出企業級Agent產品"千問辦公"(QwenWork)公測,該產品由QoderWork、MuleRun、悟空三款產品整合而來,是業內首款同時支持桌面端Agent、云端Agent、企業協同Agent的產品。千問辦公已初步打通釘釘IM,未來將全面連接企業真實數據庫和工作流。典型應用場景包括:20人規模律師事務所資深律師通過多次交互完成首份并購盡調報告后,可將全過程一鍵沉淀為"組織級Skill"向全團隊共享;籃球數據分析團隊利用Qwen3.8在數十分鐘內精準拆解160小時比賽錄像中的8400多個攻防回合,一次性輸出球員戰術畫像和教練報告。千問系列累計下載量超過10億次,在全球最大AI開源社區Hugging Face排名榜首。預計下周開源Qwen3.8-Max和Qwen3.8-27B,開源生態將進一步擴大。
![]()
【信源】界面新聞 | 阿里Qwen3.8正式發布,總參數量2.4萬億 | 2026-08-03
【信源】科技日報 | 阿里正式發布Qwen3.8,千問辦公開啟公測 | 2026-08-03
【信源】杭州網 | 阿里發布新一代基座大模型Qwen3.8,預計下周開源最大尺寸版本 | 2026-08-04
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.