阿里巴巴發佈 Qwen 3.8-Max 2.4 萬億參數、100 萬 Token 上下文 主打編程、辦公及多模態能力

| Simon Chan | 04-08-2026 07:57 |
在Google
追蹤《e-zone》
阿里巴巴發佈 Qwen 3.8-Max 2.4 萬億參數、100 萬 Token 上下文 主打編程、辦公及多模態能力

阿里巴巴最新發佈 Qwen 3.8-Max,官方稱其為迄今規模最大、能力最強的千問(Qwen)旗艦模型。新模型擁有 2.4 萬億參數,支援多達 100 萬 Token 的上下文窗口,並在編程、辦公、科學研究及長週期任務等場景展示更強能力,進一步擴大 Qwen 系列在企業與開發者市場的應用想像。

 

目前,全球開發者可透過阿里雲國際百煉平台 API 調用該模型,模型權重亦預計於下週公佈。用戶同時可在阿里巴巴最新推出的一站式 AI 辦公智能體平台「千問辦公」(Qwen Work)上體驗這個模型。

Qwen 3.8-Max 重點一覽

項目 內容
模型名稱 Qwen 3.8-Max
參數規模 2.4 萬億參數
上下文窗口 最多 100 萬 Token
模型類型 多模態基座模型
推理啟動參數 約 950 億參數
可用平台 阿里雲國際百煉平台、千問辦公(Qwen Work)

MoE 架構成效能關鍵

Qwen 3.8-Max 基於 Qwen 3.5,採用稀疏混合專家(MoE)架構,並結合混合注意力機制,令模型在保持超大規模的同時,仍可控制推理效率與成本。雖然總參數高達 2.4 萬億,但實際推理時僅啟動約 950 億參數,有助減低計算成本與延遲,令模型更適合面向真實應用場景。

這種設計對企業用戶尤其重要,因為大型模型若只係「夠大」但不夠快、不夠穩,實際落地價值會大打折扣。阿里巴巴今次的重點,明顯不只是展示參數規模,而是強調模型在效率與能力之間的平衡。

編程與長任務表現受關注

在官方介紹中,Qwen 3.8-Max 在 Frontend Code Arena 排名第四,並強調其擅長自主編程與長週期執行能力。阿里巴巴更指,模型在內部測試中曾自主完成一個長達 16 天的真實軟件工程項目,並從零開始構建一個可自進化的智能體框架,最後生成名為「oh-my-cli」的開源項目。

對開發者而言,這類能力的吸引力在於模型不再只懂即時問答,而是更接近能夠長時間協作、持續迭代的工作夥伴。若這些能力在實際使用中足夠穩定,對前端開發、原型搭建、程式測試與代碼整理等工作流程都可能帶來明顯效率提升。

多模態能力再加碼

除了文字與編程,Qwen 3.8-Max 亦主打多模態與視覺智能能力。官方指它可處理過百頁文件、整部電視劇集或長達 100 小時直播內容,並將資料轉化為可搜尋、可互動的知識庫,適合資料整理、內容分析與長文本理解等場景。

在創作層面,模型亦可根據圖片、文字或介面截圖,完成 Vlog 剪輯、教育動畫生成、前端網頁重建、2D 轉 3D 室內效果圖,甚至直接打造互動式遊戲。對需要同時處理文字、畫面與內容結構的應用場景,這類能力會比單一文字模型更具實際價值。

適合哪些應用場景?

  • 軟件開發與前端原型製作。
  • 辦公文件整理與長文資料分析。
  • 多模態內容創作,例如影片剪輯與教育動畫。
  • 客服、研究、法律審查及業務分析等長流程任務。

阿里巴巴今次發佈 Qwen 3.8-Max,明顯是把重點放在「大規模 + 長上下文 + 多模態 + 長任務」四個方向。相比單純追求榜單排名,這次更像是把模型定位推向更完整的生產力工具,亦反映 AI 競爭已由純聊天能力,進一步轉向真實工作場景的落地能力。

Source:阿里巴巴、Qwen 官方發佈資訊

相關文章

Page 1 of 9