阿里巴巴釋出 Qwen 3.8-Max:2.4 萬億引數 AI 模型主攻程式設計與研究
阿里巴巴推出迄今"最強" AI 模型 Qwen 3.8-Max,擁有 2.4 萬億引數,重點最佳化程式設計和長文本研究任務。該模型將於下週開源權重版本,支援百萬 token 上下文視窗,可處理約 75 萬詞查詢。阿里稱其效能與 Anthropic Claude 3.5 Sonnet 相當或更優,釋出後港股股價單日上漲 7%。

阿里放大招!2.4萬億引數AI"巨無霸"來了,專治程式設計和長文本
阿里這周搞了個大新聞,祭出史上最強AI模型Qwen 3.8-Max,引數直接飆到2.4萬億!中美AI競賽這下更有看頭了~
硬核引數+開源福利
阿里在X上官宣:這貨是"程式設計和協作的新標杆",下週就開源!開源權重意味著開發者可以下載模型引數自己魔改,對企業搞定製化簡直不要太香。
目前引數規模僅次於月之暗面的Kimi K3(2.8萬億)。懂行的都知道,引數越多模型越能打。
效能直接叫板Claude 3.5
阿里內部測試顯示,Qwen 3.8-Max完全不虛Anthropic的Claude 3.5 Sonnet。作為Qwen 3.5的升級版,專門為長週期任務(比如搞科研、擼程式碼)做了最佳化。
官方說法是:"不僅能搞定高難度問題,還能一條龍完成複雜任務,交付靠譜成果。"
三大殺手鐧:
- 百萬級token上下文視窗,單次能處理約75萬詞(業內標準1token≈0.75個英文單詞)
- 專治各種不服:晶片設計連肝12小時、蛋白源驗證、財務即時對賬、合同自動生成
- 玩轉視覺生產:把隨手拍的素材剪成vlog、平面圖秒變3D效果圖、幾句話就能生成小遊戲
資本市場用腳投票
CNBC報道,Qwen 3.8-Max釋出當天,阿里港股暴漲7%,投資者真金白銀投了贊成票。
國內AI大模型賽道現在卷瘋了:阿里Qwen、百度文心、月之暗面Kimi、智譜GLM都在拼命堆引數、搶場景。這次阿里承諾開源,說不定能帶火國內開源生態,讓中小企業和科研狗也能上車。
開發者必看指南
國內搞AI的兄弟們注意了,這個開源權重值得蹲:
- 商用條款:看清楚能不能商用和二次訓練
- 推理成本:2.4萬億引數得多卡伺候,私有化部署得掂量下錢包
- 長文本神器:百萬token視窗簡直是法律文書、科研論文、大程式碼庫的剋星
阿里宣傳片裡"釣魚遛狗時AI自動搞定晶片設計"的橋段雖然有點畫餅,但確實反映了大模型正在從"問答機"進化成"打工人"的行業趨勢。
常見問題
Qwen 3.8-Max 的 2.4 萬億引數意味著什麼?
引數是 AI 模型內部的可調變數,決定模型的表達能力。2.4 萬億引數使其理論上能處理更復雜的邏輯推理和長文本任務,但實際效能還取決於訓練資料質量、架構設計等因素。目前國內僅次於月之暗面 Kimi K3 的 2.8 萬億引數。
開源權重版本對開發者有什麼價值?
開源權重允許下載模型引數並修改,開發者可私有化部署、針對特定行業微調或進行學術研究。但需注意:阿里尚未公佈具體開源協議,商用許可、是否允許二次訓練等細節需等下週釋出時確認。
百萬 token 上下文視窗實際能處理多長的文件?
根據阿里官方資料,100 萬 token 可處理約 75 萬詞。以中文為例,通常 1 個 token 對應 1-2 個漢字,因此可能支援 50-75 萬漢字的單次輸入,適合處理長篇學術論文、完整程式碼庫或多輪複雜對話。
普通開發者能否直接使用 Qwen 3.8-Max?
阿里通常會提供 API 呼叫服務(可能收費)和開源權重下載兩種方式。API 呼叫門檻低但按量計費;自行部署開源版本需要多張高效能 GPU(如 A100/H100),個人開發者可考慮使用量化版本或等待社群最佳化的輕量版。
Qwen 3.8-Max 與 Claude 3.5 Sonnet 對比如何?
阿里聲稱內部測試中效能相當或更優,但未公佈具體 benchmark 資料。建議關注獨立第三方評測(如 OpenCompass、SuperCLUE)的結果,尤其是中文任務、程式碼生成、長文本理解等維度的對比。
本文基於 GNews:ThePrint 報道, 由 AiDuo123 AI 編輯翻譯改寫。原文連結: https://theprint.in/feature/alibaba-most-capable-ai-model-for-coding-and-research/3004513/
相关 AI 工具
文中提到或相关的 AI 工具 — 点进去看适合谁、怎么用、值不值得折腾
Midjourney
精选AI 绘图
頂級 AI 影像生成工具,以畫面質感、藝術風格、構圖理解著稱。V7 模型在寫實和創意兩個方向均領先。需 Discord 或網頁版使用。
Cursor
精选AI 开发工具
AI-first 程式碼編輯器,基於 VS Code 構建,深度整合 Claude / GPT-4o 等模型。Composer 多檔案編輯、Tab 自動補全、Agent 模式三大殺手鐧。
Claude
精选大模型应用
Anthropic 推出的 AI 助手,以長上下文(200K tokens)、對複雜任務的細膩理解、Artifacts 視覺化輸出聞名。Claude Sonnet 4.5 / Opus 4.7 在程式設計、寫作、推理多項基準上領先。
相关推荐
同类资讯 — 由发布时间排序

美國父母藉助 ChatGPT 協助診斷女兒罕見病:AI 醫療應用的真實案例
一位生物技術行業從業者母親在醫生未能確診女兒反覆生病原因時,將孩子的症狀和實驗室檢測資料輸入 ChatGPT,AI 在數秒內給出可能的免疫缺陷診斷方向。這一案例折射出 AI 聊天機器人在醫療諮詢中的快速普及——美國四分之一人口已用其診斷症狀,但專家強調需謹慎使用並注意隱私與準確性風險。

Windows 11 最新更新破壞 WSL 與 Claude Cowork 功能
微軟確認 Windows 11 九月安全更新 KB5124008 導致基於 Hyper-V 的 Linux 虛擬機器中 Plan9 主機資料夾共享失效,直接影響 WSL 和 Claude Cowork 無法讀取共享資料夾,應用可能顯示"未掛載 Plan9 驅動器共享"錯誤。微軟已將其列為已知問題並正在修復,但暫無補丁或臨時解決方案。

Anthropic工程師警告AI或致人類滅絕 為何仍加速開發
Anthropic研究員Jacob Coxon因擔憂遞迴自我改進AI系統的風險而辭職,該公司安全主管隨後表示確信AI可能導致人類滅絕機率超10%。儘管以安全為使命,Anthropic仍在推進自主智慧體開發並籌備估值2萬億美元IPO,其"謹慎推進反而更危險"的邏輯引發爭議。

Meta 因 AI 訓練資料與人臉識別系統遭集體訴訟
美國伊利諾州和加州的多名使用者向 Meta 提起集體訴訟,指控其未經同意使用 Facebook 和 Instagram 照片訓練未釋出的人臉識別系統 NameTag 及生成式 AI 模型 Emu 和 Muse Image,違反州生物識別隱私法。訴訟索賠金額可能達數十億美元,這是 Meta 繼 2020 年和 2024 年生物識別資料和解案後再次面臨重大隱私訴訟。