技術

阿里巴巴通義千問3.8 Max定價每百萬token僅2美元——下週開放模型權重

Adrian Kessler

一個 2.4 萬億參數的 AI 模型剛剛以每百萬輸入 Token 2 美元、輸出 Token 6 美元的價格問世。它採用稀疏混合專家架構,每次只啟動 950 億個參數,其餘閒置,藉此降低每個 Token 的成本。該模型名為 Qwen 3.8 Max,出自阿里巴巴。

與頂級美國模型的定價差距相當明顯。Qwen 3.8 Max 在數項標準基準測試中交出競爭力成績:PaperBench 達 93.0,OSWorld-Verified 達 86.1,在這些特定指標上超越 Fable 5 與 GPT-5.6 Sol。其上下文窗口延伸至一百萬個 Token——大約一次提示可輸入一百萬字——足以涵蓋長篇文件分析、大型程式碼庫與延伸推理鏈。該模型亦為多模態,可接受圖片與影片搭配文字,而這個價格等級在一年前還僅屬於專屬模型。

更重要的發展或許是阿里巴巴下週的承諾。該公司表示將公開發布模型權重,意味任何擁有足夠運算基礎設施的團隊,都能在本地執行 Qwen 3.8 Max,無需 API 費用,無需將資料傳送至阿里巴巴伺服器,也無需使用協議。若這項承諾如期兌現,將首次讓自行託管者擁有 2.4 萬億參數模型。阿里巴巴也同步釋出較小的 270 億參數檢查點,供運算資源有限的組織使用。

現實的注意事項也存在。在專注文字的 Chatbot Arena 排行榜上,Qwen 3.8 Max 排名第五——落後於 Anthropic 當前的四款模型。在企業 AI 團隊最重視的編碼智能體評測 SWE-bench Pro 上,它得分 67.7,遠低於 Fable 5 的 80.0。開放權重的發布承諾在 8 月 10 日當週,但截至本文發稿,Hugging Face 或 ModelScope 上仍未出現任何權重。對於需要遵守歐盟資料駐留要求或美國出口管制規定的組織,Qwen 3.8 Max 面臨與其他中國實驗室模型相同的管轄權問題。

8 月 10 日這個公眾權重發布窗口是第一個硬性檢查點。若阿里巴巴如期交付,對於任何願意自行架設基礎設施的團隊而言,前沿 AI 推理的成本結構將大幅下降。若發布延遲或附帶限制,其 2 美元的 API 價格仍使其成為目前市面上定價最積極的前沿模型之一。

標籤: , , , , ,

討論

共有 0 則留言。