- Qwen2.5-Max 在不同的基準測試中表現優於 DeepSeek V3 以及 GPT-4o 和 Llama-3.1-405B 等其他模型。
- 該模型採用混合專家(MoE)技術來優化效能並降低計算成本。
- 它可透過 Qwen Chat 免費供用戶使用,具有圖像分析和內容生成等高級功能。
- 此次發布強化了阿里巴巴將自己定位為全球人工智慧領導者的策略。

中國科技巨頭阿里巴巴在競爭激烈的人工智慧領域邁出了重要一步,推出了迄今為止最先進的人工智慧模型: Qwen2.5-Max。該模型旨在超越其主要競爭對手,承諾在特定任務和關鍵基準測試中均表現出色,鞏固了阿里巴巴在人工智慧領域的重要地位。
由阿里雲雲端運算部門開發的Qwen2.5-Max採用了一種名為混合專家(Mixture of Experts,MoE)的先進架構。這種方法可以將模型劃分為多個專門的子網,或稱為“專家”,並根據所需任務選擇性地激活這些專家。因此,運算資源得以最佳化,效率得以提升,這對於如此大規模的模型至關重要。
Qwen2.5-Max 的亮點
該模型已使用超過 20 兆個 token 的大量資料進行預訓練。此外,它還利用監督式微調 (SFT) 和人類反饋強化學習 (HFRL) 等先進技術進行了最佳化。這使其在以下測試中取得了卓越的準確率:
- 莫里森大學: Qwen2.5-Max 的得分為 87,9%,超過了 DeepSeek V3(87,1%)和 Llama 3.1(85,2%),成為最嚴格的常識評估之一。
- BBH: 在這項旨在衡量複雜推理的測試中,它的得分為 89,3%,高於 DeepSeek V87,5 的 3%。
- 數學: 在奧林匹克級的數學競賽中,它的得分為 68,5%,超過了 DeepSeek V3(61,6%)和 Llama 3.1(53,8%)。

可訪問性和創新功能
Qwen2.5-Max 最吸引人的特點之一是它同時向企業用戶和個人用戶開放。阿里巴巴透過其Qwen Chat 聊天機器人提供免費存取該型號的服務,用戶可以利用其豐富的功能,包括:
- 進階分析: 能夠處理文字、圖像和文檔,從而可以從發票、圖形或影片中提取複雜的資訊。
- 內容生成: 創作圖像、影片和數位工件。
- 網絡搜索: 與導航工具整合以提供更加情境化的答案。
該聊天機器人還提供選擇不同模型版本的功能,從而可以根據用戶的需求自訂體驗。甚至可以同時使用兩個模型進行即時比較。

人工智慧市場的競爭
Qwen2.5-Max 的發布正值人工智慧產業蓬勃發展之際。 DeepSeek V3 、GPT-4o 和 Claude 3.5 Sonnet 等模式近期備受關注,它們各自在特定領域取得了顯著進步。然而,根據阿里巴巴揭露的內部測試結果,Qwen2.5-Max 不僅能夠與它們相媲美,而且在多項指標上超越了它們。
阿里巴巴也考慮了其模式的可負擔性。儘管DeepSeek因其對某些主題的審查以及運行的高技術要求而備受詬病,但Qwen2.5-Max的目標是更加包容。此外,作為一個開源模式,它也可供有興趣根據自身需求進行客製化的開發者使用。

行業影響
Qwen2.5-Max 模型不僅代表技術上的進步,也對其他人工智慧公司構成了策略挑戰。隨著阿里巴巴將其雲端服務價格下調高達 97%,預計競爭將更加激烈。此舉不僅旨在吸引用戶,更意在鞏固其在人工智慧解決方案領域的領導地位。
從該模式中受益最大的行業包括教育、程式設計、金融和數據分析。例如,它的數學精確性和邏輯推理能力使其成為教學的理想選擇,而它的程式設計能力可以加速科技公司的開發進程。

隨著Qwen2.5-Max的發布,阿里巴巴展現了其在競爭激烈的行業中強大的創新能力。這款產品不僅挑戰了OpenAI和Meta等產業巨頭,也為人工智慧的應用開闢了新的可能性,標誌著該產業的一個轉捩點。