Qwen2.5-Max:阿里巴巴發表全新AI,挑戰人工智慧巨頭

最後更新: 16月2026
  • Qwen2.5-Max 在不同的基準測試中表現優於 DeepSeek V3 以及 GPT-4o 和 Llama-3.1-405B 等其他模型。
  • 該模型採用混合專家(MoE)技術來優化效能並降低計算成本。
  • 它可透過 Qwen Chat 免費供用戶使用,具有圖像分析和內容生成等高級功能。
  • 此次發布強化了阿里巴巴將自己定位為全球人工智慧領導者的策略。

Qwen2.5-Max AI模型展示

中國科技巨頭阿里巴巴在競爭激烈的人工智慧領域邁出了重要一步,推出了迄今為止最先進的人工智慧模型: Qwen2.5-Max。該模型旨在超越其主要競爭對手,承諾在特定任務和關鍵基準測試中均表現出色,鞏固了阿里巴巴在人工智慧領域的重要地位。

由阿里雲雲端運算部門開發的Qwen2.5-Max採用了一種名為混合專家(Mixture of Experts,MoE)的先進架構。這種方法可以將模型劃分為多個專門的子網,或稱為“專家”,並根據所需任務選擇性地激活這些專家。因此,運算資源得以最佳化,效率得以提升,這對於如此大規模的模型至關重要。

Qwen2.5-Max 的亮點

該模型已使用超過 20 兆個 token 的大量資料進行預訓練。此外,它還利用監督式微調 (SFT) 和人類反饋強化學習 (HFRL) 等先進技術進行了最佳化。這使其在以下測試中取得了卓越的準確率:

  • 莫里森大學: Qwen2.5-Max 的得分為 87,9%,超過了 DeepSeek V3(87,1%)和 Llama 3.1(85,2%),成為最嚴格的常識評估之一。
  • BBH: 在這項旨在衡量複雜推理的測試中,它的得分為 89,3%,高於 DeepSeek V87,5 的 3%。
  • 數學: 在奧林匹克級的數學競賽中,它的得分為 68,5%,超過了 DeepSeek V3(61,6%)和 Llama 3.1(53,8%)。
  人工智慧程式設計助理完整指南

Qwen2.5-Max與其他型號的比較

可訪問性和創新功能

Qwen2.5-Max 最吸引人的特點之一是它同時向企業用戶和個人用戶開放。阿里巴巴透過其Qwen Chat 聊天機器人提供免費存取該型號的服務,用戶可以利用其豐富的功能,包括:

  • 進階分析: 能夠處理文字、圖像和文檔,從而可以從發票、圖形或影片中提取複雜的資訊。
  • 內容生成: 創作圖像、影片和數位工件。
  • 網絡搜索: 與導航工具整合以提供更加情境化的答案。

該聊天機器人還提供選擇不同模型版本的功能,從而可以根據用戶的需求自訂體驗。甚至可以同時使用兩個模型進行即時比較。

Qwen聊天介面

人工智慧市場的競爭

Qwen2.5-Max 的發布正值人工智慧產業蓬勃發展之際。 DeepSeek V3 、GPT-4o 和 Claude 3.5 Sonnet 等模式近期備受關注,它們各自在特定領域取得了顯著進步。然而,根據阿里巴巴揭露的內部測試結果,Qwen2.5-Max 不僅能夠與它們相媲美,而且在多項指標上超越了它們。

阿里巴巴也考慮了其模式的可負擔性。儘管DeepSeek因其對某些主題的審查以及運行的高技術要求而備受詬病,但Qwen2.5-Max的目標是更加包容。此外,作為一個開源模式,它也可供有興趣根據自身需求進行客製化的開發者使用。

Qwen2.5-Max 的 MoE 架構

行業影響

Qwen2.5-Max 模型不僅代表技術上的進步,也對其他人工智慧公司構成了策略挑戰。隨著阿里巴巴將其雲端服務價格下調高達 97%,預計競爭將更加激烈。此舉不僅旨在吸引用戶,更意在鞏固其在人工智慧解決方案領域的領導地位。

  如何免費使用人工智慧製作影片:完整指南

從該模式中受益最大的行業包括教育、程式設計、金融和數據分析。例如,它的數學精確性和邏輯推理能力使其成為教學的理想選擇,而它的程式設計能力可以加速科技公司的開發進程。

Qwen2.5-Max 應用程式

隨著Qwen2.5-Max的發布,阿里巴巴展現了其在競爭激烈的行業中強大的創新能力。這款產品不僅挑戰了OpenAI和Meta等產業巨頭,也為人工智慧的應用開闢了新的可能性,標誌著該產業的一個轉捩點。

Qwen-VLo-0
相關文章:
Qwen-VLo:阿里巴巴用於創建和編輯圖像的全新 AI 模型。