AI 風向標|阿里發布 Qwen 3.8,2.4 萬億參數開源權重大模型

阿里發布 Qwen 3.8,2.4 萬億參數開源權重大模型 ⭐️ 8.0/10

阿里巴巴宣布推出 Qwen 3.8,這是一個 2.4 萬億參數的開源權重大型語言模型,直接回應了 Moonshot AI 最近發布的 Kimi K3(2.8 萬億參數)。該模型預計很快將在 Hugging Face 上發布,但尚未提供具體日期或基準測試結果。 這一公告加劇了開源權重大模型領域的競爭,尤其是中國 AI 實驗室之間的競爭,並標誌著開放發布超大模型的趨勢。用戶和開發者將受益於更多選擇和可能更低的成本,但缺乏基準測試結果引發了對其實際性能的疑問。 Qwen 3.8 擁有 2.4 萬億參數,略低於 Kimi K3 的 2.8 萬億參數,但兩者都是有史以來宣布的最大開源權重模型之一。目前尚未公布任何基準測試結果或發布日期,部分用戶反映訪問 Qwen 雲服務存在睏難。

hackernews · nh43215rgb · 7月19日 08:44 · 社群討論

背景: 大型語言模型(LLM)是在海量文本數據上訓練的人工智能係統,用於生成類似人類的文本。參數是編碼知識和推理的學習權重;參數越多通常表示能力越強,但計算成本也越高。開源權重模型公開發布這些訓練好的參數,供研究人員和開發者本地運行或通過 API 使用。阿里巴巴的 Qwen 係列和 Moonshot AI 的 Kimi 係列是競爭全球市場的知名中國 LLM 家族。

參考連結

社群討論: 社群反應不一:一些用戶歡迎競爭並期待更好的模型,而另一些用戶批評 Qwen 之前的版本在軟體工程方面不如 DeepSeek 可用。還有人猜測阿里巴巴是提前計划發布還是對 Kimi K3 做出反應。總體而言,討論反映了對模型質量的高度興趣和懷疑。

標籤: #LLM, #open-weights, #Alibaba, #Qwen, #AI competition