Moonshot 發布 2.8 兆參數巨獸 Kimi K3
採用原生多模態 MoE 架構,支援 100 萬字元上下文,規格超越目前所有開源模型。
MoE 架構效能提升 2.5 倍
擁有 896 個專家,每 Token 僅激活 16 個,顯著提升擴展效率並優化長程推理與代碼能力。
編碼基準測試超越頂尖封閉模型
在前端代碼 Arena 排名第一,領先 GPT-5.6 Soul,但 Moonshot 坦言在綜合人文測試中仍落後約 10 分。
高幻覺率與冗餘輸出問題
第三方測試顯示 K3 幻覺率高達 51%,且傾向輸出過多無效 Token,可能導致實際使用成本增加。
地緣政治引發的中美開源角力
中國轉向支持開源以換取影響力,而美國矽谷則因恐懼競爭轉向推動管制,美政府甚至考慮禁用中國模型。
阿里巴巴發布 Qwen 3.8 加入戰局
隨即推出 2.4 兆參數開源模型,顯示中國廠商正透過開源模型加速推動全球 AI 軍備競賽。
觀眾怎麼看
整理 40 則有效留言信心 高觀眾高度關注 Kimi K3 的競爭影響,並質疑美國以安全為由限制開源模型的商業動機。
多數觀眾認為美國政府推動限制開源模型,是為了保護本土科技巨頭的壟斷利益,而非出於安全考量。
觀眾指出 K3 採用 MXFP4 精準度訓練,大幅降低了部署所需的 VRAM 需求,提升了企業自建的可行性。
留言指出 K3 的 51% 幻覺率在同類模型中表現相對較佳,優於 Fable 5 與 GPT-5.6 的數據。
有觀眾對 Kimi K3 是否真正實現完全開源表示懷疑,並詢問目前的獲取權限與實際應用限制。
部分觀眾認為 K3 僅是透過知識蒸餾複製現有模型,缺乏創新且效能並未超越現有頂尖模型。
留言樣本多集中於地緣政治與商業競爭,技術細節討論較少且缺乏官方驗證。