Kimi K3 今晚開源權重:2.8 兆參數全球最大開源模型登場 蒸餾指控能否被釐清?

Author:

Published:

- 廣告 -

Moonshot AI(月之暗面)的最新旗艦模型 Kimi K3 早前推出,它的高效能被視為 DeepSeek 之後中國 AI 又一突破。但與此同時該模型又被質疑是蒸餾西方的前沿 AI 模型。Moonshot AI 將於今晚(香港時間 7 月 27 日晚上 11 時)在 Hugging Face 正式釋出完整開源權重。這是全球首個「3 兆參數級」開源模型的權重釋出,大家不單關注開源模型能否追上前沿閉源模型,更想看看能否因而釐清蒸餾指控。

表現突出基測測試名列前茅

Moonshot AI 於 7 月 16 日正式推出Kimi K3 模型,用戶可以透過 Kimi.com、手機 App、Kimi Work、Kimi Code,以及官方 API 使用這個參數量約 2.8 兆的模型。該模型採用 Sparse Mixture-of-Experts(896 個專家,每次僅激活 16 個),並引入 Kimi Delta Attention(KDA) 與 Attention Residuals 新架構,官方聲稱相比上一代 K2 整體擴展效率提升約 2.5 倍,長上下文解碼速度最高可達 6.3 倍。

模型原生支援 100 萬 token 上下文窗口,以及文字、圖像、影片輸入,特別強化長時程(long-horizon)編程、agentic 工作流(工具調用、瀏覽、多步規劃)與知識工作。

- 廣告 -

Kimi K3 在多項基準測試中表現突出,在 Arena.ai Frontend Code Arena 以 1,679 分奪得第一,超越 Claude Fable 5 與 GPT-5.6 Sol。而在 Artificial Analysis Intelligence Index v4.1 得 57 分,位列全球前三/四名,僅次於 Claude Fable 5 與 GPT-5.6 Sol,並領先 Claude Opus 4.8 等多款模型。

Kimi K3 在 Arena.ai Frontend Code Arena 以 1,679 分奪得第一。
Kimi K3 在 Arena.ai Frontend Code Arena 以 1,679 分奪得第一。
Kimi K3 在 Artificial Analysis Intelligence Index v4.1 僅落後於 Anthropic Opus 5、Fable 5 和 GPT-5.6 Sol 名列第四。
Kimi K3 在 Artificial Analysis Intelligence Index v4.1 僅落後於 Anthropic Opus 5、Fable 5 和 GPT-5.6 Sol 名列第四。

由於模型在上線後需求極高,Moonshot 曾一度暫停新訂閱以應對算力壓力。

3T 級開源容量估計數以百 GB

社群與業界反應相當兩極。開發者與研究者普遍對其「前沿級開源」潛力感到興奮,認為這是繼 DeepSeek 之後又一次打破「開源落後閉源」既有印象的事件。Elon Musk 也曾以「Impressive」回應相關榜單。前端編碼與 agent 相關測試尤其獲得正面評價,有人戲稱其表現接近「Kable」(Kimi + Fable)。

同時,硬體門檻也成為討論焦點——完整權重下載體積龐大(量化後仍約數百 GB),正式部署往往需要多卡甚至數十張高階 GPU,並非一般個人電腦可輕易運行。社區預期量化版本(如 GGUF)與託管服務(Together AI、Modal 等)將迅速跟進。

被指控蒸餾美國模型

不過,Kimi K3 的高表現也迅速引發「是否蒸餾自美國模型」的爭議。早在今年 2 月,Anthropic 就公開指控 Moonshot AI 在內的中國 AI 企業進行工業級蒸餾,指透過約 2.4 萬個虛假帳戶產生超過 1,600 萬次與 Claude 的交互,其中 Moonshot 約佔 340 萬次,聚焦 agentic reasoning、coding 與 computer-use 等能力。

最惹人關注的是在 Kimi K3 推出不久,即有社群流出截圖,指 K3 在對話中自我識別為 Claude,這被認為是 Kimi K3 是蒸餾自 Anthropic Claude 的證據。有關的指控早在 K2.5 時已經傳出,有用戶在經過一段長時間對話後,詢問這個模型的名字和規格,結果它回答說它「是 Claude」。今次 K3 又被指「露出馬腳」。

- 廣告 -
網上社區流傳的截圖,指 Kimi K3 在交談中回答說它「是 Claude」。
網上社區流傳的截圖,指 Kimi K3 在交談中回答說它「是 Claude」。
在 Kimi K2.5 時亦有類似指控。
在 Kimi K2.5 時亦有類似指控。

7 月 22 日,白宮科技政策辦公室主任 Michael Kratsios 進一步點名,指有資訊顯示 Moonshot 為開發 K3 而蒸餾 Anthropic 的 Fable 模型,並建立精密內部平台以快速切換存取方式避開偵測。

對此,Moonshot 方面否認純蒸餾說法,強調表現提升來自自身架構創新。而多位獨立研究者則認為單純蒸餾的話在時間上未必做得到——Fable 5 7 月 1 日才全球公開,K3 7 月 16 日即上線,單純蒸餾難以在短短兩週內達到此規模與強度,更可能需要大規模強化學習與自身訓練數據支撐。

開源權重能否澄清指控?

Kimi K3 今晚開源權重,讓全球研究者、企業與開發者能真正下載、檢查、部署與微調一個接近前沿的 2.8T 級模型,打破目前多數頂級模型完全閉源的格局,也讓中國開源陣營再次將「開放」作為競爭策略。

研究者可檢查架構細節、參數分布、行為指紋、潛在 watermark,以及與已知 Claude/Fable 系列的相似程度,亦可以進行獨立基準測試與逆向分析,這有助驗證官方聲稱的架構創新是否真實存在。

然而,訓練數據、完整訓練過程與中間檢查點通常不會一併公開,因此無法徹底排除「曾使用蒸餾數據作為部分訓練素材」的可能性。開源主要增加透明度與可驗證性,但不能自動證明無罪。

無論最終 Kimi K3 被證明是純創新、部分蒸餾,或兩者兼具,它都已將「開源能否追上閉源前沿」這個問題,推到了新的高度。業界與研究社群的下一步檢驗,才剛剛開始。

- 廣告 -
Buy Me a CPM: PCM 讀者會員資助計劃
- 廣告 -

Related Articles

- 廣告 -

Recent Articles

- 廣告 -

最新影片

- 廣告 -