中國 AI 新創月之暗面(Moonshot AI)再度震撼全球開源社群!據 Hugging Face 執行長 Clement Delangue 於 X 平台發文宣布,Moonshot AI 最新開源的 2.8 兆參數多模態模型「Kimi K3」已正式上線,短短 30 分鐘內狂攬逾 4,000 個讚,空降熱門榜第一名,創下該平台史上最快的成長紀錄。
(前情提要:美英官方報告:中國 Kimi K3 安全攻防能力「明顯落後」美國頂尖 AI 模型)
(背景補充:自託管 AI 模型更省錢?Cline 實測 Kimi K3 成本優勢,網反駁:按任務算比 Fable 5 貴)
本文目錄
Toggle
全球首個 3T 級開源模型,具備百萬上下文
專攻長時程編程與推理,基準測試比肩前沿模型
靈活部署,採專屬 Kimi K3 商業授權
在人工智慧(AI)算力與模型效能競爭白熱化之際,開源社群迎來了重量級的生力軍。台北時間 7 月 27 日,全球最大開源 AI 社群平台 Hugging Face 的共同創辦人暨執行長 Clement Delangue 於 X(前 Twitter)發文報喜,宣布月之暗面(Moonshot AI)的全新模型「Kimi K3」已正式登陸該平台。
Kimi K3 has been released on HF and already top 1 trending with 4,000+ likes in 30 mins. Fastest release growth ever so far!! pic.twitter.com/2lnbbgXwGD
— clem 🤗 (@ClementDelangue) July 27, 2026
全球首個 3T 級開源模型,具備百萬上下文
根據 Hugging Face 上的官方頁面資訊,Kimi K3 是 Moonshot AI 迄今為止最強大的開源權重(open-weight)原生多模態代理模型。其總參數高達 2.8 兆(2.8T),被業界譽為全球首個達到 3T 級別的開源模型。
目前,該模型的完整程式碼與權重已透過自訂的「Kimi K3 License」釋出,允許開發者進行研究、微調與二次開發。不過,官方也明文規定,若為年收入超過 2,000 萬美元的模型 API 服務商欲進行商業使用,則必須與月之暗面另行簽署商業協議。隨著 Kimi K3 的爆紅,全球 AI 領域預期將掀起新一波基於該模型的創新應用浪潮。
月之暗面正式開源「Kimi K3」!超強編程能力半小時登上 Hugging Face 第一
中國 AI 新創月之暗面(Moonshot AI)再度震撼全球開源社群!據 Hugging Face 執行長 Clement Delangue 於 X 平台發文宣布,Moonshot AI 最新開源的 2.8 兆參數多模態模型「Kimi K3」已正式上線,短短 30 分鐘內狂攬逾 4,000 個讚,空降熱門榜第一名,創下該平台史上最快的成長紀錄。
(前情提要:美英官方報告:中國 Kimi K3 安全攻防能力「明顯落後」美國頂尖 AI 模型)
(背景補充:自託管 AI 模型更省錢?Cline 實測 Kimi K3 成本優勢,網反駁:按任務算比 Fable 5 貴)
本文目錄
Toggle
在人工智慧(AI)算力與模型效能競爭白熱化之際,開源社群迎來了重量級的生力軍。台北時間 7 月 27 日,全球最大開源 AI 社群平台 Hugging Face 的共同創辦人暨執行長 Clement Delangue 於 X(前 Twitter)發文報喜,宣布月之暗面(Moonshot AI)的全新模型「Kimi K3」已正式登陸該平台。
令人驚豔的是,Kimi K3 上線僅短短 30 分鐘,便迅速吸引超過 4,000 次按讚,直接霸佔 Hugging Face「熱門(Trending)」排行榜第一名。Delangue 驚呼,這是該平台有史以來發布後成長最快的一次。
全球首個 3T 級開源模型,具備百萬上下文
根據 Hugging Face 上的官方頁面資訊,Kimi K3 是 Moonshot AI 迄今為止最強大的開源權重(open-weight)原生多模態代理模型。其總參數高達 2.8 兆(2.8T),被業界譽為全球首個達到 3T 級別的開源模型。
在技術架構上,Kimi K3 採用了全新的 Kimi Delta Attention(KDA)與 Attention Residuals 架構,並透過 Stable LatentMoE 框架大幅提升擴展效率。模型在 896 個專家網路中每次僅激活 16 個,使實際激活參數控制在 1040 億(104B),相較於前代 Kimi K2,其整體擴展效率提升了約 2.5 倍。此外,它更原生支援高達 100 萬 token 的超大上下文視窗,能輕鬆同時處理文字與圖像輸入。
專攻長時程編程與推理,基準測試比肩前沿模型
作為專為前沿智能設計的模型,Kimi K3 特別擅長知識工作、複雜推理以及長時程編程(Long-horizon coding)。官方技術部落格指出,該模型能在最少的人工監督下,自主瀏覽大型程式庫並執行 GPU kernel 優化、編譯器開發,甚至是高難度的晶片設計等任務。
在各項嚴苛的基準測試中,啟用最大思考(thinking)模式的 Kimi K3 表現亮眼。它不僅在 GPQA Diamond 取得 93.5 分、Terminal-Bench 2.1 取得 88.3 分的優異成績,其綜合代理式任務與視覺能力,更已具備與 Claude Fable 5、GPT-5.6 Sol 等頂尖閉源模型一較高下的堅強實力。
靈活部署,採專屬 Kimi K3 商業授權
為了提升硬體相容性與運行效率,Kimi K3 從監督式微調(SFT)階段便導入原生的 MXFP4 量化感知訓練,並且能無縫支援 vLLM、SGLang 等主流開源推理框架,讓開發者下載權重後即可直接部署。
目前,該模型的完整程式碼與權重已透過自訂的「Kimi K3 License」釋出,允許開發者進行研究、微調與二次開發。不過,官方也明文規定,若為年收入超過 2,000 萬美元的模型 API 服務商欲進行商業使用,則必須與月之暗面另行簽署商業協議。隨著 Kimi K3 的爆紅,全球 AI 領域預期將掀起新一波基於該模型的創新應用浪潮。