0
0

Kimi K3爆紅到要停收客 月之暗面上市故事反而更好講?

內地人工智能獨角獸月之暗面(Moonshot AI)推出新一代模型Kimi K3,短短幾日就出現一個頗戲劇性的情況:不是沒有人用,而是太多人用,令公司算力頂不住,要暫停接受C端新用戶訂閱。

表面看,停收新客似乎是壞消息;但從資本市場角度拆局,這件事其實同時反映了兩件事:

第一,Kimi K3的確有市場需求;第二,月之暗面仍然是一間需要大量資金擴充基建的初創公司。

而這兩點,正好是它赴港上市故事的「賣點」和「風險」。

Kimi K3究竟強在哪裏?

先用最簡單的方法理解。

普通AI模型,好像一間公司只有一個大型部門,無論你問寫程式、做研究還是分析文件,所有員工都要一齊開工。

Kimi K3採用的是「混合專家模型」,即Mixture of Experts,簡稱MoE。

它好像有896個不同範疇的專家,但每次回答問題,只叫最適合的16個專家出來工作,其餘專家休息。換言之,不需要每一次都動用整個模型,希望做到「大腦很大,但每次不用全開」。

月之暗面公布,Kimi K3共有2.8萬億個參數、100萬Token上下文,定位是處理長時間程式開發、複雜知識工作和深度推理。公司稱它是目前規模最大的開放權重模型。(Moonshot AI)

參數可以簡單理解為模型腦內用來辨認規律的「調校旋鈕」。參數越多,不代表一定越聰明,但一般代表模型容量較大,可以吸收和處理更多複雜模式。

Kimi K3特別受關注,是因為它不單參數大,在程式編寫和智能體任務上的表現亦相當突出,部分測試成績已接近或超越美國部分前沿模型。市場因此再次出現類似DeepSeek推出時的震撼:中國AI公司即使面對高階晶片限制,模型能力仍然在追近美國。(Reuters)

為何用了MoE,仍然算力頂不住?

很多人可能會問:既然每次只啟動16個專家,理論上不是很省算力嗎?為何仍然要停收新客?

答案是:省算力,不等於不用算力。

首先,Kimi K3整個模型仍然有2.8萬億個參數。即使每次推理只啟動其中一小部分,整套模型的權重仍要放在伺服器的高速記憶體內,否則需要用到某個專家時,就無法即時調用。

所以,Kimi K3的真正瓶頸,不一定只是GPU有多少計算核心,更可能是有沒有足夠高速記憶體,以及不同晶片之間能否快速傳輸數據。

這好比一間超大型圖書館,讀者每次只借16本書,並不代表圖書館只需要收藏16本書。其餘幾百萬本書仍然要放在書架上,而且要確保管理員可以立即找到。

因此,市場開始明白,AI競賽下一階段不只是「誰有最多GPU」,而是「誰有最多高速記憶體、最大頻寬,以及最成熟的數據中心系統」。

Kimi K3推出後,用戶請求量迅速超出預期,逼近現有集群承載極限。月之暗面其後暫停新用戶訂閱,將可用算力優先供應現有付費用戶,並加快擴充基建。(Reuters)

停收新客,是利好還是利淡?

要分兩層看。

好的一面:證明產品有人要

對一間準備上市的科技公司來說,最怕不是系統繁忙,而是產品推出後沒有人理會。

Kimi K3推出後因需求太大而暫停訂閱,至少證明市場對產品有興趣,而且部分用戶願意付費。這種「供不應求」現象,可以成為月之暗面向投資者展示產品競爭力的證據。

資本市場最喜歡聽的故事是:公司不是找不到客,而是暫時沒有足夠產能服務所有客。

這比「燒了很多錢,但沒有用戶」好得多。

不好的一面:證明收入受制於硬件

不過,停收新客亦暴露出月之暗面的商業模式仍有明顯限制。

一般互聯網平台,多一個用戶的邊際成本很低。例如社交平台多一個人瀏覽,額外成本有限。

但生成式AI不同。用戶問得越多、模型思考得越久,公司支付的GPU、記憶體、電力和數據中心成本就越高。

換句話說,Kimi不是「用戶越多,純利自然越高」,而可能是「用戶越多,先要投入更多資本」。

值得注意是這些發布正值中國國家主席 習近平 積極推動中國 AI 向全球南方(發展中國家)擴展之際,希望藉此讓中國主導的人工智慧技術深入更多國家。

OpenAI 資深主管 Dean Ball 在社群平台 X 上表示,中國採取免費開放 AI 程式碼的策略,很可能導致「全面 AI 共產主義(full AI communism)」,並稱「這正是中國所倡導的模式」。 

作者:顏寶剛|前有線新聞助理總監兼有線財經台台長(授權轉載|原文鏈結


更多人工智能相關報導

美股|Google一周內連失兩名AI大將 人工智能人才競逐白熱化

與蘋果合作關係轉趨緊張 傳OpenAI研究法律行動可能性

AI史上最狂|Anthropic擬以逾 9000 億美元估值融資

發佈回覆