開(kāi)源大模型從未如此接近全球頂尖水平——但也從未以如此戲劇性的方式,證明算力需求遠(yuǎn)未到頂。
7月17日,月之暗面發(fā)布新一代旗艦?zāi)P蚄imi K3。在權(quán)威的Text Arena綜合排行榜中,該模型以1486分位列第9名,成為首個(gè)進(jìn)入全球前十的開(kāi)源模型。
更引人注目的是,在Fronted Code Arena榜單中,Kimi K3以1679分超越Anthropic的Claude Fable 5登頂?shù)谝唬岸舜a7個(gè)細(xì)分方向中的6個(gè)排名首位。
然而,K3發(fā)布后48小時(shí)內(nèi),因用戶請(qǐng)求量大幅超出預(yù)估并逼近集群承載極限,月之暗面不得不在7月19日宣布暫停C端新用戶訂閱——一款開(kāi)源模型的發(fā)布,竟以「算力不足」收?qǐng)觥?/strong>
這種看似矛盾的現(xiàn)象,恰恰揭示了當(dāng)前AI行業(yè)最核心的爭(zhēng)論:更高效的模型,究竟是削減還是放大硬件需求?
從第38名到第9名:開(kāi)源首次撕開(kāi)前十防線
Kimi K3的排名躍升幅度極為顯著。上一代Kimi K2.6在Text Arena僅排第38位,K3一舉躍升至第9名。
招商證券策略研究在最新周報(bào)中指出,此前開(kāi)源模型中排名最高的通義千問(wèn)3.7-max-preview位列第18,K3的出現(xiàn)標(biāo)志著開(kāi)源模型首次在綜合文本評(píng)測(cè)中與全球頂級(jí)閉源模型進(jìn)入同一梯隊(duì)。
分項(xiàng)來(lái)看,K3在創(chuàng)意寫作、代碼生成和指令遵循三個(gè)核心類別均進(jìn)入前十,在物理與社會(huì)科學(xué)、法律與政府、醫(yī)療健康等專業(yè)領(lǐng)域排名第一,商業(yè)管理與金融運(yùn)營(yíng)排名第三。
技術(shù)層面,K3總參數(shù)2.8萬(wàn)億,采用Kimi Delta Attention與Attention Residuals架構(gòu),配合Stable LatentMoE實(shí)現(xiàn)896個(gè)專家中每token僅激活16個(gè)的高稀疏度。據(jù)官方測(cè)算,整套架構(gòu)的擴(kuò)展效率較Kimi K2提升約2.5倍。
登頂即「熔斷」:算力瓶頸的反向證據(jù)
K3發(fā)布后最戲劇性的一幕并非排名,而是訂閱熔斷。Kimi在公告中披露,過(guò)去48小時(shí)用戶請(qǐng)求量逼近集群承載極限,公司即日起暫停C端新用戶訂閱,全力推進(jìn)算力擴(kuò)容。
這與高盛此前的預(yù)判形成了直接沖突。高盛合伙人Rich Privorotsky曾指出,一家無(wú)法匹配西方最大規(guī)模預(yù)訓(xùn)練算力的中國(guó)實(shí)驗(yàn)室,通過(guò)架構(gòu)創(chuàng)新迅速縮小了與頂尖美國(guó)模型的差距,并據(jù)此警告「擴(kuò)展不再是唯一制勝路徑」。
但Kimi的訂閱熔斷提供了反向事實(shí)——當(dāng)模型性能真正獲得市場(chǎng)認(rèn)可時(shí),算力缺口反而以更猛烈的方式出現(xiàn)。
韓國(guó)Meritz證券在7月19日的報(bào)告中也明確回應(yīng)了這一爭(zhēng)論。報(bào)告將K3與DeepSeek沖擊區(qū)分開(kāi)來(lái):DeepSeek核心敘事是600萬(wàn)美元極低成本訓(xùn)練,而K3并未披露訓(xùn)練成本,且官方建議至少64顆高性能芯片組成的超節(jié)點(diǎn)環(huán)境部署。
從使用成本看,K3每次任務(wù)處理成本0.95美元,與GPT-5.6 Sol的1.04美元及Claude Fable 5的2.75美元處于同一量級(jí)。
閉源護(hù)城河收窄,但「杰文斯悖論」正在生效
招商證券研究進(jìn)一步指出,開(kāi)源模型對(duì)閉源最直接的沖擊來(lái)自性能追趕。
Stanford AI Index 2026顯示,截至3月,頂級(jí)閉源模型相對(duì)頂級(jí)開(kāi)源模型領(lǐng)先約3.3%,差距已不足以支撐閉源在所有場(chǎng)景維持高溢價(jià)。Epoch AI的研究則顯示,最強(qiáng)開(kāi)放權(quán)重模型平均落后最強(qiáng)閉源模型約4個(gè)月。
從token消費(fèi)趨勢(shì)看,Silicon Data LLM Token Expenditure Index自6月起持續(xù)回落,反映出AI服務(wù)正經(jīng)歷類似云計(jì)算的發(fā)展路徑——通過(guò)成本下降推動(dòng)使用規(guī)模擴(kuò)大。
根據(jù)OpenRouter數(shù)據(jù),截至7月6日全球周調(diào)用量已達(dá)52.6萬(wàn)億token,以DeepSeek、通義千問(wèn)為代表的開(kāi)源模型憑借性價(jià)比多次在周調(diào)用量上領(lǐng)跑全球。
花旗分析師將K3視為AI產(chǎn)業(yè)鏈中「杰文斯悖論」的潛在案例:技術(shù)效率降低單位成本后,使用量可能大幅增加,最終資源總消耗不降反升。
美銀證券也指出,若中國(guó)開(kāi)源模型持續(xù)逼近,美國(guó)前沿AI實(shí)驗(yàn)室更可能增加而非減少算力投入,以維持差異化。
超節(jié)點(diǎn)崛起:進(jìn)入系統(tǒng)級(jí)競(jìng)爭(zhēng)
當(dāng)算力需求持續(xù)擴(kuò)張而單顆芯片性能已無(wú)法獨(dú)立決定系統(tǒng)能力時(shí),超節(jié)點(diǎn)成為AI基礎(chǔ)設(shè)施演進(jìn)的核心方向。
招商證券在周報(bào)中介紹,超節(jié)點(diǎn)是通過(guò)高速、低時(shí)延的Scale-up互聯(lián),將數(shù)百乃至數(shù)千顆AI加速芯片連接為統(tǒng)一邏輯計(jì)算單元的新型高密度算力系統(tǒng)。
2026年WAIC上,華為昇騰950超節(jié)點(diǎn)真機(jī)首次公開(kāi)亮相,支持最高1024卡級(jí)別部署,提供1 EFLOPS級(jí)FP8算力和256TB統(tǒng)一內(nèi)存編址空間。
根據(jù)BCC Research預(yù)測(cè),全球數(shù)據(jù)中心網(wǎng)絡(luò)技術(shù)市場(chǎng)規(guī)模將從2025年的458億美元增長(zhǎng)至2030年的1030億美元,年復(fù)合增速約17.6%。
Research and Markets預(yù)計(jì)AI高速互聯(lián)市場(chǎng)規(guī)模將從2025年的103.1億美元增長(zhǎng)至2030年的301.7億美元,年復(fù)合增速約23.9%,增速顯著高于傳統(tǒng)數(shù)據(jù)中心網(wǎng)絡(luò)。
對(duì)投資者而言,Kimi K3的發(fā)布傳遞了一個(gè)清晰的信號(hào):開(kāi)源模型的能力突破不會(huì)削弱對(duì)底層硬件的需求,效率提升釋放的新增工作負(fù)載正在將行業(yè)競(jìng)爭(zhēng)焦點(diǎn)從模型本身,推向支撐模型運(yùn)行的算力基礎(chǔ)設(shè)施。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.