![]()
本文來自微信公眾號: 山上 ,作者:山上團(tuán)隊(duì)
脆弱的模型時代。
作者I薛星星
編輯I蔣澆
封面I Kimi
像所有AI行業(yè)人士一樣,月之暗面創(chuàng)始人楊植麟喜歡用“AI一天,人間一年”的說法形容AI的迅速迭代。對于剛剛發(fā)布的Kimi K3而言,似乎沒有什么形容比這句話更為貼切。月之暗面成立至今已有三年,但過去三年的所有積累可能都抵不上這三天的轟動。
自ChatGPT發(fā)布以來,中國AI行業(yè)有許多次震驚世界的時刻。一部分來自于真正的技術(shù)突破,一部分則是媒體與廠商們的自嗨,Kimi K3的發(fā)布似乎是唯一能與“DeepSeek時刻”相媲美的。
和去年年初DeepSeek-R1發(fā)布后美國芯片產(chǎn)業(yè)普跌類似,上周包括英偉達(dá)、博通以及美光在內(nèi)的費(fèi)城半導(dǎo)體指數(shù)重挫10%,創(chuàng)下自2025年4月以來最大單周跌幅,進(jìn)入技術(shù)性熊市區(qū)間。媒體統(tǒng)計稱,72小時內(nèi)美股AI板塊合計蒸發(fā)4700億美元,約超3萬億人民幣。
不止一家海外媒體及研究機(jī)構(gòu)用諸如“DeepSeek 2.0”來形容Kimi K3。《財富》雜志稱這是“第二次DeepSeek沖擊”,《華爾街日報》強(qiáng)調(diào)Kimi加劇了華爾街芯片股拋售,彭博社則表示“Kimi顛覆了美國領(lǐng)先中國的傳統(tǒng)認(rèn)知”。
恐慌的情緒不斷蔓延,甚至令OpenAI及Anthropic都備受質(zhì)疑,因?yàn)橐患抑袊_源模型的性能似乎已接近頂級閉源模型。二者本就處在上市前的關(guān)鍵節(jié)點(diǎn),模型性能領(lǐng)先是他們獲得高估值以及高定價的關(guān)鍵。部分美國開發(fā)者已經(jīng)在質(zhì)疑為何還要為Calude和GPT付出這么多的價格。
過去幾日,Anthropic宣布為所有Max及Team Premium用戶開放Claude Fable 5,但限額50%,此前他們曾因算力問題而計劃完全從訂閱方案中移除這一模型。OpenAI則在上周多次重置Codex限額,甚至一度取消了5小時的用量限制。
很難說這些事件都是Kimi K3的沖擊所致。在此之前,半導(dǎo)體產(chǎn)業(yè)已經(jīng)連續(xù)承壓數(shù)周,華爾街分析師們迫切需要為這輪下跌尋找一個足夠醒目、也容易理解的借口——境外勢力自然是萬能法寶。更不用說OpenAI及Anthropic本就處在激烈競爭之中,已經(jīng)演變到大打價格戰(zhàn)的地步。
但這似乎并不影響美國科技行業(yè)對于Kimi K3的驚訝。即便Kimi承認(rèn)自身總體性能仍落后于Claude Fable 5于GPT-5.6 Sol,諸多海外評測機(jī)構(gòu)仍在測評對K3不吝贊美,排名往往位列前茅。
Arena.ai稱Kimi K3以1679分的成績獲得前端代碼競技場榜首,超越Claude Fable 5。這家機(jī)構(gòu)表示,上次中國模型如此接近領(lǐng)先,還是2025年的DeepSeek-R1。
![]()
Arena統(tǒng)計中美AI對比
高昂的市場熱情下,連楊植麟都成為美國科技圈熱議的新偶像人物。大洋彼岸的人民群眾疑問為何他當(dāng)年沒有留在美國,而是回到了中國。楊植麟的博士生導(dǎo)師不得不專門發(fā)文解釋,澄清楊回國并不是由于簽證或移民問題,而是他自己堅(jiān)定要回去創(chuàng)業(yè)。
大模型行業(yè)仍然遵循著最簡單明了的優(yōu)勝劣汰法則,只要性能足夠領(lǐng)先,價格就不是問題。即便K3模型的輸入及輸出價格均較上代K2.6模型均上漲超3倍有余,也顯著高于GLM-5.2及DeepSeek V4 Pro,已經(jīng)是目前市面上最貴的國產(chǎn)模型,但Kimi依然遭遇了算力緊缺問題。
7月19日晚,Kimi宣布由于算力緊缺,自即日起暫停C端新用戶訂閱。他們同時調(diào)整了會員權(quán)益,將原本覆蓋Kimi網(wǎng)頁版、App以及Kimi Work的通用會員與Kimi Code會員拆分銷售。Kimi總裁張予彤稱,K3發(fā)布次日公司ARR創(chuàng)下歷史最大單日增幅。
![]()
Kimi官方推文
算力緊缺一定程度上或許也與K3模型自身的Token效率相關(guān)。在Artificial Analysis的評測中,K3完成整套測試輸出了1.3億個Token,接近同類模型平均水平的兩倍。更長的輸出通常意味著更高的推理成本,這可能進(jìn)一步加重Kimi的算力壓力。
社交媒體上,也有不少開發(fā)者吐槽Kimi K3是Token消耗大戶,有人稱跑了15分鐘就已經(jīng)耗盡了5小時的限額。
K3的出圈似乎再一次證明了AI時代模型的脆弱性。僅僅兩周之前,中國大模型市場最被人看好的還是已經(jīng)上市的智譜。上半年智譜發(fā)布的GLM-5.2模型被譽(yù)為國產(chǎn)開源模型的驕傲,幾次大幅上調(diào)價格依然緊俏。上市半年來,智譜股價翻了24倍有余,總市值一度突破1.3萬億港元。
但從上周開始,智譜的神話似乎就已松動。上周五,智譜股價下跌28.49%,本周一再跌19.56%,兩個交易日股價累計下跌超4成,市值跌破5000億港元。
Kimi K3的領(lǐng)先可能也維持不了多久。7月19日,阿里巴巴發(fā)布Qwen3.8 Max預(yù)覽版,參數(shù)規(guī)模達(dá)2.4萬億,宣稱綜合能力在全球范圍內(nèi)僅次于Claude Fable 5。馬斯克對外稱,擁有2萬億參數(shù)量的Grok新模型即將完成初步訓(xùn)練,它可能在保持較高運(yùn)行效率的同時超越Kimi。
K3發(fā)布當(dāng)天,薩姆·奧爾特曼對外表示,他知道他們過去12個月并非最佳,這主要?dú)w咎于他,但他們即將迎來迄今為止最好的12個月。“團(tuán)隊(duì)正在做非常出色的工作,我相信你會對他們?yōu)槟銣?zhǔn)備的驚喜感到非常滿意。”
![]()
芯片行業(yè)多年來一直奉行著摩爾定律,在成本大致不變的情況下芯片性能大約每18至24個月翻一倍。但就像AI行業(yè)人士常常掛在嘴邊的“AI一天,人間一年”的說法,AI時代的模型性能提升可能以周甚至天來計算。
去年谷歌的Gemini模型一度令薩姆·奧爾特曼在公司內(nèi)拉響紅色警報,但現(xiàn)在Gemini更流行的稱謂是“北美豆包”。彭博社稱Gemini 3.5 Pro的發(fā)布時間已經(jīng)推遲數(shù)月,因?yàn)槟P驮诰幊碳按a生成能力上未達(dá)預(yù)期。
剛剛完成首輪融資的DeepSeek被曝即將推出DeepSeek-V4模型的正式版,外界稱性能將逼近GPT-5.6,且繼續(xù)保持極高性價比的優(yōu)勢。
過去的時代總在反復(fù)證明時間的重要。無論是PC互聯(lián)網(wǎng)還是移動互聯(lián)網(wǎng),一家公司只要起步足夠早、跑得足夠快,就有機(jī)會趕在窗口關(guān)閉前建立先發(fā)優(yōu)勢。而隨著用戶和市場規(guī)模不斷擴(kuò)大,領(lǐng)先非但不會被稀釋,反而會持續(xù)放大,令后來者越來越難以追趕。
但在AI時代,優(yōu)勢并不總是站在時間這一邊。所有的領(lǐng)先都建立在模型性能的迭代上,總有后來者不斷推出更新的模型,縮短與前者的差距。如果說互聯(lián)網(wǎng)時代最難追趕的是規(guī)模,那么AI最醒目的優(yōu)勢就是模型。只是這種優(yōu)勢的保質(zhì)期,往往只有一個版本。
兩個交易日內(nèi)股價連跌4成的智譜,今日盤中漲幅一度超35%。市場消息稱,智譜已落地1GW級國產(chǎn)AI算力數(shù)據(jù)中心建設(shè)。
競爭仍在繼續(xù)。
本內(nèi)容由作者授權(quán)發(fā)布,觀點(diǎn)僅代表作者本人,不代表虎嗅立場。如對本稿件有異議或投訴,請聯(lián)系 tougao@huxiu.com。
本文來自虎嗅,原文鏈接:https://www.huxiu.com/article/4877026.html?f=wyxwapp
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.