Kimi K3發布后的第四日,風暴仍在持續。
4天前(7月17日)凌晨,2.8萬億參數的K3橫空出世,以1679分登頂Frontend Code Arena榜單,首次有開源模型在Frontend Code Arena前端編程榜單超越一眾閉源模型登頂。特斯拉CEO(首席執行官)埃隆·馬斯克在相關評測下留言:“Impressive(令人印象深刻)。”這是馬斯克繼今年3月點贊Kimi底層架構技術報告后第二次公開認可這支中國團隊,并在其預告新模型Grok 4.6時,甚至將Kimi K3作為對比目標。
而贊譽的另一面是風暴。發布48小時后,Kimi發文表示用戶請求量已大幅超出其預估,并且逼近現有集群的承載極限,Kimi宣布暫停C端新用戶訂閱,有業內觀點將此次事件類比為“DeepSeek 2.0時刻”。
與此同時質疑聲起,一方面有外界流傳K3蒸餾模型的言論;另一方面人工智能公司OpenAI戰略未來負責人迪恩·鮑爾也公開發帖抨擊Kimi K3模型。他一方面承認K3性能無法依靠蒸餾實現,另一方面表示開放權重模型會削弱前沿模型的商業回報,稱其為“減速主義力量”。
技術原創性爭議、開源閉源路線之辯、高定價策略的可持續性,三重追問投向月之暗面公司,該公司企業業務負責人黃震昕直面媒體,首度系統性回應外界質疑。
否認“K3是蒸餾小模型”“性能躍升來自底層原創架構創新”
針對外界流傳的“K3是蒸餾小模型”的猜測,7月21日上午,月之暗面公司企業業務負責人黃震昕在接受媒體記者采訪時直接否認。黃震昕表示,K3性能躍升的核心來自底層原創架構創新,并非對現有模型蒸餾復刻。
此前發布時,Kimi也提到架構層面變化帶來的效率提升。據介紹,Kimi K3基于Kimi Delta Attention(KDA)混合線性注意力機制和Attention Residuals(AttnRes)注意力殘差技術構建。MoE(混合專家)層面,模型在896個專家中激活16個。而上述結構性改進讓Kimi K3 相比K2的整體擴展效率提升約2.5倍。
本次黃震昕進一步披露了支撐K3的三項關鍵技術。其中,Moon Clip是一種全新二階優化器,由Kimi首次應用于大模型訓練。“當前全球可用訓練數據基本見底,這項技術能讓20T訓練數據跑出40T的訓練效果,同等性能下訓練成本、算力功耗直接減半。”Kimi Linear Tension是其自研線性注意力機制,用于解決傳統線性注意力處理超長任務時性能衰減的痛點。“行業存在AI摩爾定律,AI可執行任務時長每7個月翻1倍;這套機制讓上下文窗口擴大10倍,訓練成本僅同步擴大10倍。”
今年3月發布技術報告時已引起過一次關注的Attention Residuals(注意力殘差),這項技術優化了模型多層網絡間信息傳遞與復用邏輯,它讓2.8萬億超大參數模型既能穩定完成訓練,又能讓推理效率同步提升25%。
今年以來,月之暗面創始人楊植麟曾多次在公開演講中提及Kimi構建規模化策略Token(詞元)效率、長上下文、Agent(智能體)集群,在有限資源下實現智能最大化。而從當前Kimi技術迭代方向來看,團隊仍堅定不移地走既定路線,專注編程、金融、法律、科學研究等生產力場景。
關于模型幻覺問題,黃震昕也作出了回應。他表示,幻覺無法徹底根除。“幻覺本質是模型創造力的同源產物”,但K3已大幅壓低其發生率;配套事實校驗員子Agent的Agent Swarm架構,可逐一對報告、行業數據做校驗,進一步降低內容失真概率。
面對開源閉源路線之爭,黃震昕的觀點清晰:二者并非對立競爭關系,而是企業客戶差異化需求的產物。有私有化、微調需求的企業傾向開源,追求穩定托管服務的企業選擇閉源。開源、閉源路線本身,與模型Token能力、輸出質量沒有必然綁定關系。
他同時明確,Kimi自K2起堅持開源路線,這一路線未來不會改變,核心底層技術、論文均對外公開,完整模型權重計劃于2026年7月27日前發布。
用戶請求量大幅超出預估算力承壓的Kimi要做取舍
K3上線的火爆程度超出所有人的預判,包括月之暗面。黃震昕坦言團隊提前做了流量預案,但實際訪問量的暴漲幅度遠超預期。
發布后48個小時,Kimi在7月19日深夜緊急發布公告,表示其面臨始料未及的算力挑戰,用戶請求量已大幅超出預估,并且逼近現有集群的承載極限。
黃震昕表示,當時公司面臨兩難,放開全部新用戶注冊,會嚴重損害存量付費老用戶的使用體驗;優先保障付費客戶,則需臨時限制新用戶注冊。公司選擇了后者。“寧可暫時放棄新增收入,也要守住付費客戶的使用體驗底線。”
7月19日,月之暗面正式公告暫停C端新用戶訂閱,將已有算力全部投入服務已訂閱用戶,同時全速推進算力擴容。在新算力陸續到位,再逐步開放更多訂閱名額直至全面恢復正常訂閱。根據Kimi官方回復內容,目前老套餐沒有被移除,當前用戶可正常使用并自動續費;老用戶可選擇升級套餐。
《每日經濟新聞》記者也就算力擴容落地時間規劃、新增算力的規模等問題向公司方面發出提綱,但截至發稿暫無回應。
對于商業化層面,黃震昕透露,Kimi現階段暫不提供私有化部署服務,商業模式對標海外成熟頭部AI企業,核心發力打磨模型基礎能力。他同時也表示不會止步于當前2.8萬億規模,大模型參數規模還會持續拓展。
本次隨著模型能力一同受到關注的還有一路走高的模型價格。據第三方機構Artificial Analysis測算,Kimi K3單任務成本約0.94美元,與GPT-5.6 Sol的1.04美元接近,約為Claude Opus 4.8(1.80美元)的一半,定價已經將K3推向與海外頭部模型同臺競技的價格帶。“開源模型、中國大模型不該被貼上低價標簽。我們做出了SOTA級模型,也能匹配合理商業定價。”黃震昕說。
數據也成為這一觀點的印證。此前7月18日,月之暗面總裁張予彤在社交媒體發布一張Kimi企業最新ARR(年化收入)的圖表,圖片顯示Kimi K3于7月17日發布后,企業ARR有了數倍快速增長。
![]()
圖片來源:張予彤小紅書賬號截圖
《每日經濟新聞》記者了解到,此前6月中旬,月之暗面的ARR已經突破3億美元。
同一時間,黃震昕在公開演講中表示,Kimi海外付費用戶增長400%,API收入增長400%,產品進入200多個國家和地區,互聯網、金融、制造、教育、醫療等行業正成為重要企業客戶來源。
他也在談及大模型行業發展現狀時表示,當前賽道確實存在發展泡沫。黃震昕同時舉例,海外頭部廠商Anthropic已實現季度盈利,月之暗面也正向著這一方向趕超,“最終還是希望探索智能的上限,希望能和海外那3家模型公司掰掰手腕”。
風暴眼中,另一條消息也在發酵。據市場知情人士向《每日經濟新聞》記者透露,頭部大模型企業月之暗面已向投資人發送上市議案,預計最快6個月內有望完成港交所上市,估值可能超過300億美元。目前公司方面對此暫無回應。
K3引發的連鎖反應遠未結束,中國大模型正在全球市場成為新的價值標桿。7月18日,馬斯克宣布xAI正在訓練參數規模達2萬億的Grok 4.6,“將在下周完成首輪訓練,有可能超越Kimi。”月之暗面隨后在社交媒體上回應:“歡迎加入“2萬億+”俱樂部。”本次黃震昕也表示:“可能這次的這個(K3)表現,(讓他們)得到一點震撼的感覺,現在拭目以待,希望他們出來跟我們掰一掰手腕。”
當開源模型第一次站到編程能力的世界之巔,并向海外頭部閉源產品的價格帶看齊時,真正的考驗才剛剛開始。撕掉“低價”標簽之后,如何在開源的開放姿態與商業的合理回報之間找到平衡,讓SOTA級的技術能力兌換成可持續的定價權,還需要Kimi和所有中國開源玩家不斷探索。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.