![]()
作者|博雯
編輯|賴捷
好家伙,一覺醒來中國版Fable橫空出世了?
就在今天凌晨,月之暗面正式發布Kimi K3。而在昨天晚上,已經有爆料說Kimi K3的水平“接近Fable 5”,“優于GPT5.6”,甚至堪稱“又一個Deepseek時刻”。
本以為又是行業日常炸裂時刻,結果扒完一圈案例,還真被Kimi K3的水平給驚到了。
浮世繪風格的動畫,Kimi K3手拿把掐,整體的畫面、分鏡、創意全都不輸號稱當代最強的Fable 5。
![]()
還有人用它給剛發布的Codex鍵盤做宣傳片,說實話,這品味和設計感甚至比OpenAI自家的效果還要好。
![]()
大家可以自行對比OpenAI發的這個非常直白的實物講解……
![]()
看了一圈海外X和國內技術社區,很明顯絕大部分人都非常意外:Fable 5和GPT-5.6最近打得熱鬧,怎么突然沖出來一個Kimi K3?
但事實就是,剛剛發布的Kimi K3,不僅在權威編程評估榜單Code Arena中,力壓Claude Fable 5和GPT-5.6 Sol排到了第一,在綜合性AI能力評估測試Artificial Analysis Intelligence Index中,Kimi K3也直接從靠后的位置直接沖到了前3,作為一個開源模型,性能甚至能和Claude Fable 5和GPT-5.6 Sol兩大頂級閉源模型掰掰手腕。
![]()
現在,Kimi K3已登陸網頁端、Kimi Work、Kimi Code和API。
僅僅不到一天,海內外網友就已經玩瘋了。
![]()
更有品味、更有創造力
盤點三大熱門案例方向
根據官方介紹,Kimi K3擁有2.8萬億參數,是全球迄今為止最大的開源AI模型,主打3D推理、編程和視覺處理能力,能夠將概念、圖像和視頻轉化為可完全互動的體驗。
而翻看全網熱門案例,我們發現Kimi K3也確實在以下三個方向表現最為驚艷:
1、視覺設計
目前在X以及多個外網技術社區里,大家一致的反饋都是:Fable 5和Kimi K3都具有非常鮮明的藝術本能和視覺優先級。
比如我們開頭展現的浮世繪風格動畫,盡管在鏡頭設計與表達上有一些差異,但整體給人的驚艷感已經是不相上下。
![]()
圖源博主@Renoise
還有人用同樣的提示詞做動態展示頁,展示的產品,想要的網頁整體色調,還有一整套的排版格式都完全相同,但即使是這樣相似的條件,Kimi K3最終呈現的效果,確實也更有一種靈動的設計感。
這個案例的作者還放出了成本:Fable 5消耗4.58萬Token,耗費約2.84元,而Kimi K3消耗3.82萬Token,花費約0.34元,幾乎便宜了8倍。
![]()
圖源博主@Nico
還有人用同一套提示詞去復刻蘋果主頁,左邊是Kimi K3,右邊是Fable 5,最后效果基本都還原了“蘋果味”,但Fable 5花費了約6.37元,而Kimi K3花了約2.98元,成本只有一半。
提示詞:創建一個HTML文件,重現蘋果官網(apple.com)的頁面。頂部固定導航欄顯示蘋果菜單(標志、產品、搜索、購物袋)。特色產品主圖區:居中的大圖、大標題、副標題以及兩個鏈接(“了解更多 ?”和“立即購買 ?”)。其下方為產品宣傳頁的網格布局,淺色和深色背景交替出現,每頁均包含居中的標題、副標題和行動號召按鈕。字體、字重和間距需嚴格遵循蘋果風格(San Francisco / -apple-system),支持桌面端和移動端的響應式布局,并帶有微妙的懸停和滾動動畫。產品圖片可使用漸變色或 SVG 作為占位符。請勿引用任何其他文件。
![]()
圖源博主@LASCHUK
2、游戲
盡管代碼或構建小游戲的能力,對于現在的AI來說已算是老生常談,但對于這次的Kimi K3,用戶們的反應還是相當瘋狂。
有人甚至表示,Kimi K3完全就是Fable+GPT才能搞出來的AI游戲引擎,甚至可以說是“神級游戲引擎”。
![]()
在X上,有用戶同時讓Kimi K3和GPT-5.6 Sol通過Three.js(一個用于在網頁瀏覽器中創建和展示3D圖形的開源JavaScript庫)構建一個弩炮模型。
提示詞:用Three.js構建弩炮,這是一種古代和中世紀的攻城武器,其工作原理類似于巨大的弩。
而在最后輸出的結果中,GPT-5.6 Sol構建出來的弩炮是通過一個界面來操控的,瞄準是+/?,裝填是R,發射是按空格,環境場景則像是訓練場,也會時不時地轉動視角,好像在進行教學訓練;
Kimi K3則是通過“按住蓄力、松手放箭”來完成對真實弩機物理動作的映射:按住的時間長短就是張力大小,松開瞬間就是扳機釋放。而且整體的風格環境也塑造了月夜、火把、敵軍剪影這樣的額外元素。
原作者在測試之后表示,兩者之間的“品味差異”非常明顯,不僅是視覺上,還有功能性的。整體而言,雖然兩者都達到了相同的效果,但Kimi K3“更有創造力”。
![]()
圖源博主@Chetaslua
還有用戶用Kimi K3開發出了一個紙片人版本的馬里奧,他驚喜地發現,“當玩家角色在樹頂后面時,樹頂應該半透明”以及“玩家吃金幣”這兩個機制,都是他沒有提示而Kimi K3主動做的。
![]()
圖源博主@BridgeMind
而在官方給出的演示中,Kimi K3可以通過Three.js + WebGPU + GPU Compute實時渲染構建一個廣闊的開放世界,擁有森林、雪山、木屋村莊等等元素,還能整合天氣、光照、動畫,最終輸出一個可直接運行的瀏覽器游戲。
官方技術博客也提到,Kimi K3在動態設計、動畫和視頻剪輯方面表現出色,因為它原生的多模態架構能夠在同一模型中理解文本、圖像和視頻。
![]()
圖源Kimi官方
還有人只用了大概60萬Token,約22元的成本,就復刻了槍擊游戲《CS:GO》+第一人稱動作解謎游戲《傳送門》的效果案例,而同等成果用GPT-5.6 Sol要花費超過40元,Fable 5更是超過73元。
這位開發者感嘆道:
“免費獨立游戲開發的時代比你想象得更近!”
![]()
圖源博主@Chris
3、3D建模與推理
在熱門案例中特別顯眼的,還有“3D建模與推理”。
提示詞:用Three.js構建一個逼真的軍事軍械庫,配備步槍、手槍、狙擊步槍、手榴彈、防彈衣、彈藥箱、武器架、動畫顯示器和動態燈光。
在同樣的提示詞下,Kimi K3和Claude Opus 4.8最終輸出的成果差異明顯,Opus 4.8生成的環境是一個比較空曠的房子,房間內的元素也很少;而Kimi K3則構建了一個完整的場景,包含貼圖、合適的光影、彈藥箱、武器架等等多種細節。
構建完成后原作者嚴感嘆道,Kimi K3毫無疑問是比Opus 4.8更好的,而且水平已經直逼Fable 5。
![]()
圖源博主@Bhavy
還有AI測試中經典的“熔巖燈測試”,它在熱力學上的完整循環是:燈泡在底部加熱→蠟變輕上升→到頂部冷卻→變重下沉。可以說是同時考驗AI模型的前端生成、動畫設計、視覺審美和交互實現能力。
而在Fable 5(左)和Kimi K3(右)最終輸出的效果里,顯然Kimi K3在上升、冷卻、下沉的整個過程中,表現得更細膩,會從顏色上體現底部的蠟團正在被加熱(所以顏色更亮),而頂部的蠟球正在冷卻(所以顏色發紅發暗),展現出了熱狀態的變化。
同時,Kimi K3在底座上還生成了一圈豎條結構,對應的是真實熔巖燈里燈泡周圍的金屬絲/散熱構造,這也是提示詞里不會有,模型主動補上的物理細節。
![]()
圖源博主@BridgeMind
還有人直接用Kimi K3生成了一個四沖程發動機的3D建模,質感、交互、參數界面都相當驚艷。
![]()
圖源博主@Berryxia.AI
![]()
問題也有:
價格和速度靜待市場考驗
從上述熱門案例中我們也能看到,Kimi K3最顯眼的,就是其更主動、更真實的創造力。這也正是Kimi K3能在Code Arena上登頂的直觀原因。
畢竟Code Arena測的主要就是前端編程,比起后臺數據流轉,它更強調用戶能直接接觸到的視覺呈現和交互實現,模型也需要根據用戶要求生成網頁,完成視覺還原、交互設計和功能實現。
在Code Arena的實際測評中,同一道任務會交給兩個匿名模型,用戶實際體驗兩個結果后投票,投票完成才會公布模型身份。在結果揭曉前,用戶并不知道自己選的是哪家模型,這就極大削弱了用戶對品牌先入為主的認知。
而數百萬用戶盲測之后的結果,就是Kimi K3在今天凌晨更新的榜單中拿到了1679分,排在全球第一,壓過了 Claude Fable 5的1631分和GPT-5.6 Sol的1618分。
![]()
當然,問題也有。
比如官方博客里就很直白地表示,Kimi K3在訓練階段就特別強調遠景和具有挑戰性的任務。因此,當任務執行過程中遇到小問題或用戶意圖模糊時,模型可能會代表用戶做出意想不到的決策——有時會給用戶帶來驚喜,有時也會“過度即興發揮”,因此最好對模型施加更明確的行為約束。
此外,Kimi K3對于歷史思考內容也很敏感。如果Agent框架沒按要求回傳全部歷史思考內容,或者用戶從其它模型的會話中途切換過來,生成質量可能不穩定。所以官方建議用Kimi Code這類驗證過兼容性的框架,不要在會話中途換模型。
而在大量用戶實測的案例中,也有不少于用戶反饋生成速度比較慢,稍微復雜一點的項目,生成速度可能就奔著小時去了。
![]()
運行了超過30分鐘,然后就把20美元的訂閱額度給花完了。
![]()
還有普通用戶最關心的價格問題。
盡管大量案例都在強調Kimi K3的成本更低,而根據Artificial Analysis,在平均每個智能指數任務的價格上,Kimi K3相對能力更接近的GPT 5.6 Sol確實更便宜,對比Opus4.8更是便宜了一半。
不過整體而言,相對大家對國產模型超高性價比的期待,還是有點距離。
![]()
實際上官方也表示,Kimi K3的整體表現,仍落后于最強的閉源模型 Claude Fable 5 和 GPT-5.6 Sol。
有不少人說,Kimi K3的發布是又一個DeepSeek時刻,這個評價是否公允?就靜待它在未來長期實戰中給出的答案吧。
歡迎分享、點贊、推薦
一起研究AI
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.