![]()
OpenAI前首席技術(shù)官穆拉蒂,做出了一款中國模型的“貴替”。
Thinking Machines發(fā)布的首款模型Inkling,混合專家架構(gòu)主要沿用DeepSeek-V3,后訓(xùn)練冷啟動還使用了Kimi K2.5等開放模型生成的數(shù)據(jù)。然而在多項(xiàng)基準(zhǔn)評測中,Inkling落后于Kimi和GLM,調(diào)用價格反而更高。
對于一家融資20億美元、估值120億美元,團(tuán)隊(duì)中聚集了大量OpenAI前員工的明星公司來說,這個結(jié)果多少有些低于預(yù)期。
但穆拉蒂可能從一開始就沒打算靠Inkling爭奪第一。隨著美國企業(yè)使用中國模型面臨越來越多不確定性,一款性能尚可、支持定制、合規(guī)風(fēng)險(xiǎn)更低的本土開放模型,已經(jīng)擁有自己的市場。“貴替”沒有那么強(qiáng),也不愁“市場”。
01
穆拉蒂的首款模型,就這?
當(dāng)?shù)貢r間7月15日,Thinking Machines Lab發(fā)布了成立以來的首款模型Inkling。
單看配置,這款模型很符合一家明星AI實(shí)驗(yàn)室應(yīng)有的排場。
Inkling采用混合專家架構(gòu),總參數(shù)量達(dá)到9750億,每處理一個Token會激活410億參數(shù);預(yù)訓(xùn)練使用了45萬億個Token,數(shù)據(jù)涵蓋文本、圖像、音頻和視頻,最長支持100萬個Token的上下文。它可以理解文字、圖片和音頻,再以文字形式輸出結(jié)果,還支持通過調(diào)節(jié)“思考強(qiáng)度”,在性能、速度和成本之間進(jìn)行取舍。
Inkling同時開放了模型權(quán)重,采用相當(dāng)寬松的Apache 2.0許可證。開發(fā)者可以下載權(quán)重、自行部署,也可以通過Thinking Machines旗下的Tinker平臺對模型進(jìn)行微調(diào)。
公司給它的定位很明確:與其直接和ChatGPT爭奪普通用戶,Inkling更適合充當(dāng)企業(yè)開發(fā)AI應(yīng)用的底座。
不過,Inkling最引人注意的部分,藏在技術(shù)報(bào)告后半段。
Thinking Machines在介紹模型架構(gòu)時直接寫道,Inkling的混合專家設(shè)計(jì)“主要沿用了DeepSeek-V3”。它同樣設(shè)置了大量專家模塊,每個Token只調(diào)用其中一小部分,并采用了DeepSeek-V3的無輔助損失負(fù)載均衡等設(shè)計(jì)。
![]()
中國模型對Inkling的影響還延伸到了訓(xùn)練階段。
Thinking Machines表示,為了啟動后訓(xùn)練,公司先用開放權(quán)重模型生成的合成數(shù)據(jù)做了一輪監(jiān)督微調(diào),其中明確提到了月之暗面的Kimi K2.5。
整條技術(shù)路線已經(jīng)足夠清楚:一家由OpenAI前首席技術(shù)官創(chuàng)辦的美國實(shí)驗(yàn)室,首款模型沿用了DeepSeek的架構(gòu),又借助Kimi生成的數(shù)據(jù)完成后訓(xùn)練起步。
借鑒開放模型本身沒有問題。DeepSeek和Kimi公開權(quán)重并允許開發(fā)者使用,科學(xué)研究和工程開發(fā)原本就建立在公開成果的積累之上。更尷尬的地方在于,Inkling吸收了中國模型的技術(shù)之后,性能依然沒有壓過這些“老師”。
Thinking Machines對此也沒有粉飾。公司在發(fā)布文章中直接承認(rèn):“Inkling并非目前表現(xiàn)最強(qiáng)的模型,無論開放模型還是閉源模型。”
從Thinking Machines公布的結(jié)果看,
.在“人類最后的考試”純文本評測中,Inkling得分29.7%,Kimi K2.6和GLM 5.2分別達(dá)到35.9%和40.1%;
.加入工具后,Inkling升至46%,依然低于Kimi K2.6的54%和GLM 5.2的54.7%。
.在考察真實(shí)軟件工程能力的SWE-Bench Pro中,Inkling得分54.3%,Kimi K2.6為58.6%,GLM 5.2達(dá)到62.1%;
.Terminal Bench 2.1上的差距更加明顯,Inkling只有63.8%,Kimi K2.6和GLM 5.2分別達(dá)到71.3%和82.7%。
當(dāng)然,Inkling也有自己的長項(xiàng)。它在網(wǎng)頁應(yīng)用設(shè)計(jì)、音頻理解和安全性評測中表現(xiàn)不錯,在部分?jǐn)?shù)學(xué)任務(wù)上也能超過Kimi和DeepSeek。
只是從綜合推理、編程和智能體能力來看,它目前很難被歸入開放模型的第一梯隊(duì)。
性能沒有沖到最前面,價格同樣沒給出驚喜。
在Tinker平臺上,64K版本Inkling每100萬Prefill Token收費(fèi)1.87美元,每100萬Sample Token收費(fèi)4.68美元。前者可以粗略理解為輸入成本,后者接近生成成本,而且這已經(jīng)是“限時五折價”。256K版本的價格更高,分別達(dá)到3.74美元和9.36美元。
作為對比,Kimi K2.6官方API每100萬輸入和輸出Token分別收費(fèi)0.95美元和4美元,GLM5.2分別為1.4美元和4.4美元。
Tinker同時提供訓(xùn)練和采樣服務(wù),與普通模型API并非完全相同的計(jì)費(fèi)口徑。但按照上述價格粗略比較,Inkling的預(yù)填充價格接近Kimi K2.6的兩倍,生成價格也高于Kimi K2.6和GLM5.2,暫時沒有體現(xiàn)出價格優(yōu)勢。
于是,Thinking Machines的首款模型呈現(xiàn)出一種有些微妙的局面:架構(gòu)參考DeepSeek,后訓(xùn)練借力Kimi,綜合性能沒有超過中國頭部開放模型,調(diào)用價格反而更貴。
02
穆拉蒂的選擇
考慮到穆拉蒂和Thinking Machines的背景,這樣的選擇便更加耐人尋味。
如果Inkling來自一家普通的AI創(chuàng)業(yè)公司,借鑒DeepSeek、借助Kimi訓(xùn)練,或許還沒有這么耐人尋味。偏偏它來自Thinking Machines——一家?guī)缀蹩梢苑Q為“OpenAI校友會”的公司。
2025年2月,Thinking Machines正式亮相時,團(tuán)隊(duì)只有約30人,其中大約三分之二來自O(shè)penAI,其余成員主要來自Meta和Mistral。
創(chuàng)始團(tuán)隊(duì)一度包括OpenAI聯(lián)合創(chuàng)始人John Schulman、OpenAI前研究副總裁Barret Zoph,以及Lilian Weng、Andrew Tulloch和Luke Metz等研究人員。
這些人分別參與過OpenAI的強(qiáng)化學(xué)習(xí)、后訓(xùn)練、預(yù)訓(xùn)練、安全和推理研究。路透社當(dāng)時甚至直接形容,穆拉蒂從前東家挖走了至少20名研究人員。
站在這群OpenAI校友中間的穆拉蒂,當(dāng)然是最特殊的一個。
她于2018年加入OpenAI,先后參與DALL-E、Codex、ChatGPT和Sora等產(chǎn)品,2022年升任首席技術(shù)官,負(fù)責(zé)協(xié)調(diào)研究、模型訓(xùn)練、安全和產(chǎn)品落地。
![]()
2023年11月,OpenAI董事會突然罷免Sam Altman后,穆拉蒂還曾短暫擔(dān)任臨時首席執(zhí)行官。她的角色更接近技術(shù)和產(chǎn)品的總負(fù)責(zé)人,對OpenAI的模型研發(fā)流程和產(chǎn)品化路徑有著完整了解。
換句話說,Thinking Machines從成立之初就不缺O(jiān)penAI經(jīng)驗(yàn)。
穆拉蒂和她的團(tuán)隊(duì)知道一家頂級閉源實(shí)驗(yàn)室如何開發(fā)模型,也親歷了ChatGPT從研究成果變成全球產(chǎn)品的全過程。當(dāng)這群人離開OpenAI,從零搭建自己的技術(shù)體系時,外界自然會期待他們拿出一條帶有OpenAI印記的路線。
結(jié)果,Inkling最明確的技術(shù)來源卻指向了中國。這很容易被理解成一個戲劇性的信號——最了解OpenAI的一群人離開OpenAI后,最終選擇了中國模型的技術(shù)藍(lán)圖。
不過,這個結(jié)論還需要拆開來看。
OpenAI近年來的前沿模型全部采用閉源路線,外界拿不到模型權(quán)重,也不了解完整的架構(gòu)、訓(xùn)練數(shù)據(jù)和后訓(xùn)練方案。穆拉蒂即使熟悉OpenAI內(nèi)部技術(shù),也不能把前東家的商業(yè)機(jī)密直接搬進(jìn)新公司。DeepSeek和Kimi則公開了權(quán)重或技術(shù)報(bào)告,架構(gòu)、訓(xùn)練方法和工具鏈都可以合法研究和復(fù)用。
Inkling本身也是一款開放權(quán)重模型。對于一家想要建設(shè)開放模型生態(tài)的公司來說,從DeepSeek、Kimi等開放模型中吸收成熟方案,屬于順理成章的工程選擇。
今天開發(fā)一款開放模型,完全避開中國團(tuán)隊(duì)已經(jīng)公開的成果,反而要付出更高的試錯成本。
因此,Inkling借鑒中國模型,并不能直接證明穆拉蒂認(rèn)為DeepSeek的技術(shù)全面領(lǐng)先OpenAI。雙方公開程度不同,可供借鑒的條件也完全不同。
但這件事依然釋放了一個清晰的信號:至少在開放權(quán)重領(lǐng)域,中國模型已經(jīng)成了美國AI團(tuán)隊(duì)的重要參考系。
所以,借鑒中國模型并不難解釋。真正需要回答的問題是:Thinking Machines吸收了現(xiàn)成的架構(gòu)和訓(xùn)練經(jīng)驗(yàn),為什么最終做出的Inkling性能更弱、價格更高?
穆拉蒂擁有頂尖團(tuán)隊(duì)、充足資金和英偉達(dá)最新的訓(xùn)練系統(tǒng)。她沒有理由看不到Inkling與中國模型之間的性能和價格差距。
既然如此,“貴替”很可能就是一個經(jīng)過計(jì)算的選擇。
03
“一般般”,就夠了
按照Thinking Machines獲得的待遇,Inkling原本不該只是一款“夠用”的模型。
2025年7月,公司尚未推出任何產(chǎn)品,就完成了20億美元種子輪融資,估值達(dá)到120億美元,投資方包括安德森·霍洛維茨、英偉達(dá)、AMD和簡街等。四個月后,Thinking Machines又傳出新一輪融資談判,目標(biāo)估值高達(dá)500億美元,盡管交易最終沒有官宣完成,外界已經(jīng)將它視為OpenAI和Anthropic的潛在對手。
因此,當(dāng)Inkling以一款性能不如中國模型、價格還更貴的產(chǎn)品亮相時,難免顯得低于預(yù)期。
可從商業(yè)角度看,穆拉蒂可能從一開始就沒打算用它爭奪基準(zhǔn)評測第一名。
Thinking Machines公司強(qiáng)調(diào)的是開放權(quán)重、多模態(tài)能力和可定制性,希望企業(yè)通過Tinker對它進(jìn)行微調(diào),把Inkling改造成客服、編程助手、行業(yè)智能體等專用模型。穆拉蒂押注的市場,對基準(zhǔn)評測第一名沒有那么執(zhí)著。企業(yè)更在意模型能否私有部署、能否掌握數(shù)據(jù)、能否按照自己的業(yè)務(wù)繼續(xù)訓(xùn)練。
此前,這類需求很大一部分被中國開放模型接住了。
美國的OpenAI和Anthropic長期堅(jiān)持閉源,Meta的Llama 4表現(xiàn)不及預(yù)期后,也逐漸收縮開放路線。與此同時,DeepSeek、Kimi、Qwen和GLM持續(xù)開放權(quán)重,性能越來越接近美國閉源模型,價格卻低得多。
美國企業(yè)很快用腳投了票。
根據(jù)OpenRouter向CNBC提供的數(shù)據(jù),2026年2月以來,中國模型在美國企業(yè)經(jīng)由該平臺調(diào)用的Token中,每周占比都超過30%,最高一度達(dá)到46%。2025年上半年的平均占比還只有4.5%。
Cursor開發(fā)Composer 2時測試了多款基礎(chǔ)模型,最終選擇Kimi K2.5,理由也很直接——它在評測中表現(xiàn)最強(qiáng)。橋水基金則通過Tinker微調(diào)阿里的Qwen,得到的定制模型以更低成本超過了部分頂級閉源模型。
中國開放模型由此成了美國企業(yè)降低AI成本的一條捷徑。只不過,這條路正在承壓。
與此同時,美國對中國AI模型的監(jiān)管氛圍正在收緊。相關(guān)部門已經(jīng)圍繞數(shù)據(jù)安全、模型來源和供應(yīng)鏈風(fēng)險(xiǎn)發(fā)出警告,部分使用中國模型的企業(yè)也受到調(diào)查。即便尚未形成統(tǒng)一限制,政策上的不確定性已經(jīng)足以影響企業(yè)選擇,尤其是涉及政府業(yè)務(wù)和敏感數(shù)據(jù)的公司。
這正是Inkling的市場空間。
它是一款美國公司開發(fā)、采用Apache 2.0許可證、支持私有部署和定制的開放權(quán)重模型。美國企業(yè)選擇它,不必?fù)?dān)心使用中國模型引發(fā)的政治爭議,也更容易通過政府客戶和大型公司的合規(guī)審查。
Inkling真正的價值,來自這種合規(guī)確定性。
穆拉蒂顯然看到了這個正在形成的空缺。
![]()
Thinking Machines吸收DeepSeek和Kimi的公開成果,再把它們轉(zhuǎn)化成一款由美國公司提供的模型。Inkling不需要在所有基準(zhǔn)評測中擊敗中國模型,只需要成為那些不敢繼續(xù)使用中國模型的美國企業(yè)可以接受的選擇。
這也解釋了它為什么敢于更貴。政策替Inkling縮小了競爭范圍,性能和價格上的差距便沒那么致命。對于一些美國企業(yè)來說,一款稍弱、稍貴但風(fēng)險(xiǎn)較低的模型,已經(jīng)足夠。
從這個角度看,Inkling更能證明穆拉蒂懂得做生意。
不過,這套生意成立的代價,可能由美國企業(yè)承擔(dān)。
美國之外的公司仍然可以自由選擇GLM、Kimi和DeepSeek,在更強(qiáng)、更便宜的基礎(chǔ)模型上開發(fā)產(chǎn)品;美國企業(yè)卻可能被迫采用性能稍弱、價格更高的本土替代品。基礎(chǔ)模型的能力差距會繼續(xù)傳遞到微調(diào)后的產(chǎn)品中,最終形成結(jié)構(gòu)性的競爭劣勢。
華盛頓原本希望用限制保護(hù)美國AI公司,結(jié)果可能先替Inkling這樣的“貴替”創(chuàng)造了市場。對穆拉蒂來說,“一般般”已經(jīng)夠了。對美國AI產(chǎn)業(yè)來說,這份“夠用”則意味著成本的升高和競爭力的下降。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.