![]()
"I've joined Anthropic."
Andrej Karpathy 發(fā)出了這條推文,這位頂級(jí)研究員的這條推文,像極了邁克爾·喬丹當(dāng)年喊出的那句I”m back 。
![]()
他寫道:"未來幾年在 LLM 前沿會(huì)格外關(guān)鍵(especially formative),我非常興奮地加入這里的團(tuán)隊(duì),回到研發(fā)(get back to R&D)。"
這是一個(gè)頂級(jí)研究員對(duì)自己未來三五年的明牌下注。
而他下注的位置,正好是過去一年整個(gè) AI 圈最不敢押的那一格——pre-training(預(yù)訓(xùn)練)。
Karpathy是誰
Karpathy為何傳奇,源自于他經(jīng)歷了 AI 發(fā)展的每個(gè)關(guān)鍵節(jié)點(diǎn)和他的夢(mèng)幻履歷。
2015 年,Karpathy 拿到 Stanford 的 PhD,同年加入 OpenAI,是那 11 個(gè) founding members 里最年輕的一個(gè)。
作為OpenAI創(chuàng)始核心成員,他深度參與初代大模型底層架構(gòu)搭建,是GPT技術(shù)體系的早期開拓者,奠定了生成式AI的發(fā)展根基。入局特斯拉后,他掌舵自動(dòng)駕駛AI團(tuán)隊(duì),一手搭建純視覺Autopilot體系,讓智能駕駛實(shí)現(xiàn)規(guī)模化落地,成為全球視覺自動(dòng)駕駛路線的標(biāo)桿。
離開特斯拉后,他二度回歸OpenAI深耕大模型訓(xùn)練技術(shù),后續(xù)獨(dú)立創(chuàng)業(yè)探索AI教育賽道。其打造的Vibe Coding范式、CLAUDE.md開發(fā)規(guī)范風(fēng)靡全球,斬獲數(shù)十萬GitHub星標(biāo),成為開發(fā)者通用標(biāo)準(zhǔn),是公認(rèn)的技術(shù)頂流與行業(yè)啟蒙者。
也就是說,他離開過 OpenAI 兩次。一次去了 Tesla,一次去做了自己的公司。這次沒有回 OpenAI——他選了 Anthropic。
Anthropic 過去十年招人的故事一直是一條線——OpenAI 安全派出走。Dario、Tom Brown、Jared Kaplan、Sam McCandlish 全是這一脈,價(jià)值觀分歧,集體離開,自立門戶。這套敘事講了五年,已經(jīng)講到 Anthropic 自己都有點(diǎn)疲憊。
Karpathy 完全不在這條線上。他不是因?yàn)榘踩制缱叩模?OpenAI 創(chuàng)始成員里"工程能力派"的圖騰——nanoGPT、llm.c、CS231n、Tesla AI Day——他幾乎是過去十年"用愛發(fā)電的頂級(jí)研究員"的代名詞。他這次不回 OpenAI、不去 SSI、不去給 Mira Murati 的 Thinking Machines 站臺(tái)、也不去 xAI,最終選了 Anthropic。
這意味著:"現(xiàn)在做前沿 LLM R&D 的最佳去處"這件事,被一個(gè)安全敘事中立、純粹從研究角度做判斷的頂級(jí)研究員蓋了一個(gè)章。
這張蓋章的殺傷力,超過 Anthropic 過去任何一次招人。它打的不是 OpenAI 的人才厚度,打的是 OpenAI 作為"研究公司"的招牌——你的創(chuàng)始人都覺得我們這兒更適合做研究,你怎么還自稱研究公司?
至于他自己掛念的 Eureka 和教育,他在推文最后留了一句"plan to resume my work on it in time"——會(huì)在合適的時(shí)間回來做。換句話說:當(dāng)下不是合適的時(shí)間。
他選了技術(shù),而非資本
這次跳槽的真正意義,是他被放在了 pre-training 團(tuán)隊(duì)。
不是最近一年所有人都在追的 agent,是 pre-training——那個(gè)定數(shù)據(jù)配方、定 scaling law、定訓(xùn)練穩(wěn)定性、決定 Claude 模型本體能力上限的位置。
并沒有選擇最火熱的 agent 賽道,Anthropic 是要進(jìn)一步提升基礎(chǔ)模型能力。
過去這一年半,整個(gè) AI 圈的資本敘事都在往后訓(xùn)練那邊跑。"Pre-training is hitting a wall"——這句話從 2024 年下半年開始在 NeurIPS 走廊里傳,到 2025 年初變成 The Information 的封面文章,再到 Ilya Sutskever 自己在公開訪談里說"我們認(rèn)識(shí)的那種 pre-training 時(shí)代正在結(jié)束",整個(gè)圈子已經(jīng)形成了某種默契:scaling law 的邊際效用在下降,下一波突破要看 RL post-training、要看 inference-time compute、要看 agent 的復(fù)合工作流。
Karpathy 在這個(gè)時(shí)間點(diǎn)選 pre-training,等于把自己作為研究員的 reputation 押在反方向上。他沒有寫一篇長(zhǎng)博客論證 pre-training 還有空間,他用職業(yè)選擇直接表態(tài)——而以他在圈內(nèi)的信用,這個(gè)表態(tài)比任何論文都更有說服力。
要理解這件事的含金量,得知道 Karpathy 不是普通的 ML 研究員。他是少數(shù)把"大規(guī)模訓(xùn)練工程的臟活"和"LLM 第一性原理的直覺"打通的人
nanoGPT 這種把 GPT 訓(xùn)練濃縮到幾百行 Python 的項(xiàng)目,需要對(duì)訓(xùn)練棧每一層的取舍都有判斷;llm.c 把整個(gè) LLM 訓(xùn)練用 C 寫出來,更是把 abstraction 全部剝光的工作。他在 Tesla 跑過一支幾十人的工程團(tuán)隊(duì),做過工業(yè)級(jí)的端到端訓(xùn)練管線。這種"既懂細(xì)節(jié)又懂系統(tǒng)、既能寫論文又能壓成本"的人,全行業(yè)不超過十個(gè)。
Anthropic 把他放在 Nick Joseph 下面而不是給一個(gè) VP 頭銜,姿態(tài)也很務(wù)實(shí)——說明 Karpathy 自己也愿意從執(zhí)行做起。
短期里這意味著不會(huì)有立竿見影的產(chǎn)出,pre-training 周期長(zhǎng),加入磨合期至少半年,他真正進(jìn)入下一代 Claude 的訓(xùn)練管線,得看 2027 年。
但中長(zhǎng)期,這是一張 Anthropic 押在"pre-training 還有大空間"上的超級(jí)籌碼。
對(duì) Anthropic 的更深一層影響
人才戰(zhàn)只是表面那一層。
這次人事變動(dòng)對(duì) Anthropic 真正的意義,是把它的研究文化敘事推到了一個(gè) OpenAI 短期內(nèi)追不回來的位置。
過去一年,OpenAI 的敘事重心被產(chǎn)品徹底帶走了。ChatGPT 進(jìn)入九億周活、Sora 2 上線、Agent SDK、GPT-5 系列——這些都是商業(yè)上漂亮的成績(jī),但代價(jià)是 OpenAI 已經(jīng)很難再被外界叫做"研究公司"了。它的研究故事被產(chǎn)品故事蓋過去,連內(nèi)部研究員都在抱怨這件事。
Anthropic 選擇了另一條路。它沒有 to C 現(xiàn)象級(jí)產(chǎn)品,沒有 Sora 那種破圈的發(fā)布會(huì),Claude 在普通用戶里的認(rèn)知度始終落后 ChatGPT 一個(gè)數(shù)量級(jí)。但它一直在守一件事——"我們是科學(xué)公司"。
Dario 在公開訪談里講 mechanistic interpretability、講 Claude 的訓(xùn)練哲學(xué),比講營(yíng)收講得多得多。
這套敘事的最大短板,是缺少一個(gè)"非 Anthropic 出身"的頂級(jí)研究員來背書。你不能讓 Dario 自己一直講,那像自賣自夸。
Karpathy 補(bǔ)上了這塊拼圖。
他在中英文世界對(duì)"研究文化"的想象里,是最大公約數(shù)。nanoGPT 是開源的、CS231n 是免費(fèi)的、他的 YouTube 課是給所有人看的——他幾乎是過去十年里"用愛發(fā)電的頂級(jí)研究員"的代名詞。這種品牌資產(chǎn)沒有任何 Anthropic 內(nèi)部員工能替代,因?yàn)檫@是十年時(shí)間沉淀出來的。
接下來一年,Anthropic 在融資、在招人、在面向 enterprise 客戶講故事的時(shí)候,"Karpathy 在我們 pre-training 團(tuán)隊(duì)"會(huì)被反復(fù)說出來。它帶來的不只是一個(gè)研究員的產(chǎn)出,更是一種關(guān)于"Anthropic 是什么樣的公司"的敘事重新校準(zhǔn)。
而在中文圈,這件事的放大效應(yīng)會(huì)更猛。Anthropic 在中國市場(chǎng)的位置一直很尷尬——產(chǎn)品不可用,但開發(fā)者文化里被廣泛閱讀。Karpathy 加入會(huì)讓中文開發(fā)者社區(qū)進(jìn)一步把心智傾斜過來,而這恰恰是 OpenAI 長(zhǎng)期忽視的池子。
當(dāng)然,我們確實(shí)也很難指望 Anthropic 會(huì)傾向中文社區(qū)。
OpenAI 的“創(chuàng)始人魔咒”
Karpathy 這次跳槽,會(huì)讓一個(gè) OpenAI 不愿意再被討論的問題再次被翻到臺(tái)面上:OpenAI 11 位 founding members 里,還在公司的還有幾個(gè)
![]()
數(shù)一下:Ilya Sutskever 去了 Safe Superintelligence,Mira Murati(雖然不是 founding member,但屬于早期核心)帶隊(duì)成立了 Thinking Machines,John Schulman 去了 Anthropic 又跳到 Thinking Machines,Wojciech Zaremba 還在,Sam Altman 還在,剩下的要么沉寂、要么早就走了。
Karpathy 八年前就走過一次,這次去 Anthropic 不算二次出走,但媒體框架一定會(huì)把這件事和"OpenAI 創(chuàng)始人外流"那條線串起來。
更刺的是,他選擇了 Anthropic 而不是回 OpenAI、不是去 SSI、不是給 Thinking Machines 站臺(tái)、也不是去 xAI。在所有可能的去處里,他選了 OpenAI 最直接的對(duì)家。
Sam 這次怎么回應(yīng)——或者怎么不回應(yīng)——是個(gè)值得盯的窗口。
一個(gè)更大的命題是:頂級(jí)研究員還能不能創(chuàng)業(yè)?
Karpathy 自己的經(jīng)歷種,藏著一個(gè)對(duì)所有"想 fork 一家 AI 公司"的研究員都不友好的信號(hào)。
他離開 OpenAI 二次,是去做 Eureka Labs。這家公司的方向他自己講得很清楚——用 LLM 重新做教育。他寫過 LLM 101,做了一年多的產(chǎn)品和課程實(shí)驗(yàn),沒有拿大輪融資,也沒有出現(xiàn)某種現(xiàn)象級(jí)產(chǎn)品。然后他選擇回到大廠。
把這件事和最近一兩年的其他案例放在一起看:Mira Murati 的 Thinking Machines 估值傳出 100 億美元但產(chǎn)品還沒影;Ilya 的 SSI 估值更高,對(duì)外完全沉默;David Luan 的 Adept 賣給了 Amazon;Inflection 整建制被 Microsoft 收走。
一個(gè)隱隱的結(jié)構(gòu)性問題在浮出來:當(dāng)算力護(hù)城河每六個(gè)月再深一點(diǎn),當(dāng)大廠的薪酬包能開到八位數(shù)美元,當(dāng)主戰(zhàn)場(chǎng)感全部集中在三五家手里,AI 頂級(jí)研究員的"創(chuàng)業(yè)最優(yōu)解"是不是已經(jīng)沒了
Karpathy 用腳投票了。他不是創(chuàng)業(yè)失敗——Eureka 沒關(guān),他也沒融崩——他只是判斷:當(dāng)前階段,AI 最大的杠桿點(diǎn)是模型本身,不是普及,不是教育,不是任何外圍。他要回到那個(gè)杠桿點(diǎn)上。
對(duì)所有正在考慮"我要不要 spinoff 自己出來做"的頂級(jí)研究員來說,這個(gè)信號(hào)是冷的。
那些被忽略的
回到他原推文里最后一句,那句幾乎所有報(bào)道都沒怎么展開的話——
"I remain deeply passionate about education and plan to resume my work on it in time."
"我對(duì)教育依然抱有熱情,會(huì)在合適的時(shí)間回到這件事上。"
這句話表面上是給 Eureka 留個(gè)體面的尾巴,但讀懂了它,會(huì)發(fā)現(xiàn)這是整條推文里最重的一句。
因?yàn)樗臐撆_(tái)詞是:當(dāng)下不是合適的時(shí)間
一個(gè)親手做了一年多 AI 教育的研究員,公開承認(rèn)現(xiàn)在不是做這件事的時(shí)候。這對(duì)所有"AI + 教育"賽道的創(chuàng)業(yè)者來說,是一個(gè)不愿意被讀出來但讀出來就很傷的判斷——AI 已經(jīng)強(qiáng)到可以重塑教育嗎?不夠。教育市場(chǎng)已經(jīng)準(zhǔn)備好被 LLM 重塑了嗎?也不夠。在這兩個(gè)"不夠"之間,他選擇回到上游,先讓模型本身再往前推一步。
這是一個(gè)頂級(jí)研究員對(duì)當(dāng)下階段最誠實(shí)的判斷:未來幾年最有杠桿的位置,是把 LLM 本身往前推。其他一切——教育、agent、應(yīng)用、產(chǎn)品——都得等模型本體跨過下一個(gè)臺(tái)階。
如果他是對(duì)的,下一代 Claude 會(huì)證明他是對(duì)的。如果他錯(cuò)了,整個(gè)圈子會(huì)因?yàn)樗e(cuò)而集體松一口氣——因?yàn)槟且馕吨?pre-training 真的撞墻了,所有人在 RL 和 agent 上的押注是對(duì)的,賽道格局會(huì)更分散,機(jī)會(huì)會(huì)更多。
但 Karpathy 用他過去十年的判斷力告訴我們:他不是經(jīng)常錯(cuò)的那種研究員。
而 Anthropic,剛把他簽了下來。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.