黃仁勛在最新26分鐘訪談中全程沒(méi)提GPU和算力,只談一件事——程序員該從寫(xiě)代碼轉(zhuǎn)向"造Agent"。LangChain用Nemotron 3 Ultra配合Harness優(yōu)化,Deep Agents評(píng)測(cè)追到0.86,與最高分只差0.01,但單次成本從43.48美元壓到4.48美元。模型沒(méi)變,變的是模型周?chē)南到y(tǒng)。
![]()
26分鐘不談GPU:黃仁勛在怕什么?
黃仁勛最新一次公開(kāi)訪談,全程沒(méi)有提起GPU、算力或新模型參數(shù)。
他和LangChain創(chuàng)始人Harrison Chase聊了26分鐘,主題只有一個(gè):當(dāng)Agent開(kāi)始真正替人調(diào)用工具、執(zhí)行流程,企業(yè)該把工程資源放在哪里?
他的答案很直接——少寫(xiě)重復(fù)代碼,多造能把事情做完的Agent。
這不是一句口號(hào)。黃仁勛把寫(xiě)代碼類(lèi)比成打字:打字能力很重要,卻不是作家的全部工作。同樣,寫(xiě)出一段Python仍然重要,但不再等于完成一個(gè)Agent系統(tǒng)。
工程師還要決定Agent能看見(jiàn)什么、能調(diào)用什么、失敗后怎么恢復(fù),以及輸出由誰(shuí)驗(yàn)收。
生成代碼只解決"寫(xiě)出來(lái)"。Agent工程還要解決"跑得動(dòng)、做得對(duì)、出錯(cuò)能停、過(guò)程可追溯"。
Harness:模型外面那層被忽視的"工作臺(tái)"
黃仁勛反復(fù)提一個(gè)詞:Harness。
它包括Prompt、工具說(shuō)明、記憶、上下文管理、任務(wù)拆分、重試、評(píng)測(cè)和權(quán)限控制。模型負(fù)責(zé)推理,Harness負(fù)責(zé)把推理組織成可以驗(yàn)收的工作。
公開(kāi)資料能確認(rèn)的是,LangChain讓Nemotron 3 Ultra運(yùn)行Deep Agents評(píng)測(cè),沒(méi)有重新訓(xùn)練模型權(quán)重,只調(diào)整系統(tǒng)Prompt、工具描述和中間件。
結(jié)果是:評(píng)測(cè)成績(jī)從原始狀態(tài)追到0.86,最高分閉源模型為0.87。
差距只有0.01。
但單次評(píng)測(cè)成本從43.48美元降到了4.48美元——便宜了近10倍。
![]()
這張圖說(shuō)明,同一個(gè)模型放進(jìn)不同Harness,能力會(huì)被釋放到不同程度。比較Agent系統(tǒng)時(shí),只看模型榜單已經(jīng)不夠。
對(duì)開(kāi)發(fā)團(tuán)隊(duì)來(lái)說(shuō),執(zhí)行軌跡開(kāi)始像測(cè)試日志一樣重要。它能告訴你分?jǐn)?shù)丟在哪里,也能把一次偶然失敗變成新的回歸用例。
長(zhǎng)期積累的Prompt、工具接口、軌跡和評(píng)測(cè)集,會(huì)逐漸變成公司的Agent工程資產(chǎn)。
便宜10倍改變的不是賬單,是開(kāi)發(fā)方法
黃仁勛說(shuō),成本下降會(huì)改變開(kāi)發(fā)方法,而不只是讓相同的事更便宜。
Agent完成一次任務(wù)往往要多輪推理、調(diào)用多個(gè)工具,還可能并行嘗試不同路徑。當(dāng)每一次試驗(yàn)都昂貴,團(tuán)隊(duì)就會(huì)主動(dòng)減少評(píng)測(cè)和探索。
便宜帶來(lái)的第一項(xiàng)能力是"多試"——同時(shí)比較模型、Prompt、工具和重試策略。
第二項(xiàng)是"常測(cè)"——把評(píng)測(cè)放進(jìn)日常開(kāi)發(fā)與生產(chǎn)監(jiān)控。
第三項(xiàng)才是"多部署"——把過(guò)去只能服務(wù)少數(shù)高價(jià)值任務(wù)的Agent擴(kuò)展到更多細(xì)分流程。
合理推演是:當(dāng)開(kāi)放模型的Harness調(diào)優(yōu)成本足夠低,企業(yè)會(huì)傾向于"先用前沿模型探路,再把高頻任務(wù)專(zhuān)門(mén)化"。
問(wèn)題剛出現(xiàn)、邊界還不清楚時(shí),前沿模型適合探索上限。任務(wù)反復(fù)出現(xiàn)、驗(yàn)收標(biāo)準(zhǔn)逐漸穩(wěn)定后,再把它收斂成成本更低的專(zhuān)用Agent。
這里的"專(zhuān)門(mén)化"不只發(fā)生在模型權(quán)重里。
真正拉開(kāi)差距的,是公司自己的工具說(shuō)明、業(yè)務(wù)詞匯、權(quán)限邊界、歷史軌跡和驗(yàn)收數(shù)據(jù)。它們共同決定Agent是否理解這家公司。
公司未來(lái)建在Harness上,但密鑰不能直接交給Agent
黃仁勛拋出一個(gè)更激進(jìn)的判斷:未來(lái)的公司會(huì)把越來(lái)越多能力建在Harness上。
過(guò)去,企業(yè)把流程寫(xiě)進(jìn)ERP、CRM和一串固定審批規(guī)則。Agent時(shí)代,部分流程會(huì)變成"給定目標(biāo)、工具、權(quán)限和驗(yàn)收標(biāo)準(zhǔn),再讓系統(tǒng)規(guī)劃路徑"。Harness就是承接這些業(yè)務(wù)規(guī)則的新容器。
這也解釋了為什么開(kāi)放棧被反復(fù)強(qiáng)調(diào)。企業(yè)希望掌握自己的記憶、軌跡、評(píng)測(cè)集和調(diào)優(yōu)數(shù)據(jù),并決定它們運(yùn)行在什么基礎(chǔ)設(shè)施上。
但Agent能調(diào)用終端、數(shù)據(jù)庫(kù)和內(nèi)部API時(shí),已經(jīng)不只是聊天機(jī)器人,而是擁有行動(dòng)能力的軟件進(jìn)程。
NemoClaw藍(lán)圖把Deep Agents Code、Nemotron 3 Ultra與OpenShell運(yùn)行時(shí)組合起來(lái)。模型負(fù)責(zé)推理,Harness負(fù)責(zé)組織任務(wù),OpenShell把代碼執(zhí)行放進(jìn)沙箱,并對(duì)網(wǎng)絡(luò)、憑證、文件和日志分別施加策略。
![]()
黃仁勛的底線很明確:Agent不應(yīng)直接拿到長(zhǎng)期密鑰。更合理的方式是由運(yùn)行時(shí)根據(jù)當(dāng)前任務(wù)和策略臨時(shí)注入權(quán)限,讓Agent只在必要時(shí)間、必要范圍內(nèi)訪問(wèn)必要資源。
落到工程實(shí)現(xiàn),至少要回答四個(gè)問(wèn)題:它以誰(shuí)的身份行動(dòng),哪些命令可以執(zhí)行,失敗后如何停止或回滾,誰(shuí)能復(fù)盤(pán)完整軌跡。
沒(méi)有這些邊界,Agent能力越強(qiáng),風(fēng)險(xiǎn)敞口也越大。
別把Agent當(dāng)同事,它首先是受控軟件
Harrison Chase問(wèn)了一個(gè)敏感問(wèn)題:當(dāng)Agent用自然語(yǔ)言協(xié)作、表現(xiàn)得越來(lái)越像人,我們?cè)撛诙啻蟪潭壬习阉鼣M人化?
黃仁勛的回答很冷靜。自然語(yǔ)言讓交互更順暢,但不應(yīng)模糊責(zé)任邊界。Agent可以擁有角色和名字,卻不能因?yàn)檎Z(yǔ)氣自信就被默認(rèn)正確,也不能因?yàn)?像同事"就跳過(guò)權(quán)限與驗(yàn)收。
判斷Agent是否完成任務(wù),要看外部證據(jù):測(cè)試是否通過(guò)、Diff是否符合預(yù)期、數(shù)據(jù)是否寫(xiě)入正確位置、審批記錄是否完整。
它說(shuō)"已經(jīng)完成",只是一個(gè)待驗(yàn)證的輸出。
擬人化可以幫助團(tuán)隊(duì)理解協(xié)作關(guān)系,但工程管理必須保持去人格化:每一次工具調(diào)用都有身份,每一次高風(fēng)險(xiǎn)動(dòng)作都有策略,每一個(gè)最終結(jié)果都有驗(yàn)證器。
社區(qū)傳聞稱(chēng),部分企業(yè)已經(jīng)在嘗試讓Agent擁有"虛擬員工編號(hào)"和"匯報(bào)關(guān)系"。但公開(kāi)資料能確認(rèn)的是,這些做法目前仍停留在實(shí)驗(yàn)階段,尚未形成行業(yè)共識(shí)。
程序員的工作清單正在重排
黃仁勛對(duì)就業(yè)問(wèn)題的判斷延續(xù)了他一貫的供給邏輯:當(dāng)生產(chǎn)一項(xiàng)數(shù)字服務(wù)的成本下降,社會(huì)不會(huì)只滿足于原來(lái)的數(shù)量,而會(huì)產(chǎn)生更多此前做不起、排不上優(yōu)先級(jí)的需求。
對(duì)程序員而言,真正變化的不是"還有沒(méi)有代碼",而是工作清單的重排。
樣板代碼、格式轉(zhuǎn)換和重復(fù)調(diào)試會(huì)更多交給Agent。任務(wù)定義、系統(tǒng)設(shè)計(jì)、評(píng)測(cè)構(gòu)建、權(quán)限治理和異常處理會(huì)變得更重要。
這份判斷并不保證每個(gè)崗位都原樣保留。軟件供給擴(kuò)大以后,新的工作會(huì)從"親手完成每一步"轉(zhuǎn)向"設(shè)計(jì)一套能持續(xù)完成任務(wù)的系統(tǒng)"。
個(gè)人是否受益,取決于能不能跨過(guò)這次職責(zé)遷移。
最后缺的不是模型,是一整套Agent棧
把黃仁勛的訪談拼成一張工程全景圖:
模型負(fù)責(zé)推理,Harness負(fù)責(zé)計(jì)劃、記憶和工具,運(yùn)行時(shí)負(fù)責(zé)隔離與執(zhí)行,Evals和Guardrails負(fù)責(zé)判斷結(jié)果能否交付。
少任何一層,Agent都可能只停在演示階段。
![]()
這套結(jié)構(gòu)也給出了團(tuán)隊(duì)的實(shí)施順序:先用真實(shí)任務(wù)建立評(píng)測(cè),再讓模型和Harness跑起來(lái);隨后補(bǔ)足沙箱、身份、日志和人工接管;最后才討論規(guī)模化部署與成本優(yōu)化。
模型會(huì)繼續(xù)變強(qiáng),但企業(yè)真正需要長(zhǎng)期經(jīng)營(yíng)的,是模型周?chē)翘着c自身數(shù)據(jù)、工具和責(zé)任邊界綁定的工程環(huán)境。
黃仁勛所說(shuō)的Harness,可能就是下一代軟件公司最核心的一層基礎(chǔ)設(shè)施。
結(jié)語(yǔ)
黃仁勛這次訪談最值得關(guān)注的地方,在于他把討論從"哪個(gè)模型更強(qiáng)"拉回到了"系統(tǒng)怎么搭"。
LangChain的評(píng)測(cè)數(shù)據(jù)提供了一個(gè)具體樣本:0.86對(duì)0.87,4.48美元對(duì)43.48美元。差距不在模型,在Harness。
當(dāng)Agent從Demo走向生產(chǎn),企業(yè)競(jìng)爭(zhēng)的核心會(huì)從"用了什么模型"轉(zhuǎn)向"能不能把自己的業(yè)務(wù)流程、權(quán)限邊界和驗(yàn)收標(biāo)準(zhǔn),穩(wěn)定地裝進(jìn)一套可迭代、可評(píng)測(cè)、可追責(zé)的系統(tǒng)里"。
Harness就是那個(gè)容器。誰(shuí)先把它建起來(lái),誰(shuí)就能讓Agent真正入職,而不是只停留在聊天窗口里。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶(hù)上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.