黃仁勛曾經喜愛有加的DeepSeek,V4版發出之后,將進一步成為其集結的中國之外的開源模型陣營的對手。
還沒等下半年昇騰950超節點規模部署,DeepSeek-V4就開始瘋狂降價,緩存命中的輸入價格已經低到可以用“美元/10億token”來計價了。也許,黃仁勛那個建立開源模型新秩序的計劃,也該加速推進了。
上個月,英偉達發布了Nemotron 3 Super。這是一個1200億總參數規模的模型,它還有一個總參數達4800億的兄弟模型。它就是Nemotron 3 Ultra,一旦正式開源,或將成為美國本土現役最大開源模型。
2026/03/12 完整閱讀 >
另外,同期有媒體曝光,英偉達還有一個未來5年累計投入260億美元投資開源生態的秘密計劃。或許,這個計劃就是后來在GTC 2026上亮相的Nemotron聯盟(Coalition)?
![]()
美國并非沒有開源模型實驗室。相反,數量還不少。仍在嚴肅地發布高質量開源模型的實驗室,至少在20家左右,與中國旗鼓相當。但問題是,它們發布的模型往往總參數規模較小,而且許可條款更為嚴格,導致社區影響力有限。
比如,艾倫AI實驗室的Olmo、Huggingface的SmolLM、LiquidAI的LFM2、ServiceNow的Apriel、斯坦福大學的Marin、IBM的Granite、Moondream的同名模型,甚至還可以算上OpenAI的GPT OSS,以及微軟的Phi、以及谷歌的Gemma。Anthropic從不開源,xAI從來只許諾開源,Meta則從開源走向了閉源。
真正撼動硅谷與華爾街的中國開源模型陣營,正是DeepSeek、Qwen、Kimi、Minimax和GLM等旗艦開源模型。它們也才是“token出海”這一中國敘事的主力。
從這個意義上說,從去年底至今,美國的開源模型生態正在重啟。英偉達與Arcee是典型的活躍分子;Reflection去年融資了20億美元,今年又計劃融資25億美元,對外主打“美國版DeepSeek”的形象。
年初,強調自己是Made in America (美國制造)的Arcee開源了旗艦模型Trinity-Large-Base。這是一個4000億總參數規模的開源模型,基于2048塊英偉達B300預訓練。僅從參數規模來看,它接近2年前Meta發布的Llama-3.1-405B,以及去年Meta發布的Llama-4-Maverick(400B)。尚未發布的Nemotron 3 Ultra,大致也在這個體量。
不過,隨著Meta的2T規模的Behemoth的無限期擱淺,中國開源模型陣營率先進入了萬億參數規模級別。去年至今,包括螞蟻的Ring-1T、Kimi-K2.6(1T)、DeepSeek-V4-Pro(1.6T);此外,GLM-5.1也達到了744B總參數規模。據傳,下半年的Kimi-K3規模在2.5T左右。參數規模無法代表絕對性能差異,但整體上指示了性能擴展的方向。
2026/04/27 完整閱讀 >
黃仁勛深知開源模型的重要性,英偉達正在挑起美國開源陣營的大梁。他曾在他的“五層蛋糕論”里談及,“世界上大多數模型都是免費的。研究人員、初創公司、企業乃至整個國家都依賴開源模型來參與先進的人工智能項目。當開源模型達到技術前沿時,它們不僅僅會改變軟件,還會激活整個技術棧的需求。”
隨著Cursor這樣的“600億美元”估值的初創企業,事實上基于中國開源模型底座訓練了自己的Composer,美國對自己的前沿開源模型的焦慮,有增無減。而DeepSeek在技術報告中“我們在英偉達GPU和華為昇騰NPU平臺上對細粒度EP方案進行了驗證”,再次證明了讓黃仁勛破防的事情,正在緩慢發生。
中國開源模型正在穩步向自主的算力基礎設施上遷移,最令他擔心的是,中國的開源模型跑在以華為為代表的中國GPU系統上,一起走向世界,以高性價比占領世界,美國的閉源模型將會淪為世界的少數和非主流。所以,黃仁勛索性自己下場,在中國之外培育起一個開源模型的生態,它們都將跑在英偉達GPU上和CUDA生態里。
英偉達并非自研開源模型的新軍。在ChatGPT問世后,它開源過不少模型,不過命名相當令人困惑。2023年,它就發布了Nemotron-3-8B,主要用于企業AI服務;到了2024年,Nemotron-4系列發布,包括15B與340B,主要用來合成數據。在2025年底,重新啟動Nemotron-3的番號之前,英偉達還陸續發布過Minitron、Llama-Nemotron、Nemotron-H等模型。
在與美國艾倫實驗室研究員Nathan Lambert對談時,英偉達應用深度學習研究(ADLR)副總裁Bryan Catanzaro稱,之所以構建Nemotron,一方面是公司需要它,去研究與預測未來硬件的突破方向;另一方面則是支持更廣泛的生態,也就是自己業務增長的機會。Bryan曾在2014年在百度與Andrew Ng、Dario Amodei、Awni Hannun和Adam Coates等人共事;在Transformer架構出現后,主導了英偉達的自研模型Megatron-LM。
在Bryan看來,“自下而上的混亂創新”,是Nemotron模型系列早期進展緩慢的主要原因。2025年,他終于與多位負責人高層對齊,統一傳遞了“合在一起更好”的信息。今年1月前后,整合后團隊全職員達到了500人,涵蓋數值量化、語音識別、圖像理解、預訓練、后訓練、RL系統等各個維度。
這個團隊規模,比DeepSeek大多了。據DeepSeek-V4技術報告披露的貢獻者,團隊約有300名研發者、工程師、商業與合規人員。可以說,英偉達目前是美國實力最雄厚的開源模型公司。
但是,過于強大的Nemotron模型,難免讓英偉達的客戶們擔心。于是,黃仁勛開始謀劃開源模型的新秩序。
今年3月,媒體報道稱,英偉達計劃投入260億美元,用于模型開發、算力基礎設施、研究人才,以及“生態系統開發”。當時外界推測,后者可能指合作伙伴關系,甚至是潛在的收購。
隨后,在GTC 2026上,英偉達高調宣布成立Nemotron聯盟。創始成員機構包括:法國的Mistral AI、美國的Reflection AI、印度的Sarvam AI,以及德國的Black Forest Labs(原Stability AI團隊),它們是模型的構建者;以及LangChain與Thinking Machines Lab,屬于開發框架與執行環境的構建者;以及Cursor與Perplexity這樣的AI應用公司。
2026/04/17 完整閱讀 >
Nathan相信,從2027年初開始,美國將在開源模型的采用指標上緩慢收復失地。隨著開源模型競爭變成一場經濟續航能力和快速跟進的游戲,中國陣營會逐步面臨困境。但是,中國速度的放緩,再到趨勢反轉,需要很長時間。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.