![]()
AI 巨頭發新模型,要先過「安檢」了
作者|樺林舞王
編輯|靖宇
6 月 25 日,一條消息在硅谷引起震動——美國政府要求 OpenAI 分階段發布它的最新模型 GPT-5.6。
不是建議,不是「我們希望你考慮一下」,而是白宮網絡安全總監辦公室,和科技政策辦公室聯合提出的正式要求。Sam Altman 在當天的員工 Q&A 上告知團隊,GPT-5.6 將先以有限預覽形式發布給一小批合作伙伴,政府會「逐客戶審批」誰能用。
這在 AI 行業歷史上是頭一遭——美國政府在一款 AI 模型發布前,主動要求公司限制發布范圍。
這不禁讓人想到,AI 領頭羊公司們,未來前沿模型的發布,進入到一個新時代。
01
三周內,兩大 AI 巨頭都「被管了」
時間倒回 6 月 9 日。Anthropic 發布了 Fable 5,這是它有史以來面向公眾推出的最強模型,基于此前只提供給少數合作伙伴的 Mythos 架構。發布當天,科技圈一片興奮。
三天后,興奮變成了錯愕。
6 月 12 日晚 5 點 21 分,由于無法在短時間內按國籍過濾用戶,Anthropic 做了一個無奈但唯一可行的決定——對所有人關閉這兩個模型。
上午還在用的工具,晚上就沒了。直到 6 月 26 日,已經過去整整 14 天,Fable 5 和 Mythos 5 仍然處于下線狀態。有人甚至做了一個網站「Is Fable 5 Back?」來追蹤恢復進度,答案一直是:No。
13 天后,輪到了 OpenAI。只不過這次,政府的動作從「事后追殺」變成了「事前管控」——在 GPT-5.6 正式發布前就介入,要求分階段上線。
兩周之內,美國兩大 AI 公司的最強模型都被納入了政府審查流程。一位知情人士向 Axios 透露了關鍵細節——政府介入不是因為突然變強硬了,而是因為 GPT-5.6 具備「Mythos 級別」的能力。換句話說,「這種級別的模型就會觸發這種流程」。
這不是兩個孤立事件,而是一個新范式正在成型。
02
前沿模型成了管制品
這一切都有跡可循。
6 月 2 日,就在 Anthropic 發布 Fable 5 一周前,特朗普簽署了一份行政令——「促進先進人工智能創新與安全」。這份文件的核心內容是要求聯邦機構在 60 天內(即 8 月 1 日前)設計一個框架,讓前沿 AI 模型開發者在發布前自愿與政府接觸。
幾個關鍵設定值得注意。
第一,政府要求開發者在向「可信合作伙伴」發布前 30 天提供模型訪問權,用于安全評估。第二,由 NSA 局長來決定哪些模型屬于「受管前沿模型」——判定標準是通過一個保密的基準測試流程。第三,這個框架名義上是「自愿」的。
但現實是什么?Anthropic 的 Fable 5 被直接關停,OpenAI 的 GPT-5.6 被要求分階段發布,兩家公司都照做了。正如一位評論者尖銳指出的——當政府提出要求,兩家實驗室都遵從,「自愿框架」就是一個公關措辭更好的強制框架。
OpenAI 自己也承認,這不是他們理想的長期模式,并表示將與政府和行業合作尋找更可持續的方式。但至少在目前,他們選擇了配合。Altman 在內部郵件中說,希望如果審查順利,幾周后就能更廣泛地開放。
站遠一點看,正在發生的事情有一個清晰的底層邏輯——AI 模型的能力一旦越過某條線,它就不再只是一個科技產品,而變成了一種需要管控的戰略能力。
這條線是什么?是網絡安全能力。
Anthropic 在 4 月首次展示 Mythos 時,就明確表示這個模型「太危險了,不能廣泛發布」。它的核心能力是自主發現軟件漏洞——甚至據傳能在數小時內突破高度防護的系統。這正是 Anthropic 建立 Project Glasswing 的原因,只把 Mythos 提供給約 150 家經過審查的合作伙伴。
問題在于,當 Anthropic 推出 Fable 5(Mythos 的公開版本,加了安全分類器來阻止高風險請求),有人找到了繞過安全限制的方法。盡管 Anthropic 認為這個「越獄」很窄、不具普遍性,且其他模型(包括 OpenAI 的 GPT-5.5)也能做到同樣的事,但政府仍然選擇了最嚴厲的應對。
而現在 GPT-5.6 被認為具備同等水平的能力,同樣的流程就被啟動了。
這意味著一個新的產業邏輯正在形成——模型的能力等級決定了它的發布流程。就像藥品有 OTC(非處方)和處方之分,AI 模型也開始出現「自由發布」和「受管發布」的分層。當你的模型強到可以自主發現零日漏洞,它就不再是一個普通的 SaaS 產品了。
03
「更快」不再是唯一的競爭力
對 AI 行業來說,這帶來了一個微妙但深刻的競爭格局變化。
過去幾年,前沿模型的競賽邏輯很簡單——誰先發布更強的模型,誰就贏得市場注意力和開發者信任。速度就是一切。
但當發布需要經過政府審批,速度就不再只取決于訓練速度和工程效率了。競爭優勢從「誰更快」悄悄轉向了「誰更受信任」。
這里有一個值得玩味的細節。在 Fable 5 被關停的同一時間,Anthropic 的 Project Glasswing 仍在正常運行——那些經過嚴格審查的合作伙伴,包括 Google、NVIDIA、微軟等,依然可以使用 Mythos。這說明政府管控的對象不是模型本身,而是分發渠道和使用者。
換言之,在這個新范式下,能力只是入場券,信任才是通行證。
對開發者和企業客戶來說,這帶來了一個非常實際的問題。如果你的核心業務流程依賴某個前沿模型,而這個模型可能因為政府指令在一夜之間下線,你需要怎樣設計你的技術架構?
Fable 5 事件已經給出了教訓。那些把關鍵工作流直接綁定在單一模型上的公司,一夜之間失去了生產力。有人在事后建議,所有使用前沿模型的系統都應該有一個「代理層」,能在模型被撤回時迅速切換到替代方案。這在過去聽起來像是過度設計,現在它變成了基本的風險管理。
04
正在收窄的窗口
還有一個更長遠的影響值得關注。
有人在社交媒體上指出了一個不太被討論的推論——這種管控不會減緩 AI 的研發速度,只會減緩發布速度。實驗室內部擁有的能力和公眾能用到的能力之間的差距,會從此穩步拉大。
以前我們說「AGI 已經在某個實驗室里被開發出來了」,這是一句半開玩笑的話。在新的發布范式下,這可能會在相當長一段時間里成為一個沒法證偽的現實——最強的模型確實存在,但你就是用不到。
8 月 1 日,行政令要求的「受管前沿模型」框架將正式出臺。屆時,什么級別的模型需要經過政府審查、審查流程怎么運作、「可信合作伙伴」如何篩選,都會有更明確的答案。
但方向已經很清楚了。從 Mythos 到 Fable 5 再到 GPT-5.6,AI 模型的發布正在從一個純粹的商業決策,變成一個需要政府背書的「準許可」流程。這不是某一家公司的問題,而是一個產業級的結構性變化。
AI 行業用了十年時間讓全世界相信,這項技術可以改變一切。現在,這個信息似乎被聽進去了——只不過,做出反應的不只是市場。
*頭圖來源:webiano.digital
本文為極客公園原創文章,轉載請聯系極客君微信 geekparkGO
極客一問
你覺得審查 AI 模型發布,
會讓這個行業變得更安全,
還是更慢?
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.