GPT-5.5不過是一個小版本的更新,就是為了頂住Claude 4.7 和 Mythos最近的勢頭。但是,它背后的套路更深。
GPT-5.5標志著前沿模型之間的競爭,正在進入模型/芯片協同設計、系統競爭的時代。黃仁勛已經在英偉達內部要求大家使用Codex,就在GPT-5.5發布之前,英偉達各部門超過1萬人已經通過Codex體驗了它。
現在,硅谷每家科技大廠、每家前沿AI實驗室,都需要一個自己的智能體編碼工具,因為用AI研發AI,用AI提升效率,將對競爭起到決定性的作用。所以,最近谷歌的創始人都跳出來,要求建立突擊隊迎頭趕上Claude Code。馬斯克也與Cursor達成了價值600億美元的收購權交易——微軟也動過這個念頭。
2026/4/22 >閱讀全文
2026/04/22>閱讀全文
OpenAI和英偉達一直是早期芯片和協同設計合作伙伴:OpenAI 提供反饋,為英偉達的硬件路線圖提供信息;反過來,OpenAI 也能夠提前獲得新架構的使用權。這種合作關系達到了一個新的里程碑,雙方共同搭建了首個 GB200 NVL72 10 萬 GPU 集群。完成了多次大規模訓練運行,英偉達稱其在前沿規模上樹立了系統級可靠性的新標桿。
”GPT-5.5 就是該基礎設施全力運行的產物。 “
OpenAI透露,Codex和GPT-5.5在協同設計中也發揮了重要的作用,AI幫助改進了為自己服務的底層架構。
為了以 GPT-5.4 的延遲運行 GPT-5.5,OpenAI需要將推理過程重新定義為一個集成系統,而非一系列孤立的優化。
GPT-5.5 的設計、訓練和運行都與英偉達GB200 和 GB300 NVL72 系統緊密結合。Codex 幫助團隊更快地將想法轉化為可基準測試的實現,包括繪制草圖、搭建實驗流程,以及幫助確定哪些優化值得深入投入。GPT-5.5 則幫助發現并實現了技術棧本身的關鍵改進。
Codex 和 GPT-5.5 在實現性能目標的過程中發揮了至關重要的作用。其中一項改進是負載均衡和分區啟發式算法。在 GPT-5.5 之前,加速器上的請求被分割成固定數量的塊,以平衡計算核心之間的工作負載,確保大小請求都能在同一 GPU 上運行。然而,預先確定的靜態塊數量并非適用于所有流量模式。為了更好地利用 GPU,Codex 分析了數周的生產流量模式,并編寫了自定義啟發式算法來優化工作負載的分區和平衡。這項工作產生了巨大的影響,token生成速度提高了 20% 以上。
英偉達負責企業AI的副總裁博塔諾(Justin Boitano)則強調了協同設計中的效率提升:
“調試時間從幾天縮短到幾小時,并將復雜代碼庫中數周的實驗成果轉化為一夜之間取得的進展。這不僅僅是編碼速度的提升,更是一種全新的工作方式,它能幫助人們以截然不同的速度開展工作。”
為了下一代 AI 基礎設施,OpenAI已經承諾部署10 吉瓦的英偉達系統,未來幾年,OpenAI 模型訓練和推理,將跑在數百萬個英偉達GPU 上。
重視開放權重模型的英偉達,也把OpenAI gpt-oss 開源權重模型納入其生態,為英偉達TensorRT-LLM 和包括 vLLM 和 Ollama 在內的生態系統框架優化了模型權重。
英偉達和 OpenAI長達十余年的、整個AI技術棧領域的密切合作,意味著黃仁勛將會全力支持OpenAI與Anthropic的競爭。
![]()
被黃仁勛買到麾下的Groq創始人羅斯(Jonathan Ross),也把GPT-5.5歸功于英偉達的GB200 NVL72 訓練,”真是立大功了!“
就在昨天,谷歌云在Next活動上發布了第八代TPU:用來訓練的8t,和用來推理的8i。這是用來訓練下一代Gemini,而且用訓練和推理的分離,直接藐視通用GPU,也順便藐視了羅斯,他號稱是LPU和TPU雙料創始人。
2026/4/23>閱讀全文學
去年底,第六代TPU訓練出來的Gemini 3,已經碾壓了GPT-5。現在,英偉達要用GB200/300,通過GPT5.5實現復仇。可以期待的是,8t/8i將全面硬杠Vera Rubin/LPU的訓練和推理。
那么,GPT-5.5實現翻盤了嗎?業內都留意到打榜分數都是與Claude-4.7對比,而大魔頭Mythos則神秘地躲在”玻璃門“后面。
可以看出GPT-5.5 在 軟件工程SWE-Bench-Pro 這項評測上仍然落后,但在終端智能體 TerminalBench 2.0 和網絡安全智能體 CyberGym 上表現突出。
也就是說,GPT-5.5 在真實開源代碼庫里的長鏈條軟件工程任務上不是最頂尖,但它在終端上連續操作完成任務和網絡安全攻防/漏洞分析這兩類更偏 agent、環境交互和實戰鏈條的評測上較強。 它的強項可能更偏工具使用、環境操作和安全任務。
![]()
GPT 5.5所體現的token經濟學,是GPT-5.5 不僅更加智能,而且解決問題的效率更高,通常能以更少的token和更少的重試次數獲得更高質量的輸出。在人工智能分析的編碼指數 (AIA) 中,GPT-5.5 以競爭對手前沿編碼模型一半的成本,提供了最先進的智能。
![]()
就在谷歌稱其75%的代碼由AI生成之后,OpenAI也宣布超過85%的員工在使用Codex,包括軟件工程、財務、溝通、市場營銷、數據科學和產品管理在內的各個部門。
在溝通部門,團隊利用 Codex 中的 GPT-5.5 分析了六個月的演講請求數據,構建了評分和風險評估框架,并驗證了一個自動化的 Slack 智能體,從而可以自動處理低風險請求,而高風險請求仍然需要人工審核。在財務部門,團隊使用 Codex 審核了 24,771 份 K-1 稅表,總計 71,637 頁。他們采用的工作流程排除了個人信息,幫助團隊比上一年節省了兩周時間。在市場推廣團隊,一名員工實現了每周業務報告的自動化生成,每周節省了 5-10 小時。
甚至OpenAI這位研究科學家,分享了他動動嘴讓5.5干活、自己的”朋友和男朋友“一起外出度周末的體驗。
![]()
”假期里,我對著 5.5 口述了幾分鐘,描述了一個新的、很有野心的強化學習訓練項目。點了發送之后,我就把這事忘了,接著和朋友還有男朋友一起玩了幾天。周一回來時,一個工業規模的強化學習訓練任務已經在那兒嗡嗡跑著了,它已經連續運行了 31 個小時。“
那么,這個周末之后,是不是輪到我們的DeepSeek V4了?也期待它與中國自主芯片系統的協同設計,帶來驚喜。
參考:
https://openai.com/index/introducing-gpt-5-5/
https://blogs.nvidia.com/blog/openai-codex-gpt-5-5-ai-agents/?linkId=100000419058977
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.