2026年7月18日,在2026世界人工智能大會(WAIC)上,商湯科技正式發(fā)布了大模型家族的重量級旗艦新品——SenseNova U1 Pro(以下簡稱U1 Pro)。
作為“日日新 SenseNova U”系列的旗艦版本,U1 Pro 定位為面向長程任務的交付級原生多模態(tài)智能體基座,實現理解、生成和行動的深度統(tǒng)一。在原生統(tǒng)一架構的基礎上,通過在視覺創(chuàng)作領域的深度迭代,U1 Pro 具備了媲美全球頂尖模型的“交付級”復雜圖片創(chuàng)作能力,擁有廣闊的應用空間
U1 Pro的問世,標志著多模態(tài) AI 正在迎來一場深刻的“長程演進”:行業(yè)正式告別傳統(tǒng)的“單點式內容生成(Generation)”,全面邁向能夠閉環(huán)完成復雜、長程任務的“系統(tǒng)級內容交付(Delivery)”新時代。
訪問SenseNova U1 Pro官網:https://www.sensenova.cn/u1-pro
多模態(tài)演進第三階段:攻克“抽卡”痛點,定義“交付級”新標準
正如代碼產品已率先走通了“從 Copilot 工具輔助,到 Vibe Coding 意圖驅動,再到 Agentic Coding 系統(tǒng)級任務交付”的路徑,多模態(tài)產品也正在經歷相同的長程演進:第一階段解決“真實感生成”的問題,到第二階段能夠以自然語言交互,并持續(xù)修改,實現多模態(tài)創(chuàng)作進階,再到第三階段能在真實場景中,直接完成“交付級”創(chuàng)作,完美兼顧設計美感和內容精準,解決反復抽卡的困境。
然而能交互,不等于能交付。旗艦版SenseNova U1 Pro圍繞“一個復雜目標,持續(xù)理解、規(guī)劃、執(zhí)行、檢查和修正”,帶來了四大核心交付能力:
·巔峰設計美感,告別“AI味”:圖像生成從“細節(jié)逼真”推進到“專業(yè)設計美感”的全新階段,作品具備極強的構圖、色彩與排版美學,直接實現專業(yè)交付品質。
·原生 8K 超清輸出:最高可支持8K 原生分辨率輸出,輕松駕馭高信息密度的超長、超大圖創(chuàng)作。畫幅放大后,文字、線條、圖標和模塊關系仍然清晰穩(wěn)定,經得起印刷、展覽級細節(jié)檢驗。
·極致的圖文與細節(jié)控制:大幅加強了圖文信息整合分析能力。在極高信息密度下,U1 Pro 仍能維持整體版式與內容表達,文字渲染出錯率極低。
·長程 Agentic 閉環(huán)思維:基于統(tǒng)一基座內生的理解、生成和行動能力,支持長程圖文交錯思維,能夠圍繞復雜目標進行數十輪的Agentic Generation Loop(智能體生成循環(huán))。并在最新版本中,進一步實現了整體風格與局部文本的同步精準可控編輯,讓交付結果可被持續(xù)修改與使用。
技術基石:NEO-unify 架構與原生視覺底座的深度融合
SenseNova U1 Pro 之所以能夠突破“生成”邊界、走向“穩(wěn)定交付”,其底層核心得益于NEO-unify 內核架構在原生多模態(tài)體系中實現語言和視覺的統(tǒng)一表征,打破了理解與生成的割裂壁壘。
商湯今年4月開源了基礎模型 SenseNova U1。開源兩個多月以來,在真實高強度工作流實踐中,U1 迎來了爆發(fā)式增長。今年6月,U1的用戶人均日生圖量相比5月提升近3倍,表明模型已深度切入真實應用工作流。截至7月中旬,SenseNova U1以及集成了U1能力的SenseNova-Skills代碼庫在GitHub的總Star 數突破8000。
同時,商湯開源的SenseNova-Vision 統(tǒng)一視覺大模型,基于原生統(tǒng)一架構,讓經典視覺任務如實例分割、目標檢測等,直接成為通用大模型的原生能力,告別了傳統(tǒng)“多專家模型拼湊”的局限。商湯在視覺 AI 領域十余年的技術沉淀,也為多模態(tài)長程智能體提供了堅實的世界理解底座。
![]()
超稠密物體分割:重疊魚群各顯其形
![]()
看穿鏡面反射:正確還原空間幾何
![]()
零樣本泛化:未知游戲“一秒讀懂”
![]()
突破視覺錯覺:不看表象,洞察空間本質
真實物理世界大考:高難度場景實戰(zhàn)檢驗
在考驗其面向復雜多模態(tài)任務的“系統(tǒng)級交付”實力中,SenseNova U1 Pro 在美學敘事、邏輯控制以及硬核數據推理三大高難度場景,交出了驚艷的答卷:
高信息密度視覺敘事:WAIC九周年《智會世圖》東方山水長卷
U1 Pro 最終交付了一幅4:1 超寬畫幅的宣紙水墨風東方美學長卷,圖中包含豐富的河流、山脈、城市地標與高密度小字信息,遠看具備“統(tǒng)一視覺敘事”,放大后看大量文字、圖標等設計細節(jié)完美支撐,自然連接起2018 至 2026 年跨越九年的世界人工智能大會發(fā)展歷程。
![]()
![]()
![]()
WAIC九周年(2018-2026)水墨長卷全景,及部分局部細節(jié)圖。
可控視頻創(chuàng)作:《沙影之刃》世界觀設定與 22 鏡分鏡
在復雜視頻創(chuàng)作任務中,模型不再只是依靠隨機抽卡拼湊鏡頭,而是率先自主規(guī)劃并生成了包含劇情世界觀、主角與敵人人設、服裝武器、沙漠環(huán)境色調在內的整體視覺藍圖,并一次性輸出多達22 個邏輯一致的連續(xù)分鏡。在此基礎上,配合商湯視頻工具,實現了人物、劇情和視覺語言的高度可控交付。
![]()
《沙影之刃》世界觀設定&22鏡分鏡總覽
硬核邏輯推理與復雜交付:世界杯黑馬預測與決賽全景復盤
商湯“小浣熊”依托專屬 Skills 進行持續(xù)分析,在2026年世界杯開賽前一個月,成功預測本屆最大黑馬——佛得角出線,在 12 家參與預測的大模型中高居第二。
同時,U1 Pro 展現了極強的“數據向視覺轉化”能力。它能將復雜的體育戰(zhàn)術及數據——如世界杯決賽雙方的晉級路徑、核心球員對位、戰(zhàn)術體系、傳球網絡及觸球熱力圖等高密度推理結果融會貫通,自主生成一張高清的可視化圖表報告,完整閉環(huán)了“信息搜集-分析推理-復雜視覺交付”的全流程。
![]()
賦能生產力底座:重塑個人、組織與企業(yè)單元
作為一個極具通用性的多模態(tài)基座,SenseNova U1 Pro 正在重塑辦公、電商、教育等每一個生產單元:
·商業(yè)與辦公:企業(yè)信息圖、高品質商業(yè)演示文稿(PPT)的自動化與精準交付。
·品牌與電商:商業(yè)海報、產品宣傳視覺的專業(yè)級美學輸出。
·教育與出版:高精度科學圖解、教學用圖像的無錯漏繪制。
·創(chuàng)意內容創(chuàng)作:電影影視概念設計、動漫分鏡腳本等數字藝術創(chuàng)作,大幅縮短創(chuàng)意與專業(yè)制作之間的距離。
同時,該能力在商湯旗下的產業(yè)級AI “小浣熊” 及視頻創(chuàng)作工具 “Seko” 中已得到深度驗證,幫助數以千萬計的個人用戶、接近一萬家企業(yè)用戶以及大批AI原生組織,將自身經驗、興趣和創(chuàng)意轉化為可規(guī)模化復用的真實交付成果。
即日起,商湯科技 SenseNova U1 Pro 的預覽版本已正式邀請測試,并將隨著推理服務資源擴大逐步放開邀測范圍。模型的正式版本將在今年 8 月份正式上線對公眾開放服務,屆時相應的定價和 API 服務也將同步推出。
我們相信在“理解、生成、行動”原生統(tǒng)一架構下,“視覺和語言的聯合涌現”將加速實現,最終為物理世界的 AGI 構建全新的通用智能底座。
更多U1 Pro創(chuàng)作作品:
1、商業(yè)信息表達:突出復雜信息“一圖說清”、文字與圖像細節(jié)可靠,以及可直接用于匯報和交付的完成度。
![]()
商業(yè)建筑視覺
![]()
AI 模型技術信息圖
![]()
產品裝配說明
2、商業(yè)視覺創(chuàng)作:突出從“像”到“真”再到“美”的專業(yè)級設計能力,優(yōu)先選擇視覺中心明確、色彩強、版式完整的商業(yè)海報與產品視覺。
金魚時尚海報
![]()
泉州城市旅行海報
3、科普知識圖解:突出復雜知識可視化、圖文信息整合、清晰標注與出版級細節(jié);畫面放大后仍能展示可靠的信息質量。
![]()
固態(tài)電池科學圖解
![]()
旅游攻略圖
![]()
知識信息圖
![]()
美食打拋飯信息圖
![]()
黑白攝影專業(yè)教程
![]()
科普知識長圖
4、影視動漫與數字藝術:突出角色概念、世界觀設定、電影感場景,以及 8K 原生與超長超大圖創(chuàng)作能力;優(yōu)先用于視頻開場、橫向運鏡和高潮鏡頭。
![]()
超長國風景觀畫卷|連續(xù)場景適合橫向推進,直接體現超長超大圖能力
![]()
孫悟空動態(tài)概念圖
![]()
動漫角色設定圖
關于商湯
作為人工智能軟件公司,商湯科技以“堅持原創(chuàng),讓AI引領人類進步”為使命,旨在持續(xù)引領人工智能前沿研究,持續(xù)打造更具拓展性更普惠的人工智能軟件平臺,推動經濟、社會和人類的發(fā)展,并持續(xù)吸引及培養(yǎng)頂尖人才,共同塑造未來。
商湯科技擁有深厚的學術積累,并長期投入于原創(chuàng)技術研究,不斷增強行業(yè)領先的多模態(tài)、多任務通用人工智能能力,涵蓋感知智能、自然語言處理、決策智能、智能內容生成等關鍵技術領域,同時包含AI芯片、AI傳感器及AI算力基礎設施在內的關鍵能力。
商湯科技業(yè)務涵蓋生成式AI、視覺AI和創(chuàng)新業(yè)務,以高效率、低成本、規(guī)模化的AI創(chuàng)新和落地,打通商業(yè)價值閉環(huán),引領人工智能進入工業(yè)化發(fā)展階段。商湯前瞻性打造新型人工智能基礎設施——商湯AI大裝置SenseCore,打通算力、算法和平臺,并在此基礎上建立“商湯日日新SenseNova”大模型及研發(fā)體系,以低成本解鎖通用人工智能任務的能力。此外,商湯科技持續(xù)領跑計算機視覺市場,商湯方舟 SenseFoundry以多年積累計算機視覺能力,輔以前沿多模態(tài)大模型,為國內外各行業(yè)提供更加穩(wěn)定高效的視覺Al支撐。
商湯倡導“發(fā)展”的人工智能倫理觀,并積極參與有關數據安全、隱私保護、人工智能倫理道德和可持續(xù)人工智能的行業(yè)、國家及國際標準的制訂,與多個國內及多邊機構就人工智能的可持續(xù)及倫理發(fā)展開展了密切合作。商湯《AI可持續(xù)發(fā)展道德準則》被聯合國人工智能戰(zhàn)略資源指南選錄,并于2021年6月發(fā)表,是亞洲唯一獲此殊榮的人工智能公司。
目前,商湯科技已于香港交易所主板掛牌上市。商湯在香港、上海、北京、深圳、成都、杭州、西安、新加坡、曼谷、吉隆坡、利雅得、阿布扎比、迪拜、首爾等地設立辦公室。另外,商湯科技在德國、泰國、印度尼西亞、菲律賓等國家均有業(yè)務。更多信息,請訪問商湯科技網站、微信、微博和領英。
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.