![]()
作者|參商 西梅汁
編輯|星奈
媒體|AI大模型工場
![]()
國內大模型發展趨勢|4月份解讀
C端產品內卷:豆包、DeepSeek、智譜開啟商業化新周期
四月以來,國內大模型C端產品集體邁入"付費分層"新階段,但市場反饋呈現明顯分化。豆包傳出在測試復雜任務付費后,社交平臺出現較多"免費習慣被打破"的討論,部分用戶認為68元/月的標準版門檻偏高,而500元/月的專業版更被調侃"不如直接雇助理"。這種輿論反差恰恰說明:大模型商業化不能簡單套用互聯網產品的"先免費后增值"邏輯,用戶愿意付費的前提,是清晰感知到,付費后能獲得什么不可替代的價值。
具體到豆包的三檔定價策略,其實暗含了分層篩選用戶的意圖。標準68元/月主打輕度生產力場景,如PPT生成、會議紀要整理;加強版200元/月面向進階用戶,開放數據分析、多輪深度推理等高算力任務;專業版500元/月則鎖定企業級或專業創作者,提供專屬模型微調、優先推理通道等權益。這種"階梯式價值錨定"本身是合理的商業設計,但問題是,當前模型能力是否足以支撐用戶對"專業版"效果的預期?當用戶花500元/月卻仍遇到幻覺、邏輯斷層等問題時,付費意愿自然會回落。
對比其他玩家的策略,差異更顯微妙。智譜前段時間選擇直接提價83%,但依托GLM-5.1在Coding場景的硬核表現,調用量反而增長400%,說明專業用戶更看重"結果可靠性"而非絕對價格;DeepSeek用"快速模式+專家模式"做體驗分層,免費用戶仍能使用基礎能力,付費用戶獲得深度思考與優先響應,這種"能力可見、付費可選"的漸進式設計,用戶抵觸情z緒相對更低。可見,付費分層的成功與否,關鍵不在于"收不收錢",而在于"分層邏輯是否透明、價值交付是否可感知"。
更重要的是,這輪商業化并不是簡單“漲價”,而是大模型產品從流量產品向生產力產品遷移的信號。據資料顯示,豆包日均Token使用量突破120萬億,三個月內翻倍;火山引擎上累計Token使用量超萬億的企業客戶,也從去年底100家增至140家。這些數據說明,用戶和企業對大模型的使用正在從淺層嘗鮮變成高頻調用。只要模型能夠進入工作流,幫助用戶完成更復雜、更耗時、更專業的任務,付費就不再是突兀的商業動作,而會變成效率提升之后的自然結果。
分層付費只是商業化的起點,而非終點。未來競爭的關鍵,或許不在于定價本身,而在于是否能構建出"場景-能力-價值"的精準匹配。更關鍵是讓用戶清晰感知付費價值:花錢就能更快搞定 PPT、更穩寫完代碼、更省心完成內容創作。或許這樣,大模型才能跳出淺層流量生意,真正邁入訂閱服務、增值權益、結果導向付費的成熟商業周期。
組織變革驅動AI落地:大廠為何集體"為AI重組"?
國內大廠的組織調整最近呈現出一致的動作。
AI不再只是某個事業群的業務選項,而是被放到集團戰略中樞的位置。阿里的調整從ATH事業群的成立開始,把通義、千問、云基礎設施、推理平臺以及面向業務場景的AI應用,重新納入一套更統一的協同體系中。通義實驗室升級為事業部,集團技術委員會由吳泳銘牽頭,周靖人、李飛飛、吳澤明等分別負責模型、AI云基礎設施、業務技術平臺和推理平臺,這意味著阿里正在試圖結束過去AI業務分散推進的狀態,轉向圍繞Token展開的系統化協同。
百度的改革則更像是把AI從技術部門推向全員工作方式。百度取消原有T/P/E/M字母職級體系,統一調整為數字職級,并將AI工具應用、大模型落地能力、AI業務產出納入績效考核,甚至明確要求骨干員工AI工具提效達標20%以上。這背后的邏輯很直接:大模型落地不能只靠少數算法團隊沖鋒,而要讓搜索、文庫、網盤、地圖、健康等業務都被AI重新組織。
騰訊和字節的動作,則體現了另一種組織提速方式。通過產品矩陣讓AI進入更多真實場景。騰訊在4月連續推進QClaw、混元Hy3 Preview模型、ima知識Agent“Copilot”、WorkBuddy接入騰訊文檔資料庫等能力,把Agent、記憶、應用連接器、企業云服務串成一套可交付的系統。字節則圍繞豆包、火山引擎、即夢和汽車AI方案,把模型能力快速推向語音交互、視頻生成、3D生成、AI座艙等高頻場景。相比單純調整組織架構,這兩家的特點是用更快的產品迭代,推動模型能力持續進入業務前線。
大模型競爭正在告別單純比參數、比榜單的階段,進入“組織力決定落地力”的系統階段。技術差距逐漸縮小之后,真正拉開差距的,不只是模型本身,而是研發、算力、產品、數據、場景和商業化之間的協同效率。大廠紛紛調整架構、重構考核、整合平臺,是因為AI落地已經不是一個部門能獨立完成的事,而是需要整個組織圍繞智能化重新排布資源。
那么,當大廠用組織杠桿放大技術優勢時,創業公司的敏捷性是否仍是核心競爭力?答案或許在于聚焦與差異化。組織力決定落地速度,但場景力決定商業價值,這或許是大模型時代留給不同體量玩家的分工密碼。
車載成大模型最大落地場景:北京車展背后的"艙駕一體"戰爭
四月的北京車展上,火山引擎、科大訊飛、商湯絕影幾乎同期推出車載大模型解決方案。一個明顯信號是,車載場景正在成為大模型商業化落地中確定性最高的賽道之一。
車企愿意為端側部署、低延時響應、多語言出海等能力買單,根本原因在于,智能座艙早已從車型的加分項,變成影響用戶體驗和市場競爭力的標配能力。當用戶可以通過語音完成導航、車控、娛樂、辦公等一系列操作,大模型也不再只是車機里的“聊天助手”,而是開始融入駕駛全流程,成為連接人、車、服務與場景的移動智能體。
具體來看,火山引擎基于 Agentic AI 架構,用“一個 AI 大腦”深度聯動車控、智駕、導航、座艙等關鍵功能域,形成“感知—推理—執行—記憶—學習”的一體化閉環,優勢在于字節系產品能力與車企實際需求的快速耦合。
科大訊飛則把“端側+出海”作為雙引擎,專屬車載大模型 SparkAuto EMM 已完成多類算力平臺適配,指令響應延時壓到 150ms,同時支持 32 種語言、覆蓋 60 個國家,精準切中了中國車企全球化過程中的剛需;商湯絕影的 Sage Box 采用“端側模型+千機系統+原生智能體”的三層架構,主打“一腦多形”的靈活賦能,優勢在于將多模態理解與生成能力統一到車載場景之中。
這些背后,其實指向同一個變化:大模型正在從“云端炫技”走向“車端實用”,從單點能力展示進入真正的工程化落地階段。
更值得關注的是,車載場景本身正在成為大模型能力迭代的“加速器”。車輛行駛過程中,模型需要處理模糊指令、抗干擾語音、多任務并行,還要面對實時性、穩定性、安全性等更高要求。相比普通對話場景,車載環境更像是一場高壓測試,也在倒逼大模型技術快速成熟。
比如,訊飛端側模型可以在本地完成語音交互與智能規劃,降低對云端網絡的依賴;商湯 SenseNova U1 系列以 8B-MoT 規格實現多模態理解與生成的統一;火山引擎則在視頻生成等能力中強化版權與肖像安全保障。這些在車載場景中被反復打磨的能力,未來也有可能反哺教育、醫療、工業等更多垂直領域。
不過,車載并不是終點,“空間智能”或許才是大模型落地的下一站。群核科技以“全球空間智能第一股”登陸港股,背后是空間設計、3D 生成、虛實交互等能力的系統化整合;螞蟻靈光也在移動端首發世界模型體驗,用戶上傳圖片即可秒級生成 3D 世界,并進行自由探索。
那么,當大模型開始具備理解和生成三維空間的能力,人車關系也會從“指令—執行”,升級為更自然的“意圖—協同”。智能座艙不再只是屏幕、語音和應用的組合,而會進化成一個可感知、可理解、可服務的移動生活空間。這也意味著,車載大模型的競爭已經不只是參數和單點能力的比拼,而是進入“技術—場景—生態”的系統化階段。車企真正需要的,也不是一個能聊天的語音助手,而是一套能理解駕駛場景、連接服務生態、持續優化體驗的智能系統。
當端側部署、多語言出海、空間智能等能力不斷成熟,大模型正在重構的不只是人車交互,更是智能出行的價值鏈條。這或許才是“艙駕一體”戰爭背后的真正命題。
國內大模型動態
阿里
4月,阿里密集發布AI新品:推出新一代大模型Qwen3.6系列(登頂國產榜首)、語音模型Fun-ASR1.5、圖像模型Wan2.7-Image等,上線無代碼開發工具Meoo、世界模型Happy Oyster、數字人“千問小酒窩”、數字員工QoderWake及釘釘AI硬件A1 Pro;同時成立ATH事業群、升級通義實驗室,全面加速AI從模型到產品、從組織到場景的落地。
4月30日,阿里發布數字員工QoderWake和Qoder移動端兩款Agent產品,全面覆蓋企業和個人場景的需求。QoderWake是業界首個安全可控、持續進化的生產級數字員工產品,能在真實工作中承擔軟件工程師、運營和分析師等崗位角色。目前,QoderWake已開啟邀測,個人和企業均可在官網申請雇傭一位或多位數字員工,或根據自身業務流程定制專屬數字員工。
4月30日,釘釘正式推出DingTalk A1 Pro,并在天貓釘釘官方旗艦店開售。這是釘釘AI硬件家族的新產品,DingTalk A1 Pro內置2980mAh大容量電池,連續錄音時長達到180小時,待機時長達到180天,結合釘釘AI聽記能力,A1 Pro能夠將錄音實時轉寫為文字,通過AI大模型進行總結分析,并支持多語種實時翻譯。內置200多種AI紀要模板,覆蓋客戶拜訪、面試問答、法律咨詢、跨國會議等典型工作場景,幫助用戶把語音溝通轉化為結構化的線上知識。
4月22日,阿里巴巴正式發布生態級AI助手數字人形象“千問小酒窩”。這位女性數字人形象擁有標志性的微笑酒窩,“能談心,更能辦事”。千問小酒窩既能聊天陪伴,也能處理訂餐、買票、打車、規劃等日常事務,一句話完成外賣、行程、購票等跨服務操作。目前千問App內已上線,未來將逐步接入淘寶、飛豬等阿里各生態應用。
4月20日,阿里通義實驗室宣布正式推出語音識別大模型Fun-ASR1.5。據介紹,它基于統一的大模型架構,單模型即可無縫覆蓋30種語言、漢語七大方言體系及20+地方口音,古詩詞吟誦也能精準轉寫。目前,Fun-ASR1.5 已在阿里云百煉平臺正式上線,面向教育、傳媒、金融、科技、文化等各行業客戶提供 API 服務。
4月20日,阿里宣布 Qwen3.6-Max-Preview 正式發布。據介紹,該模型是 Qwen 系列新一代旗艦模型的早期預覽版,擁有更強的世界知識和指令遵循能力,并在智能體編程任務中性能顯著提升。用戶可以在 Qwen Studio 進行交互對話,并且即將通過阿里云百煉 API 以 qwen3.6-max-preview 的名稱調用。
權威三方評測榜單Artificial Analysis顯示,Qwen3.6-Max-Preview性能表現超過GLM5.1、MiniMax-M2.7等模型,登頂最佳國產模型。
4月16日,阿里巴巴ATH事業群推出開放式世界模型產品“Happy Oyster”,主打實時世界創建與交互。該產品可生成動態三維環境,支持影視制作、游戲開發等場景。其與HappyHorse同屬ATH旗下AI創新事業部。目前已開啟內測,用戶可通過官網加入候補名單。Happy Oyster基于原生多模態架構,其背后是支持多模態輸入與音視頻聯合生成的流式生成世界模型。
4月15日,阿里ATH事業群發布旗下首款AI開發工具Meoo(秒悟),該工具集成了千問、Kimi、GLM、MiniMax四大頂尖模型,并內置阿里云數據庫、存儲等核心產品服務,用戶無需任何編程基礎,只需用自然語言描述想法,Meoo最快1分鐘就能自動生成前端后端完整的網站、H5頁面,并在阿里云上一鍵部署上線。
4月14日,千問上線“表格Agent”,支持在對話中直接生成、編輯Excel文件。用戶可以要求千問檢索信息后生成表格,也可以將多輪對話內容整理為表格,或基于圖片、文件生成。系統通常可在1–2分鐘內輸出可下載的Excel文件,無需二次復制粘貼,并支持通過自然語言進行修改。
4月13日,阿里云宣布調整標準版、專業版用戶的API免費額度并支持按量付費。DataWorks標準版、專業版用戶,取消每日調用API的數量限制;DataWorks標準版,調用API的免費額度調整為10萬次/月;超出部分采用OpenAPI按量付費的方式;DataWorks專業版,調用API的免費額度調整為50萬次/月;超出部分采用OpenAPI按量付費的方式;DataWorks基礎版和企業版保持不變;各版本的QPS限制保持不變。從2026年4月14日逐步發布,到2026年4月23日所有region生效。
4月10日,阿里巴巴ATH方面表示,HappyHorse是阿里ATH旗下創新事業部研發的模型,目前正處于內測中,也會于近期開放API。ATH創新事業部已啟動一個AI時代的全新交互方式探索計劃,HappyHorse是這個探索方向的一部分,更多的產品會陸續推出。當前HappyHorse業已注冊官方微博,表示正式與大家見面,還需要一點時間。
4月9日,阿里云百煉正式上線”記憶庫”功能,”記憶庫系統“內置了「提取-存儲-檢索-注入」四大模塊,用戶每次與AI Agent對話結束后,系統可根據配置的記憶規則自動提取關鍵信息并存儲,并根據用戶的指令,觸發語義檢索召回相關記憶并附加至上下文中,實現個性化回答,有效提升Agent的長期記憶能力。
現在,“記憶庫”功能限時免費向所有用戶開放,用戶可通過API直接調用,或通過OpenClaw等Agent產品一鍵安裝。
4月8日,由阿里CEO吳泳銘提出阿里組建新的Alibaba Token Hub(ATH)事業群,所有關聯業務需要圍繞Token進行商業化。
組織變動也隨之發生。據了解,中國電商事業群AI業務的負責人張凱夫不再負責,承載AI業務的“智能搜推產品”事業部調整為“平臺用戶及產品”和“智能算法”兩個部門,負責多模態的“未來創新事業部”則融入ATH 事業群。
4月8日,阿里發布全員信,包括把通義實驗室升級為事業部,由周靖人負責;李飛飛出任阿里云CTO,吳澤明專注集團CTO,淘寶閃購CEO職務由雷雁群接任。
同時,成立阿里巴巴集團技術委員會,由吳泳銘任組長,成員包括周靖人、吳澤明、李飛飛。周靖人擔任技術委員會首席 AI 架構師,李飛飛負責阿里云技術以及 AI 云基礎設施建設。吳澤明負責集團業務技術平臺以及AI推理平臺建設,并擔任技術委員會召集人。
4月3日,全球知名大模型盲測榜單LMArena旗下聚焦AI編程能力的Code Arena公布新一期排名,阿里巴巴最新一代大語言模型Qwen 3.6-Plus登上全球榜單第二,超越OpenAI、Google、xAI等國際巨頭,成為該榜單上排名最高的中國大模型。
4月2日,阿里新一代大語言模型Qwen3.6-Plus正式發布。較之上一代模型,千問3.6整體性能提升明顯,尤其是編程Coding能力、智能體Agent能力和工具調用能力都實現了全面躍升,同時深度適配主流Agent框架,釋放模型在開放環境中完成復雜任務的新潛力。
目前,Qwen3.6-Plus已上架阿里云百煉,每百萬Tokens(詞元)輸入最低2元;千問3.6也已登陸悟空、千問App等阿里AI應用和平臺。
4月2日,千問AI眼鏡發布后首次進行OTA升級,上線首批“AI辦事”能力。通過深度接入淘寶閃購、支付寶,支持話費充值、掃碼騎車、停車繳費、語音點外賣等高頻生活服務,這驗證了AI眼鏡類終端設備可以從“回答問題”轉向“把事辦成”,成為大模型落地真實世界的物理接口。
4月1日,阿里巴巴圖像生成與編輯統一模型Wan2.7-Image正式發布。針對當前AI生圖中的審美疲勞、色彩失控等痛點,Wan2.7-Image帶來了更具“活人感”的人物生成、精準的色彩控制以及超長文本渲染能力。
騰訊
4月29日,騰訊文檔宣布正式接入WorkBuddy資料庫。據介紹,用戶只需在WorkBuddy PC端或微信小程序完成一次授權,AI就能直接讀取騰訊文檔里的資料,無需下載、上傳或頻繁切換應用,自動完成從資料獲取到內容產出的全流程操作。
4月28日,騰訊云在重慶舉辦城市峰會,宣布升級全棧企業級Agent產品能力,首發ClawPro專有云版、ADP智能工作臺、Agent Memory、Agent Storage等多款產品,并與重慶兩江新區、渝歐跨境、中國東信等十余家政府機構和企業簽署合作。
同日,騰訊云發布關于CodeBuddy、WorkBuddy計費方案調整的公告。其中提出,企業旗艦版將更名為“SaaS企業版”,價格由“78元/人/月”調整為“198元/人/月”。企業專享版將更名為“專有云企業版”,價格由“158元/人/月”調整為“316元/人/月”。計劃于2026年5月15日起執行新的計費方案。
4月23日,騰訊混元發布并開源Hy3 preview語言模型。該模型采用MoE架構,總參數295B、激活21B,支持256K上下文。官方稱其在推理、代碼、Agent等維度大幅提升。目前Hy3 preview已在騰訊云、元寶、QQ、騰訊文檔等多個核心產品上線,并支持接入OpenClaw、KiloCode等主流Agent框架。
4月16日,混元3D世界模型 2.0(HY-World 2.0)正式發布并開源。據介紹,HY-World 2.0是一個多模態世界模型,能夠根據文字、圖片、視頻等不同類型輸入,自動生成、重建和模擬3D世界,同時支持多格式3D資產(Mesh/3DGS/點云等)導出,支持與現有的游戲工作流無縫對接,用于快速生成游戲地圖和關卡原型。
4月9日,騰訊宣布QClaw V2大版本上線,新版本(V0.2.5)實現多Agent、應用連接器和龍蝦管家三大核心能力,支持用戶創建多個Agent,每個Agent可自定義不同的專長、技能和權限;同時打通眾多第三方應用,官方稱單任務操作步驟可減少60%以上。針對安全問題,QClaw上線“龍蝦管家”功能,在QClaw可一鍵開啟安全防護環境,攔截惡意prompt、skill投毒、文件誤刪、敏感信息泄露等風險。
4月8日,QQ瀏覽器正式發布國內首個瀏覽器“龍蝦”——QBotClaw,支持用戶自由配置國內各大主流大模型 API Key,內置QQ瀏覽器Skill,用戶直接提問即可使用,實現人人都能輕松用上“龍蝦”。首期上線Mac版本,Windows版本也將于近期上線。據介紹,QBotClaw內置自研的QQ瀏覽器Skill,具備深度記憶能力,可微信直連。
4月3日,騰訊云正式發布“龍蝦”記憶服務TencentDB Agent Memory。據介紹,這個由騰訊云數據庫團隊研發的記憶引擎,從原始對話到用戶畫像,構建了四層漸進式記憶系統。評測數據顯示,接入該服務后,OpenClaw的總回答準確率高達76.10%,較原生記憶提升近59%。目前,Agent Memory以插件的形態無縫集成至騰訊云Lighthouse、ClawPro等產品中,支持免費一鍵開啟。
字節跳動
字節跳動在AI模型與應用上密集迭代,發布全雙工語音大模型Seeduplex、3D生成模型Seed3D 2.0及高清視頻生成Seedance 2.0 API,推出AI座艙方案和即夢“小章魚”工具,豆包日均Token破120萬億,并開始測試復雜任務付費服務。
5月4日,近日,豆包App Store頁面出現付費版本服務聲明。對此,豆包官方回應稱,豆包始終提供免費服務,在免費服務的基礎上,豆包也在探索推出更多增值服務,相關方案細節目前還在測試階段。另據接近豆包的人士透露,付費功能將主要專注在復雜任務和生產力場景,如PPT生成、數據分析、影視制作等。隨著模型能力持續升級,產品已經能滿足越來越多的復雜高價值任務。但此類任務需消耗更多算力與推理時間,因此豆包計劃上線付費服務,滿足好這部分復雜場景需求。免費版本則繼續面向用戶的日常使用。
4月24日,北京車展開幕首日,火山引擎發布基于 Agentic AI架構的新一代汽車AI解決方案,包含AI座艙套件方案、豆包座艙助手方案兩大解決方案。
基于行業首個全鏈路端到端AI座艙架構,本次發布的全新解決方案徹底顛覆了上一代智能座艙“意圖分域+多 Agent 協同”的語音助手架構,通過一個AI大腦深度聯動整車,打通車控、智駕、導航、座艙等關鍵功能域,實現“感知-推理-執行-記憶-學習”一體化閉環。
4月23日,字節跳動正式發布新一代3D生成模型Seed3D 2.0,幾何精度與紋理材質生成兩項核心指標上均取得SOTA 結果。該模型采用Coarse-to-Fine兩階段策略和MoE架構,60位3D建模人員盲評中幾何生成偏好率最高達98.3%,紋理生成偏好率超69%。模型現已支持部件分割、鉸接資產及場景組合生成。當前,Seed3D 2.0 API服務已上線火山方舟。
4月21日,在AI創新巡展·成都站上,火山引擎宣布Seedance 2.0 API正式支持原生1080P全高清視頻生成,無需后期超分處理,細節與光影層次顯著提升。該能力適用于影視、廣告、電商等更多創意場景,也能更高效地推動內容從“生成”走向“可交付”,為企業及創作者提供更高效、更高質量的內容創作支持。
4月9日,字節跳動宣布推出原生全雙工語音大模型Seeduplex。據介紹,相比于上一代半雙工豆包端到端語音模型,Seeduplex基于“邊聽邊說”的全新框架設計,交互體驗的自然感、順暢度有所提升。目前,Seeduplex已在豆包App全量上線。
同日,豆包宣布打電話能力正式升級,實時語音通話功能已接入全雙工語音大模型Seeduplex。據介紹,作為原生全雙工端到端語音大模型,Seeduplex能夠在復雜聲學場景下實現精準抗干擾與動態判停,提供更順暢、更自然的語音交互體驗。該模型上線后,豆包語音通話在對話自然度、響應速度和抗干擾表現上都進一步提升,邊聽邊講,交流體驗也更自然。
4月9日,即夢AI上線首個協作型AI敘事創作工具 “小章魚”Octo,并創新提出Vibe Create創作模式。作為探索性嘗試,Octo功能并未全量上線,僅在即夢Web端開放內測申請。
據介紹,在交互方式上,Octo支持“對話 + 多模態混合”的同屏共創方式,其搭載的智能Agent可主動通過圖片、音頻等形式與創作者開展創意碰撞,實時感知界面內容與用戶操作,實現邊對話邊生成的異步并行創作。同時該功能還搭建了全流程AI制作閉環,能夠完成從故事大綱梳理、核心資產構建,到劇本分鏡生成、短片成片輸出的全鏈路操作,并深度聯動Seedance 2.0、Seedream 5.0 Lite等即夢線上最新模型。
4月2日,火山引擎在AI創新巡展·武漢站上宣布,Seedance 2.0 API 面向企業用戶開放公測。據介紹,火山引擎為 Seedance 2.0 建立了行業領先的版權與肖像安全保障,覆蓋視頻生成涉及的各種模態和創作前后全流程,對侵權、深度偽造等行為進行檢測和防御,有效保護版權方和創作者的權益。
截至今年3月,豆包大模型日均Token使用量已突破120萬億,在過去三個月內增長一倍,比2024年5月發布時增長1000倍。目前,在火山引擎上累計Token使用量超過一萬億的企業,已從去年底的100家增長到140家。
百度
4月28日,百度內部發布全員通知,官宣啟動全公司職級體系全面改革,自 2026 年 5 月 1 日起正式執行,取消原有 T/P/E/M 字母職級體系,統一調整為 5-12 級數字職級體系,同步將 AI 工具應用、大模型落地能力、AI 業務產出納入全員績效考核核心指標,明確要求骨干員工 AI 工具提效標準達標 20% 以上,將 AI 核心能力作為員工晉升、評優的硬性考核指標,全面適配公司全棧 AI 轉型戰略。
4月27日,在百度AI Day開放日上,百度文庫網盤聯合發布通用智能體GenFlow4.0并升級Office Agent,用戶可在網盤通用智能體GenFlow4.0中一鍵部署OpenClaw,將文庫網盤打造成自己的“AI工作臺”。截至目前,通用智能體GenFlow4.0月活用戶已達1億,月任務交付量達2億次。
4月24日,百度在2026百度創作者大會上正式介紹全新升級的搜索AI引擎。升級后的AI搜索引擎以Master Agent為核心,新增需求規劃Agent和組織生成Agent,可自主拆解復雜任務、調用工具、鏈接服務,將搜索體驗從“找到、知道”全面升級為“得到、做到”。
4月15日,百度文心大模型團隊正式開源文生圖模型ERNIE-Image。據介紹,該模型基于單流Diffusion Transformer(DiT)架構,并配有一個輕量級Prompt Enhancer,用于將簡短輸入擴展為更豐富、更結構化的描述。參數規模僅為8B,僅需24GB顯存的消費級顯卡即可運行,生成效果媲美頂級商業模型。
4月13日,近日,百度智能云旗下DuClaw公布了新一輪升級,在此前打通小度硬件的基礎上,進一步打通百度地圖,用戶現在通過DuClaw部署小龍蝦,只需一條出行指令,就可同步調起小度與百度地圖,完成包括日程查詢,天氣路況及出行規劃建議,并通過小度硬件語音交互實時反饋給用戶。
4月2日,從百度健康方面獲悉,其面向醫生群體推出的AI產品“有醫助理”于今日上午正式發布。該產品是國內首個將權威醫學檢索與任務型AI執行深度融合的全場景醫生工作平臺。
“有醫助理”包含檢索與任務兩大核心模式:其中檢索模式基于數千萬級醫學數據支持權威循證溯源,致力打造“中國版OpenEvidence”;任務模式基于Claw框架,能夠自主完成學術科研、論文創作、患者隨訪等復雜任務,實現醫療AI從“信息檢索”向“任務完成”的跨越。百度健康方面還透露,“有醫助手”已在App端開放檢索模式體驗,任務模式逐步開放使用。針對醫療數據隱私,產品構建了包括數據隔離、加密通信在內的五層醫療級安全防護體系。
月之暗面
4月20日晚,月之暗面正式發布并開源其最新模型Kimi K2.6。據官方披露,該模型在測試中可實現13小時不間斷編碼,其Agent集群架構迎來大升級,支持300個子Agent并行完成4000個協作步驟,在多項基準測試中表現持平或優于GPT-5.4、Claude Opus 4.6和Gemini 3.1 Pro等閉源模型,是月之暗面迄今最強的代碼模型。
目前模型已上線kimi.com、Kimi API、最新版Kimi App和Kimi Code編程助手,所有用戶均可開始使用。
螞蟻集團
4月27日,螞蟻靈光App正式上線“體驗世界模型”功能,成為業界首個可在移動端體驗世界模型的AGI產品。用戶只需上傳一張圖片,即可在手機上秒級生成3D世界,并用手游操控視角,自由探索長達60秒。該功能背后接入的是螞蟻靈波LingBot-World-Fast世界模型,該模型現已開源。靈光App負責人蔡偉表示,這是靈光探索智能邊界的又一實踐,旨在把好的AI體驗帶給所有人。目前,用戶可在各大應用商店下載靈光App體驗。
4月22日,螞蟻百靈正式推出 Ling-2.6-flash —— 一款總參數量 104B、激活參數 7.4B 的 Instruct 模型。該模型主打“Token 效率(Token Efficiency)”,在保持競爭力智能水平的同時,更快、更省以及更適合大規模真實應用。
據權威三方評測Artificial Analysis 數據,Ling-2.6-flash 展現了突出的 Token Efficiency 優勢,以 15M output tokens 實現了 26 分 的 Intelligence Index,在保持較強智能水平的同時,將輸出消耗控制在相對更低的位置。相比部分依
4月20日,螞蟻靈光發布新一代閃應用“靈光圈”,致力于打造人人可用的消費級Coding Agent。
在原有“30秒生應用”基礎上,靈光閃應用持續強化多智能體協作、全模態生成及移動端原生能力集成,成為首個支持用戶用自然語言,在手機端創建、分發、使用、迭代AI應用的平臺,真正實現了0代碼、0部署、0門檻個性化創作。截至目前,靈光用戶已創建超3000萬個閃應用。
4月16日,螞蟻靈波科技宣布開源流式三維重建模型 LingBot-Map。該模型僅需一個普通 RGB 攝像頭,即可在視頻采集過程中實時估計相機位姿、重建場景三維結構,為機器人、自動駕駛、AR 眼鏡等應用提供連續、穩定、實時的空間感知與理解能力。模型支持約 20 FPS 實時推理和超萬幀長視頻連續運行且精度幾乎不衰減,兼顧了精度、速度和長時穩定性。
4月2日,近日,螞蟻數科旗下專業龍蝦產品DTClaw已開啟內測。與當前市場上僅能完成文檔整理、會議紀要、資料收集等技能的“普通蝦”不同,DTClaw 定位“專業蝦”,可為金融專家、理財顧問、數據專家等專業人群提供7×24 小時在線的專屬AI智能體服務。
據了解,DTClaw出生即“專家”,平臺支持上百種專業skills技能,且預置豐富的熟蝦模版,覆蓋理財、投資、數據分析、研發與測試等高價值場景,用戶可一鍵部署,無需再從頭訓起,高效省token。
MiniMax
4月16日,MiniMax上線全球首個云端沙箱 Hermes —— MaxHermes。MaxHermes 將 Hermes Agent 的學習閉環與自我進化能力與 MiniMax M2.7 模型深度結合,用戶無需本地部署,10 秒內即可在云端擁有一個越用越懂自己的 AI 智能體。
據悉,MaxHermes 的核心差異在于其獨特的學習閉環機制。每完成一項復雜任務,MaxHermes 會自動從中提煉出可復用的 Skills,保存為獨立文檔。在后續使用中,這些 Skills 按需加載,并根據新的使用反饋不斷自我改進。此前,OpenClaw 的 Skills 依賴人工預設與引導,能力在部署那一刻就已固定;而 MaxHermes 的 Skills 由 Agent 自主生成、自主迭代,能力隨使用持續生長。
4月12日,MiniMax M2.7在全球正式開源,攜華為昇騰、摩爾線程、沐曦、昆侖芯、NVIDIA,以及Together AI、Fireworks、Ollama等海內外芯片廠商、推理平臺,在開源首日即完成模型接入與推理適配工作。
4月10日,MiniMax正式發布新一代音樂生成模型Music 2.6。本次更新從底層引擎到創作工具實現全維度進化,大幅提升生成延遲、音樂控制、聲學品質,推出全新“Cover”創作功能和面向AI Agent生態的Music Skill,并面向全球創作者開啟為期14天的免費內測。
4月9日,MiniMax宣布發布MMX-CLI,一個面向AI Agent的命令行工具。據了解,接入MMX-CLI后,Agent可以在ClaudeCode、OpenClaw等環境中原生調用MiniMax最新的編程、視頻生成、語音合成、音樂創作等全模態模型,無需適配繁瑣接口,也無需額外編寫MCP Server。
科大訊飛
4月24日,科大訊飛正式亮相2026北京國際汽車展覽會,重點展出基于星火大模型迭代打造的新一代多模態智能座艙解決方案。該座艙系統實現極速交互響應,指令意圖響應延時低至150ms,針對口語化模糊指令、碎片化用車需求的識別理解準確率突破90%;專屬端側車載大模型SparkAutoEMM完成多類車載算力平臺適配兼容,可在車端本地實現語音交互、場景服務、智能規劃等本地化AI能力,降低云端依賴、提升行駛穩定性與隱私安全性。
同時,訊飛同步展示星火海外版大模型車載應用成果,全面支持32種主流語言,服務范圍覆蓋全球60個國家和地區,目前已完成多家主流出海車企車型的適配搭載,加速智能座艙出海商業化落地。
4月16日,2026科大訊飛 AstronClaw升級發布會正式舉辦,發布9項創新產品。其中,面向招標與采購場景,科大訊飛企業級招采助手——招采Claw首次亮相。產品深度融合全新升級的科大訊飛AstronClaw、SkillHub及招采知識庫,直擊傳統招采痛點,以專屬Agent智能決策大腦,為企業打造全流程自動化、智能化、合規可控的招采新范式,助力企業實現降本提效與合規升級。
智譜 AI
4 月 28 日,智譜入選《時代》雜志 “2026 年全球最具影響力 10 家人工智能公司”,成為唯一上榜的中國獨立大模型企業,同期入選的還有字節跳動、阿里巴巴兩家中國公司。
《時代》評價稱,智譜作為中國首家在香港完成IPO上市的大語言模型公司,其GLM-5模型在部分基準測試中超越了谷歌的Gemini3Pro等對手,并在Coding和Agent任務上近Claude Opus系列模型。這是迄今為止最強有力的信號之一,智譜的GLM模型表明中國模型能在前沿領域與西方技術競爭。
4月8日,智譜正式發布新一代開源模型 GLM-5.1,官方稱這是目前全球最強的開源模型。據官方介紹,其是唯一達到 8 小時級持續工作的開源模型,在最接近真實軟件開發的 SWE-bench Pro 基準測試中,GLM-5.1 實現國產模型首次超越 Opus 4.6。
OpenRouter 顯示,伴隨此次發布,智譜 GLM 再度提價 10%。調價后,GLM-5.1 在 Coding 場景的緩存命中 Token 價格已接近 Anthropic 旗下 Claude Sonnet4.6 水平。這是國產大模型首次在核心場景實現與海外頭部廠商的價格對齊。
4月2日,智譜發布首個原生多模態Coding基座模型GLM-5V-Turbo。該模型最大突破在于深度融合視覺與編程能力,能夠原生處理文本、圖片、視頻等多模態信息,同時擅長編程、長程規劃、操作執行等復雜任務。
GLM-5V-Turbo在多模態Coding、Agent等核心基準上取得領先表現,引入視覺能力的同時,純文本編程與推理能力保持了同等水準。并且深度Claude Code與龍蝦場景,讓OpenClaw龍蝦具備了真正的視覺能力,能看懂屏幕上的信息。目前該模型已通過智譜MaaS平臺開放接入。
4月1日,在智譜2025年業績說明會上,智譜CEO張鵬對記者介紹,2026年一季度智譜的API調用定價提升83%,即便如此,市場依然呈現出供不應求的情況,調用量增長400%。當前,智譜已成為國內付費Token消耗量最高的廠商之一。據介紹,智譜GLM模型已全面部署于Google Vertex AI、AWS Bedrock、Fireworks、Cerebras等全球頂尖云服務商。
商湯科技
4月28日,商湯科技發布并開源新一代原生理解生成統一模型SenseNova U1系列,隨后壁仞科技、寒武紀、昆侖芯、摩爾線程、中科海光等10家國產芯片公司,均已完成對開源的SenseNova U1 Lite系列的Day 0適配。
SenseNova U1基于商湯NEO-unify原生理解生成統一架構,實現了語言和視覺信息的高效協同,達到開源模型的SOTA水平。它在單一模型架構上統一了多模態理解、推理與生成,并在業內首創了連續性圖文創作輸出,具有高密度信息表達能力。僅憑8B-MoT的較小規格,就能達到甚至超越部分大型商業閉源模型。
4月24日,商湯絕影亮相北京車展,正式發布面向艙駕一體全場景智能體的智能座艙與智能駕駛全系智能體產品。
據悉,此次首發的Sage Box(千機智盒),以Sage端側模型、千機系統(Sage OS)與New Member原生智能體三層架構,打造出可進化的車載自主智能大腦,實現“一腦多形”賦能全場景終端。
4月20日,商湯醫療完成新一輪融資,估值突破 10 億美元,成為全球醫療世界模型賽道領跑者。本輪資金用于醫療 AI 模型迭代、臨床場景落地及全球化拓展,依托商湯多模態大模型技術,加速醫療影像診斷、藥物研發、健康管理等領域的 AI 應用普及。
科大訊飛
4月24日,科大訊飛正式亮相2026北京國際汽車展覽會,重點展出基于星火大模型迭代打造的新一代多模態智能座艙解決方案。該座艙系統實現極速交互響應,指令意圖響應延時低至150ms,針對口語化模糊指令、碎片化用車需求的識別理解準確率突破90%;專屬端側車載大模型SparkAutoEMM完成多類車載算力平臺適配兼容,可在車端本地實現語音交互、場景服務、智能規劃等本地化AI能力,降低云端依賴、提升行駛穩定性與隱私安全性。
同時,訊飛同步展示星火海外版大模型車載應用成果,全面支持32種主流語言,服務范圍覆蓋全球60個國家和地區,目前已完成多家主流出海車企車型的適配搭載,加速智能座艙出海商業化落地。
4月16日,2026科大訊飛 AstronClaw升級發布會正式舉辦,發布9項創新產品。其中,面向招標與采購場景,科大訊飛企業級招采助手——招采Claw首次亮相。產品深度融合全新升級的科大訊飛AstronClaw、SkillHub及招采知識庫,直擊傳統招采痛點,以專屬Agent智能決策大腦,為企業打造全流程自動化、智能化、合規可控的招采新范式,助力企業實現降本提效與合規升級。
DeepSeek
4月29日,部分用戶反饋,DeepSeek網頁版已上線“識圖模式”。試用發現,該模式支持用戶上傳圖片并進行內容理解與分析。目前,該功能尚未全量推送,具體功能邊界尚不清楚。值得一提的是,就在今日,DeepSeek負責多模態開發的研究員陳小康在X平臺發文“Now, we see you”并配圖,圖中DeepSeek標志性的鯨魚“摘下”了眼罩。
本月初,DeepSeek剛剛上線了“快速模式”和“專家模式”,前者適合日常對話,即時響應;后者擅長復雜問題,高峰需等待。彼時就有網傳截圖顯示,除了“快速”和“專家”模式,DeepSeek還有個名為“vision”的模式。最新的“識圖模式”與前述“vision”入口高度吻合。分析認為,這標志著DeepSeek多模態能力的開放,其產品矩陣從純文本對話正式延伸至圖文交互,向GPT-4o、Gemini等主流多模態大模型靠攏。
4月24日,DeepSeek全新系列模型DeepSeek-V4的預覽版本正式上線并同步開源。據悉,DeepSeek-V4擁有百萬字超長上下文,在Agent能力、世界知識和推理性能上均實現國內與開源領域的領先。模型按大小分為pro和flash兩個版本,DeepSeek-V4-Flash是更快捷高效的經濟之選,API服務已同步更新,通過修改model_name為deepseek-v4-pro或deepseek-v4-flash即可調用。
4月8日,DeepSeek正在悄悄進行一場小范圍的灰度測試。最新版本中,DeepSeek 輸入框上方新增“快速模式”與“專家模式”,這是 DeepSeek 走紅以來首次在產品端引入模式分層設計。快速模式適合日常對話,即時響應,支持圖片和文件中的文字識別;專家模式擅長復雜問題,支持深度思考和智能搜索;當前不支持文件上傳和多模態功能,DeepSeek 還提醒該模式下如遇高峰需等待。
愛詩科技
4月23日,AI視頻創作平臺PixVerse(愛詩科技)正式成為聯合國2026 AI for Good全球峰會電影節獨家AI合作伙伴。這是繼2025年受邀參會、入選聯合國大學全球人工智能網絡之后,PixVerse與國際組織的又一次深度合作。目前PixVerse全球用戶已超1億,覆蓋177個國家和地區。此次合作中,PixVerse設立特別獎,面向全球征集AI視頻作品,所有入圍前10名的決賽選手將受邀赴瑞士日內瓦參加峰會頒獎典禮。投稿截止5月15日。
4月8日,愛詩科技PixVerse C1正式上線,作為全球首個影視行業大模型,PixVerse C1支持文生、圖生、參考生、首尾幀能力,最高支持15秒1080P視頻,音畫同步出片,所有能力可跟隨提示詞指令自動分鏡。
昆侖萬維
4月28日,昆侖萬維發布2026年第一季度報告。該公司實現營業收入25.7億元,同比增長45.69%,其中海外業務收入24.87億元,同比增長49.29%,國際競爭力持續增強。伴隨AI技術商業化落地加速推進,天工AI業務收入較2025年第四季度延續高速增長態勢。短劇和AI短劇平臺業務單月流水超4800萬美元,年度經常性收入(ARR)突破5.7億美元。
此外,已搭建全模態模型底座,依托“視頻模型、音樂音頻模型、世界模型、基座文本與多模態模型”四大SOTA模型重塑內容創作供需體系,賦能“AI短劇、AI音樂、AI游戲”三大AI原生娛樂經濟體,探索AI Native平臺經濟全新模式。
4月3日,在 2026 中關村論壇年會期間,昆侖萬維天工 AI 舉辦專場發布會,正式推出三大旗艦模型:Matrix-Game 3.0(AI 游戲)、SkyReels V4(AI 視頻)、Mureka V9(AI 音樂),均躋身世界第一梯隊。同步發布 “4+3 戰略”:以四大 SOTA 模型(視頻 / 音樂 / 世界 / 文本多模態)為底座,賦能 AI 短劇、AI 音樂、AI 游戲三大原生娛樂經濟體,配套超級智能體(SuperAgent),構建全鏈路 AI 內容生態。
階躍星辰
4月16日,階躍星辰正式發布新一代語音生成模型 StepAudio 2.5 TTS,圍繞全局語境控制、文中語境控制、零樣本復刻與全音色控制三項核心能力, StepAudio 2.5 TTS 讓語音生成更自然、更靈活也更有表現力。
據了解,想要靈活調控 StepAudio 2.5 TTS,上手方式并不復雜,只要你“說出需求”就行。上手更簡單,結果也更貼近預期。
4月2日,階躍星辰正式上線新模型Step 3.5 Flash 2603。新增low think mode,面向所有Step Plan用戶開放。據介紹,測試數據顯示,該模型在默認推理模式(high)下,推理分數基本持平,token消耗降低了14%;切換到low think mode(低推理模式)后,token消耗則降低了56%。
群核科技
4月17日,群核科技正式在港交所掛牌上市,成為“全球空間智能第一股”股票代碼:00068.HK。群核科技是“杭州六小龍”中首家完成IPO的科技企業,同時成為“全球空間智能第一股”。
本次IPO,群核科技獲最終以每股7.62港元的發行區間上限定價,全球發售約1.606億股,募集資金總額約12.24億港元,所得款凈額約10.92億港元。招股階段,群核科技香港公開發售獲1591倍認購,國際發售獲14.46倍認購。
此前,群核科技已獲得紀源資本、順為資本、IDG資本、高瓴創投、經緯創投、Coatue、Hearst、Pavilion Capital、云啟資r、線性資本等知名機構的投資。
公司成立于2011年,總部位于杭州,是一家以GPU集群和人工智能技術為核心的空間智能企業,旗下擁有國內最大空間設計平臺酷家樂及其海外版Coohom。
數據支持天眼查,大模型獨家合作賬號
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.