人工智能已經(jīng)正式邁入全新階段,從理解語言進化到接管物理世界。作為全球AI競爭的主要玩家,中美都在積極布局物理AI。
中國制造看華南,而物理AI則離不開深圳。從賽格電子市場到華強北的元器件柜臺,從代工廠、模組商到品牌方,一顆芯片、一塊PCB、一套模組,AI硬件可以在幾公里之內(nèi)完成從立項到出貨的全部鏈路。數(shù)據(jù)顯示,截至2026年5月初,華強北AI產(chǎn)品銷量占比已從2023年的12%躍升至41%。
華強北是風向標,物理AI浪潮正席卷全國并走向全球。《2026中國AI硬件產(chǎn)業(yè)全景洞察與趨勢報告》預測,不含手機和汽車的AI硬件市場規(guī)模將突破1.27萬億元,覆蓋AI眼鏡、AI手機、AI拍學機、機器人、車載終端、智能穿戴等。AI的發(fā)展正從“處理數(shù)字信息”向“理解并介入現(xiàn)實物理世界”發(fā)生根本性轉(zhuǎn)變,物理AI將是下一輪產(chǎn)業(yè)革命的核心。
毫無疑問,在AI硬件中,模型是“大腦”,決定了產(chǎn)品的智能上限和辦事能力。當前,超15萬家智能硬件廠商已接入千問大模型,包括國內(nèi)頭部具身智能企業(yè)和全球TOP10手機廠商。此外,千問大模型還服務了100%的主流車企、智能家電等。千問大模型事實上已成為物理AI的操作系統(tǒng)。
為什么是千問?走進深圳實地調(diào)研,截然不同的AI硬件都給出了同一個答案。
1、月均5000萬次拍照的AI拍學機
兒童AI終端品牌嚕咔博士最近宣布,旗下AI拍學機已全面接入千問大模型。截至目前,該產(chǎn)品累計用戶規(guī)模突破25萬,月均拍照識別量超過5000萬次,預計覆蓋全球20多個國家和地區(qū)。
嚕咔博士把AI拍學機定義為“兒童多模態(tài)AI陪伴終端”。接入千問后,AI拍學機實現(xiàn)了圖像理解、視覺推理、OCR識別和實時交互等功能,并在多項評測中達到SOTA水平,端到端延遲控制在1至2秒內(nèi)。產(chǎn)品還集成了萬相Wan2.7以及ASR/TTS,實現(xiàn)萬物識別、雙語啟蒙、AI講故事等功能。
此外,嚕咔博士的Agent架構記憶中心基于向量數(shù)據(jù)庫打造可存儲的長期記憶,實現(xiàn)個性化成長軌跡追蹤;阿里云的內(nèi)容安全中心通過多層內(nèi)容審核與過濾,配合兒童專屬安全策略引擎,確保交互內(nèi)容合規(guī)。阿里云還為嚕咔博士的出海提供全球基礎設施。
2、“端到端閉環(huán)”的人形機器人
近日,逐際動力發(fā)布最新一代人形機器人LimX Luna,該產(chǎn)品基于阿里云全棧AI打造,并接入千問Omni模型。具身智能的“大腦”VLA(視覺-語言-動作)模型與運控"小腦"模型的訓練需要海量多模態(tài)數(shù)據(jù),對訓練吞吐和存儲有極高要求。目前,逐際動力的訓練數(shù)據(jù)規(guī)模已達1.5PB,訓練高峰瞬時吞吐可達上百TB。基于阿里云PAI平臺和CPFS并行存儲,逐際動力構建了模型訓練平臺;依托阿里云ACK容器服務和邊緣計算能力,多類強化學習環(huán)境被統(tǒng)一封裝為云上仿真平臺。這套方案把過去以周為單位的環(huán)境調(diào)試,壓縮至小時級。
機器人本體側(cè),LimX Luna等機器人接入千問Omni后獲得了全模態(tài)實時互動能力。機器人不僅能"看懂、聽懂、說出來",還能根據(jù)現(xiàn)場場景調(diào)用外部工具完成任務。
此外,逐際動力自研的具身智能標準化訓練框架FluxVLA也已上架阿里云PAI平臺。
3、千問支持不同品類的物理AI載體
嚕咔博士意味著消費級AI硬件已進化為新物種,逐際動力則代表了工業(yè)級AI硬件對大模型和智能算力的極致要求。AI正在從硬件的"附加功能"變成用戶最在意的“核心體驗”,誰先完成與AI的深度融合,誰就能率先接入物理世界。
在深圳實地走訪,可以發(fā)現(xiàn),除了學習機和人形機器人,AI手機、AI眼鏡、家居機器人,無人機、車載終端、智能穿戴等品類背后都有千問大模型。
在AI手機領域,OPPO正在基于PAI平臺對千問進行后訓練,以支持不同AI場景;榮耀聯(lián)合阿里云打造的視覺問答(Visual-Question-Answering,VQA)端到端方案,將圖像細分場景識別率提升近40%,延遲降低30%。
在AI眼鏡領域,基于千問定制的"云+端"多模態(tài)架構,雷鳥 V3 AI 拍攝眼鏡已通過攝像頭與麥克風傳感器,實現(xiàn)視覺理解、實時問答與低延遲多模態(tài)交互。
在家居場景,科沃斯掃地機器人接入千問,采用"端側(cè)小模型識別意圖+云端大模型承接復雜對話"的架構,服務全球 3800 萬家庭。
在無人機領域,影石科技的影翎 A1 基于千問系列模型,打造智能影像拼接、深度主體追蹤、一鍵智能運鏡等能力,實現(xiàn) “先飛行后構圖” ,小白也能輕松出片。
在AI玩具場景,小智AI是基于千問語言、語音等模型打造的開源項目,在Github擁有超2.7萬Star。全球依托小智AI打造的硬件超200萬,暢銷東南亞等地。
阿里云智能集團公共云事業(yè)部南區(qū)解決方案總經(jīng)理陳立偉表示,超15萬家智能硬件廠商已接入千問大模型,國內(nèi)頭部具身智能企業(yè)和全球TOP10手機廠商都已接入千問。此外,千問還覆蓋消費級、工業(yè)級、出行、家居、安防等幾乎全部場景。支撐這些物理AI載體持續(xù)升級的是阿里云全棧AI技術。
模型層面,千問是業(yè)內(nèi)率先實現(xiàn)"全模態(tài)、全尺寸、全面開源"的大模型,覆蓋文本、視覺、語音、視頻的全模態(tài)能力,提供從0.5B到480B等十多檔參數(shù)的全尺寸版本,并已累計開源400多款模型。這讓不同物理AI載體在對應的場景中都能找到適配的模型。
算力層面,阿里云領先的計算、存儲、網(wǎng)絡、數(shù)據(jù)庫、安全引擎等,再加上遍布全球的基礎設施,構成了物理AI的地基。AI企業(yè)尤其是初創(chuàng)企業(yè),不必重復造輪子,可以直接將訓練、推理、出海等業(yè)務跑在阿里云上。
目前,阿里云通過端云協(xié)同、多模態(tài)互動、多智能體架構,推動AI硬件與物理世界深度融合。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.