![]()
作者:鄭施婧
原創(chuàng):深眸財經(jīng)(chutou0325)
伴隨著阿根廷隊和瑞士隊淘汰各自對手,美加墨世界杯的八強全部出爐。而在精彩紛呈的足球賽事之外,綠茵場上意外多了一群特殊的“觀眾”——大模型公司。它們扎堆入局,硬生生把全球的“足球賽場”變成了自家的“技術(shù)秀場”。
從VAR判罰到戰(zhàn)術(shù)分析,AI的腳步走過賽場每個角落。而其中最吸睛、也最富爭議的,當(dāng)屬賽果預(yù)測。
![]()
(圖源:球迷屋)
畢竟,AI能從海量數(shù)據(jù)中學(xué)習(xí)規(guī)律,那么基于足夠多的足球數(shù)據(jù)和信息來預(yù)測勝負,似乎是一件手到擒來的事。于是,Kimi、通義千問、聯(lián)想、騰訊混元紛紛大顯身手,試圖爭奪本次世界杯“神算手”的稱號。
可AI廠商們想象中的“封神”時刻,卻并沒有如期到來。
01
穩(wěn)賺不賠的技術(shù)秀
世界杯是AI大模型最殘酷的考場。22個人、11種戰(zhàn)術(shù)、天氣、場地、傷病、心態(tài)......變量從不同維度涌入,互相纏繞、互相干擾。這比處理標(biāo)準(zhǔn)化文檔難,文檔有格式,足球沒有;比做信息檢索狠,檢索有答案,足球沒有。
那問題來了,面對如此大的風(fēng)險,AI廠商為何仍執(zhí)意入局?
歸根結(jié)底,AI廠商們是想借著世界杯這一坐擁全球頂級流量的場合,來獲取資本信任、搶占用戶心智。但撬動的支點,不是營銷,而是技術(shù)本身。
以騰訊混元為例。它命中29支晉級球隊的戰(zhàn)績被媒體廣泛傳播,但資本和行業(yè)客戶看的可不是“命中29”,而是它背后的技術(shù)本色。混元采用了MoE混合專家架構(gòu),在7T訓(xùn)練token中嵌入了近21.4%的合成數(shù)據(jù)。這意味著模型并非死記硬背,而是通過合成數(shù)據(jù)模擬了無數(shù)次“虛擬賽事”做邏輯推演,學(xué)會了“舉一反三”。同時,其256K的超長上下文窗口,能一次性消化海量賽事報告。因此,當(dāng)它預(yù)測世界杯時,展示的不僅是比分,更是對“變量可控場景”的強大建模能力。
![]()
(圖源:騰訊元寶)
除此之外,這還是一場成本極低的技術(shù)“高考”。訓(xùn)練300個子Agent跑一輪預(yù)測的電費,可能抵不上央視一條15秒廣告,但獲得了全網(wǎng)對“AI預(yù)測準(zhǔn)確率”的討論量,這個廣告位,平時根本買不到。
并且借著世界杯這個“考場”,AI廠商還可以用足球這個充滿不確定性的“磨刀石”,把自家的技術(shù)打磨得更鋒利。
通義千問在動態(tài)更新的賽事數(shù)據(jù)流中,反復(fù)測試了對實時信息的接入能力和響應(yīng)速度,這背后是對推理延遲和并發(fā)處理能力的極致壓榨;聯(lián)想的天禧AI更是將多模態(tài)融合技術(shù)直接搬進了現(xiàn)場,用3D數(shù)字人可視化與裁判視角AI視頻,驗證系統(tǒng)在復(fù)雜場景下的實時渲染與決策輔助能力。
而這還只是明線。暗線里,還有一層心理博弈。預(yù)測對了,是“我們家產(chǎn)品優(yōu)秀”。預(yù)測錯了?這正好說明“足球的魅力,人類的勝利”。更何況,“準(zhǔn)不準(zhǔn)”從來不是人們使用AI的第一誘因。“AI有沒有用、方不方便用”才是。
如此看來,這場秀的本質(zhì)是用極低成本撬動高價值,四兩撥千斤。“秀”不是博眼球,而是一塊技術(shù)試金石。
02
三重“詛咒”
回顧近期賽事,巴西對陣挪威這場賽事在預(yù)熱階段就引發(fā)了不少關(guān)注。一個是傳統(tǒng)豪強,另一個時隔28年才闖進16強,實力懸殊。不僅巴西球迷提前慶祝,市面上12家AI也齊刷刷押注巴西,個個信心滿滿。
結(jié)果呢?終場哨響,比分定格在1:2。
![]()
(圖源:中央廣播電視總臺)
12家AI全軍覆沒。
這是偶發(fā)的嗎?并不是。烏拉圭對陣佛得角,12個AI均預(yù)測烏拉圭勝,結(jié)果2:2戰(zhàn)平;Kimi把冠軍票投給德國隊,卻輸給了巴拉圭。AI賽果預(yù)測頻頻翻車的背后,是三道無法繞開的“詛咒”。
第一重“詛咒”源于AI對數(shù)據(jù)的依賴。賽場上,可量化的數(shù)據(jù)和不可量化的數(shù)據(jù)在維度上的差異,讓AI從一開始就陷入了被動。
先說可量化的一半,也就是歷史戰(zhàn)績、跑動距離、傳球成功率等。將它們喂進去,模型跑通。表面上嚴(yán)絲合縫,但表象之下的隱患同樣醒目。聯(lián)賽數(shù)據(jù)占了整整七成,而國家隊杯賽的樣本屈指可數(shù)。相當(dāng)于你讓一個只讀過《聯(lián)賽百科全書》的人,去寫《杯賽畢業(yè)論文》。偏科,幾乎是必然的結(jié)果。
可這還不是最難的。高原反應(yīng)、賽前失眠、更衣室氣氛......這些變量每一件都在真實地改寫比賽走向。它們不可量化,更為棘手。AI連分析它們的“門”都沒有,于是就只能假裝它們不存在,或者用一句“球員狀態(tài)一般”這樣的模糊標(biāo)簽,把千變?nèi)f化的人類情緒粗暴地塞進一個頁腳里。
可量化的喂不飽,不可量化的吃不進。所以,AI的每一次預(yù)測,從入口處就已經(jīng)帶上了系統(tǒng)性偏見。它不是“算錯了”,是“看問題的角度天生就歪”。
第二重“詛咒”是共識的幻覺。12家AI集體押注巴西,結(jié)果的高度統(tǒng)一,恰恰暴露了AI產(chǎn)品同質(zhì)化的本質(zhì)。
它們輸入同一套Opta數(shù)據(jù)源,跑類似的蒙特卡洛模擬,連底層架構(gòu)都基于Transformer。所謂的“獨立思考”,從一開始就不存在。這就像深圳華強北的AI玩具,商家用豆包等通用大模型,配上東莞玩具廠的公版外殼,貼上芯片模組就上架了,功能千篇一律,導(dǎo)致退貨率一度沖到40%。
當(dāng)AI的“獨立思考”只是在共用同一個大腦時,再多的大模型不過是套上了不同的馬甲。同時,集體也可能因為沒有異見者,而喪失“糾偏”、“糾錯”和“更新”的能力。更微妙的是,這種趨同會給人帶來虛假的安全感:“所有AI都說巴西贏,那穩(wěn)了啊。”
AI們不會吵架,它們只會互相點頭確認(rèn)偏見,然后默契地一錯到底。
第三重“詛咒”是最為隱秘、也最致命——“薛定諤的貓”。被觀測,就坍縮。當(dāng)Kimi把224頁預(yù)測報告公之于眾,當(dāng)通義高調(diào)宣布“巴西奪冠”,“公開”本身就開始改變它試圖預(yù)測的那個未來。
巴西球員看到了,心理負擔(dān)加一層;對手教練看到了,戰(zhàn)術(shù)針對性加一級;球迷情緒煽動了,輿論累積。一旦說出口,世界就會圍著這句話重新博弈。球員可能因“被看好”而輕敵,也可能因“不被看好”而爆發(fā)。AI算得出射門轉(zhuǎn)化率,但算不出一個人在被全世界否定時能爆發(fā)出多大的能量。
這就導(dǎo)致一個悖論:AI越強大、預(yù)測越公開,準(zhǔn)確性反而可能越低。它不是在預(yù)測未來,而是在預(yù)測一個被自己預(yù)言所改變的新未來。
03
“真金”浮出水面
比賽過半,32強出爐。各家AI紛紛交出了自己的第一份成績單。騰訊混元命中29支晉級球隊位列榜首;MiniMax命中28支;DeepSeek和智譜命中27支。AI陣營整體命中率61.9%,比人類專家高出7.3個百分點。
![]()
但排名只是表象,真正值得追問的是成績背后,各家AI分別秀出了什么技術(shù)底牌?
DeepSeek在預(yù)測中的成績不算驚艷,但它的算力成本僅為同類模型的1/10。將這套“低成本推理”能力遷移到汽車碰撞測試、材料疲勞分析等標(biāo)準(zhǔn)化參數(shù)環(huán)境中,能將單次仿真從數(shù)小時壓縮到分鐘級,也能幫助工程師快速篩選方案方向。目前已有二十家車企將其作為“第一道過濾器”。
而在醫(yī)療場景中。騰訊混元支撐的“小覓AI助手”能在23秒內(nèi)自動檢索患者歷史影像,分析病變趨勢,一鍵生成報告初稿。目前已服務(wù)近萬家醫(yī)療機構(gòu),病歷小結(jié)準(zhǔn)確性達87%。
![]()
(圖源:騰訊云官網(wǎng))
不過,相較于世界杯,醫(yī)療場景的容錯率更低。AI光算得準(zhǔn)遠遠不夠,因為醫(yī)生需要知道“為什么”,患者需要知道“責(zé)任歸誰”。所以,或許用AI做預(yù)篩和初稿,醫(yī)生做復(fù)核和最終定論。這種“AI窮盡可能、人類最終拍板”的協(xié)作模式,才是低容錯場景里最務(wù)實的路徑。
如果說醫(yī)療場景考驗的是AI的“可解釋性”,那Kimi在世界杯上展示的,則是拆解能力。它把“比賽結(jié)果”這一復(fù)雜問題拆解 為戰(zhàn)術(shù)、傷病、賠率等多維度 ,交給不同Agent并行計算。 在產(chǎn)業(yè)里,它同樣可以一個Agent讀財報,一個爬輿情,一個分析行業(yè)周期。各管一攤,各有視角。當(dāng)“財報Agent”說“這家公司現(xiàn)金流穩(wěn)健”,當(dāng)“輿情Agent”發(fā)現(xiàn)“高管密集減持”, 多個Agent各自亮出判斷 , 交叉驗證 。最終把“未知的混沌”變成“有概率的清單”,把決策范圍從大海撈針壓縮到十選一。
![]()
(圖源:KIMI)
同一個考場,不同的答卷。有的強在MoE架構(gòu)的效率,有的強在多Agent協(xié)同的復(fù)雜度,有的強在多模態(tài)融合的廣度。世界杯這場“技術(shù)高考”沒有輸家,每一份答卷都在告訴行業(yè):我的能力邊界在哪,我的技術(shù)能去哪。
總而言之,或許我們不該把AI預(yù)測看作“神諭”,它更像一臺“超級計算器”。它的價值不在于告訴你“答案是哪個”,而在于窮盡可能性,把混沌轉(zhuǎn)化為概率,成為人類做選擇時最值得參考的“軍師”。
但它仍然回答不了創(chuàng)始人在絕境中能否扛住、更衣室里那口氣是散還是聚、它也甩不掉那只注定終身相隨的“貓”。最終拍板的那一步,或許永遠要留給人類自己。
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.