今天,又是每年都非常重磅的火山引擎Force原動力大會了。
![]()
有一說一,人是真多啊。
基本上每年這個時候,就是豆包模型全家桶的年度更新。
今年自然也不例外,所有的模型基本就是全面升級。
人在現(xiàn)場,也第一時間給大家總結(jié)一下這次大會和我覺得值得說的亮點。
希望對大家有用。
一. Seed 2.1 Pro
這個模型,基本就是今天最重頭戲了。
今天,正式發(fā)布了Doubao-Seed-2.1-pro和Doubao-Seed-2.1-turbo。
![]()
畢竟在這個時代,模型就是一切。
而基礎(chǔ)模型,是所有心懷夢想的廠商,永遠(yuǎn)不可能放棄的話題。
Seed的基模在過去,在2025年初,可以說確實是個很棒的模型,那時候大家都還在卷推理,卷多模態(tài)。
可2025年,有太多的事情發(fā)生,Manus橫空出世,將大家對于Agent的理解向前推了一大步,然后就是Claude Code+Claude讓企業(yè)客戶直接用腳投票,那段時間,Anthropic憑借著Coding和Agent能力的一騎絕塵,甚至將OpenAI都遠(yuǎn)遠(yuǎn)甩在了身后。
而Seed慢了, 在這個 Coding和Agent的能力幾乎已經(jīng)約等于模型智能能力水平的時代里,也逐漸越來越被人遺忘。
而這次基模 Seed-2.1-Pro ,在憋了很多之后,終于發(fā)布了,他們的多模態(tài)能力依然是王者,這個你絲毫不用懷疑字節(jié)在多模態(tài)上的能力,豆包手機和Seedance就能看出來這塊的積累,而之前一直以來,都是巨大短板的Coding和Agent能力,在這半年持續(xù)不斷的猛追之下,在這一次,也終于算是能打了,也終于算是到了可用級別。
老規(guī)矩,先看下評分。
![]()
Coding能力,確實是補了一大波,有些地方能摸一摸Opus 4.7的級別,比最新一代的模型還是差點了,差距坦誠的講,還是有的。
Agent能力,也就是各種工具調(diào)用還有長程任務(wù)上,倒是大幅進(jìn)化了不少。
![]()
現(xiàn)場還有一個秀Agent能力的我覺得挺牛逼的,還是蠻秀的。
![]()
目前 Seed-2.1系列在 火山、Trae、豆包上等等均已上線,也兼容所有的Agent框架,我直接在Claude Code里測了下。
我對它的評價是,一個非常綜合的水桶級模型,雖然在Coding能力上,離Claude這種還有差距,但是這回至少是上桌了,然后他強就強在,水桶。
因為這玩意,在世界知識、多模態(tài)上,都有不錯的表現(xiàn)。
一個還是多模態(tài)的能力,一個基模如果沒有多模態(tài),其實我覺得還是比較傷的,就像DeepSeek V4 Pro還有GLM-5.2,Coding能力確實都很強,但是最大的問題,還是沒有多模態(tài)。
而Seed系列的多模態(tài)一直都是國際領(lǐng)先的水平,視覺理解的能力在幾乎所有評測集上都是TOP。
你讓它看文檔、看圖表、看視頻,基本上能力都非常的強,一個又能寫代碼又能看圖看視頻的模型,跟一個只能寫代碼的模型,在實際業(yè)務(wù)場景里能做的事情還是有不少差距的。
舉個例子,我自己開發(fā)的AI資訊監(jiān)控網(wǎng)站AIHOT上,會對我們所有抓取到的內(nèi)容進(jìn)行摘要總結(jié)及評分。
比如今天早上抓到的這篇Google的內(nèi)容,下面那一段文字,就是我對原文的摘要和總結(jié),右上角就是AI系統(tǒng)對它的打分以及是否值得被精選。
![]()
但這個總結(jié)和評分,其實是丟信息的,因為原文里面是有圖片的,甚至很多的模型里面,是有視頻的。
![]()
而我背后用的模型,是兩個沒有多模態(tài)能力的純文本模型,一個小一點的,用來翻譯+總結(jié)和摘要,一個大一點的,用來評分。
因為丟失了多模態(tài)的信息,特別是這個評分,有的時候是不公平的,比如說X上的一些信息,可能只是發(fā)了個質(zhì)量很高的播客視頻,但是只簡單配了兩句話,那就很有可能,是會被我的精選系統(tǒng)過濾掉的。
很多發(fā)圖片比較多的內(nèi)容也是如此,比如,小紅書和B站,這些上面的一些信息我過去一直沒有監(jiān)控,不是因為我監(jiān)控的技術(shù)手段做不到,是過去我找不到一個比較好的支持多模態(tài)的評分模型,所以一直就沒干。
那 Doubao-Seed-2.1上了之后,我覺得完全可以把背后的這個模型,換成用 Doubao-Seed-2.1-turbo來進(jìn)行摘要,用Seed-2.1-Pro來進(jìn)行評分,支持我AIHOT上多模態(tài)內(nèi)容的生態(tài)。
說干就干,我直接把Claude Code里面的模型,用CC switch換成了 Seed-2.1-Pro,讓他自己來開發(fā)自己。
![]()
然后把我上面說的那段話,直接當(dāng)做Prompt,扔了進(jìn)去,先讓他做摘要和總結(jié)這塊的迭代,因為精選評分那塊改模型整體改動太大了,Promtp、閾值、公式算法什么的都需要調(diào)整,還要做全量的線上數(shù)十萬條數(shù)據(jù)的全量回測,不是一時半會就能干完的。
![]()
這個任務(wù)開發(fā)難度不算很高,但是也沒有那么簡單,就是我的那個代碼,因為后端流程有點復(fù)雜了,亂七八糟的細(xì)節(jié)太多了,而且過去沒有把圖片扔進(jìn)去推理的先例,圖片緩存和持久化啥的全都沒做,所以要考慮的細(xì)節(jié)還是很多的。
在思考了十幾分鐘以后,Doubao-Seed-2.1-pro給了我一個詳細(xì)的方案。
![]()
考慮的還是比較全面的,一些對抗性審查的方案還有風(fēng)險的應(yīng)對措施,基本都考慮到了。
![]()
沒啥問題,我就直接讓他開工了。
![]()
大概在30分鐘后,開發(fā)完成了。
基本沒啥問題,前面的圖片緩存、抓取、壓縮流程啥的都能跑通,整體都還不錯。
但是出現(xiàn)了一個很詭異的BUG,就是莫名其妙的,跑一個文字+多圖的摘要,失敗了一大半,長的甚至要幾分鐘之多,我都干懵了,我以為火山的API這么慢??
結(jié)果讓它找了半天原因,發(fā)現(xiàn)是Doubao-Seed-2.1默認(rèn)開了深度思考,所以本來就慢,然后自己又給自己寫了個300秒超時,然其中一個圖片的包裝函數(shù)又寫錯了。
改了兩輪,搞了10分鐘,才把這個事解決,然后讓他給我列了一個100條數(shù)據(jù)的回測報告,這一次,發(fā)現(xiàn)推理速度變得極其牛逼,延遲幾乎只要3.5s就能直接出。
![]()
回測報告的UI展示上,我覺得中規(guī)中矩,前端審美是能看的,干凈清爽,也沒啥特別的錯位BUG。
![]()
摘要的信息準(zhǔn)確性無敵,香爆了。
我感覺我的AIHOT在信息質(zhì)量上,又要邁向新一波質(zhì)量的升級了。
然后還有兩個點我覺得還是需要說一下,價格和上下文長度。
首先是價格,這個價格相比海外,確實不算貴了,¥6 / ¥30每百萬token(輸入/輸出),但是相比國內(nèi)DeepSeek這種直接干到個位數(shù)級別的爹,感覺還是有優(yōu)化空間。
上下文還是卡在了256k,沒有到達(dá)主流的1M,這個還是比較可惜的。
坐等Doubao-Seed的下一個版本了。
二. 豆包辦公模式
因為 Doubao-Seed-2.1-Pro正式發(fā)布了,所以,還有一個很重要的功能應(yīng)該也要即將正式上線了。
也是豆包專業(yè)版。
這其中專業(yè)版我覺得最核心的功能,我覺得就是我這兩天一直在測的,基于 Doubao-Seed-2.1-Pro的豆包辦公模式,也是豆包的Agent。
因為我已經(jīng)提前拿到了內(nèi)測資格,當(dāng)你打開豆包客戶端之后,就能在下面看到這個東西。
![]()
基于 Doubao-Seed-2.1-Pro的辦公任務(wù)。
Agent時代下驅(qū)動的通用辦公場景,也是所有廠子我覺得不可能放棄的一環(huán)。
豆包的辦公模式其實之前就有了,但是之前的體驗,坦誠的講,我自己體驗下來,說實話確實一般。
核心原因還是基模,因為之前跑的是Seed 2.0 Pro,這個模型多模態(tài)能力很強,理解力也不差,但是在Agent和Coding能力上的短板,導(dǎo)致它在執(zhí)行一些稍微復(fù)雜辦公任務(wù)的時候,就表現(xiàn)比較一半了。
而這次,底座換成了 Seed-2.1-Pro 。
不要小看這個“換底座”三個字。對于一個AI產(chǎn)品來說,底座模型的能力升級,可能比產(chǎn)品本身做任何改進(jìn)都更有效,真的,產(chǎn)品團(tuán)隊搞半年的交互優(yōu)化、流程重構(gòu),在現(xiàn)在,我覺得可能不如底座模型在Agent能力上提升個20%來得實在。
這就是我一直說的,模型就是一切。
我們自己體驗下來,變化還是挺明顯的。
打開豆包的桌面客戶端,在輸入框下側(cè)選擇辦公任務(wù),就能進(jìn)入。
辦公任務(wù)下,我們直接選中本地電腦,它就能夠去訪問到你本地電腦環(huán)境中的各種文件。
![]()
你可以指定某個項目文件夾,也可以不指定。
![]()
豆包自己也自帶了一堆skills,Agent在執(zhí)行任務(wù)的時候會自動調(diào)用。
![]()
我測試了一些任務(wù),在豆包辦公模式的表現(xiàn)上, Seed-2.1-Pro 整體能力發(fā)揮的還不錯。
舉個例子。
我讓它來做我們財務(wù)同事之前跟我講的他們一個工作流。
月底報銷的時候,她需要把全公司所有人的發(fā)票都匯總到一個飛書多維表格上。
這種活交給Agent來干最合適不過了。
這里出于隱私,我拿1月的發(fā)票來演示。
![]()
打開辦公模式,我直接在收集了全公司發(fā)票的目錄下,讓他去匯總所有人的發(fā)票的信息,按照報銷人的格式填到多維表格里面。
![]()
它會先申請訪問文件的權(quán)限和執(zhí)行腳本的權(quán)限。
![]()
然后還會申請飛書文檔的編輯權(quán)限。
![]()
等你都授權(quán)之后,它就庫庫開始干了。
![]()
然后就能看到,它把公司各個部門按照每一個報銷人,一共210個發(fā)票上的信息都提取出來,填到了我指定的多維表格里。
![]()
基本上沒有什么問題,這個就體現(xiàn)出Agent能力和多模態(tài)模型的省心省力了。。。
然后測了下聯(lián)網(wǎng)、收集信息調(diào)研的能力。
正好過幾個月我們辦公室的租期就到了,再加上越來越多的小伙伴加入我們,現(xiàn)在的辦公室確實有點坐不下了。
所以我們最近就瘋狂的在朝陽找新的、更大的地方。
目前行政那邊,根據(jù)預(yù)算和交通方面的要求,實地也跑了一些,最后選了3個備選方案。
正好昨天下午給我的,我也不太懂,我就把這3個地方丟給豆包,把要求告訴它,讓它幫我出一個對比方案,如果有它覺得更合適的地方,也可以推薦。。
![]()
它就去網(wǎng)上搜了一大堆資料,最后給了一份很詳細(xì)的報告。
先從各個維度全面對比了3個地方,然后分別介紹優(yōu)缺點,還額外給出了幾個推薦的地方。
![]()
這個租金報價預(yù)估,居然基本都是真實的,跟我昨天行政拿給我的報價,幾乎就沒差個多少錢。。。
同樣為了看得更直觀,我又讓它生成了一個PPT。
它會自動調(diào)用做PPT的技能去生成。
![]()
一輪直出的效果長這樣。
![]()
就只能說,能看,這塊我盤了一下,大概率是skill的原因。
這塊我建議可以加歸藏的PPT skill,可能視覺效果會更好一點。
我自己也拿我之前測一些通用辦公任務(wù)的30個題目的測試集,在基于Doubao-Seed-2.1-Pro之上的豆包辦公任務(wù)跑了下回測。
最終效果長這樣。
![]()
數(shù)據(jù)分析那邊跟Gemini有點像,有時候會自作主張,踩中一些陷阱,比如其中的一道數(shù)據(jù)分析的題目。
![]()
但是整體來說,在有了Seed-2.1-Pro的加持之后,豆包的辦公任務(wù),也終于變得還不錯了,能在Agent這個通用辦公場景上,跟其他家正面開戰(zhàn)了。
畢竟,這可是豆包啊。
三. Seedance
Seedance這塊,作為字節(jié)的王者,這次也迎來了一波更新。
Seedance 2.0擁有4K了,而且是原生4K。
![]()
注意,是原生4K,跟后期超分是兩回事,現(xiàn)在市面上有不少4K視頻,其實就是先生成個720p或者1080p的底子,然后拿超分模型往上拉。
Seedance 2.0模型的質(zhì)量,配合上4K,基本是可以達(dá)到影視級了。
目前已經(jīng)在火山和即夢上上線。
然后就是新模型,Seedance 2.5。
![]()
更加優(yōu)秀的運動能力、分鏡能力,還有表演質(zhì)感。
而且,支持30秒的單段原生直出。
直接看視頻吧。
而且,現(xiàn)在,還支持在支持在保持畫面一致性的同時做局部調(diào)整了。
四. 寫在最后
除了上面三大塊之外。
還有兩個模型和一些功能我覺得可以快速提一下。
Seedream 5.0 pro,7月初上線。核心升級在于交互式精準(zhǔn)編輯,你可以直接在畫面上點選、圈選、用箭頭標(biāo)注來表達(dá)編輯意圖,不需要再用文字去描述空間關(guān)系了,還有多圖層分離和高密度信息表達(dá)能力的提升,一整頁PPT的信息量都能準(zhǔn)確呈現(xiàn)。
![]()
一個全新的音頻生成模型。
![]()
支持用文字、聲音參考生成音頻、全要素直出(人聲+音效+背景音一條Prompt搞定),單次可以生成2分鐘音頻并且支持延長到幾十分鐘保持一致性。
對于做有聲書和播客的人來說簡直是大殺器。
然后,火山方舟CLI也正式發(fā)布了,這對我這種后端幾乎都在火山上的開發(fā)者來說是個大利好。
![]()
能方便非常多。
![]()
整體大概就是這樣。
![]()
說到底還是那句話,模型就是一切。
字節(jié),也在向Coding和Agent,全面進(jìn)軍了。
以上,既然看到這里了,如果覺得不錯,隨手點個贊、在看、轉(zhuǎn)發(fā)三連吧,如果想第一時間收到推送,也可以給我個星標(biāo)?~謝謝你看我的文章,我們,下次再見。
>/ 作者:卡茲克、tashi
>/ 投稿或爆料,請聯(lián)系郵箱:wzglyay@virxact.com
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺“網(wǎng)易號”用戶上傳并發(fā)布,本平臺僅提供信息存儲服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.