7月28日消息,阿里Qoder正式上線實(shí)時(shí)語音交互智能體Qoder Voice。據(jù)介紹,這是國內(nèi)首個(gè)實(shí)時(shí)語音交互智能體,用戶通過語音即可喚醒Agent,實(shí)現(xiàn)實(shí)時(shí)雙向交流和任務(wù)執(zhí)行,進(jìn)一步拓展AI編程智能體的人機(jī)交互方式。
據(jù)了解,目前多數(shù)Agent仍以文本交互為主,長上下文場(chǎng)景下輸入效率較低,而傳統(tǒng)語音交互多采用單向輸入模式,難以實(shí)現(xiàn)持續(xù)對(duì)話。Qoder Voice由實(shí)時(shí)全雙工語音模型Qwen-Audio-3.0-Realtime驅(qū)動(dòng),支持用戶與智能體實(shí)時(shí)雙向交流,并在后臺(tái)同步執(zhí)行任務(wù)。官方介紹,該模型在Artificial Analysis發(fā)布的Speech to Speech Index評(píng)測(cè)中獲得84.1分,位列全球第一。
用戶可在Qoder Quest模式主界面點(diǎn)擊語音入口,在任意界面喚起懸浮語音助手。收到語音指令后,Qoder Voice能夠自動(dòng)創(chuàng)建任務(wù)、調(diào)用工具并持續(xù)執(zhí)行,用戶無需停留在當(dāng)前頁面等待結(jié)果,還可在交互過程中隨時(shí)打斷、追問或調(diào)整需求,實(shí)現(xiàn)語音交互與任務(wù)執(zhí)行同步進(jìn)行。
除執(zhí)行任務(wù)外,Qoder Voice還支持討論式交互。面對(duì)復(fù)雜任務(wù),智能體會(huì)先生成執(zhí)行方案,用戶可通過語音進(jìn)一步補(bǔ)充需求或調(diào)整方向,系統(tǒng)再根據(jù)反饋優(yōu)化執(zhí)行。例如,在代碼重構(gòu)場(chǎng)景中,用戶可對(duì)不同方案進(jìn)行討論,并實(shí)時(shí)修改需求,提升人與Agent協(xié)同效率。
阿里方面介紹,Qoder Voice已率先登陸Qoder國際版,面向個(gè)人訂閱、個(gè)人體驗(yàn)版及企業(yè)訂閱用戶開放,并提供3天限時(shí)免費(fèi)試用,Qoder中國版也將于近期上線。
據(jù)披露,目前Qoder已服務(wù)中國一汽、中信證券、亞信科技等數(shù)十萬家企業(yè),全球用戶超過500萬。(定西)
