昆侖萬維WAIC專場論壇:從“生成內容”到“理解物理世界” AI迎來關鍵轉折 ...
原標題:昆侖萬維方漢WAIC拋三大產業預判:世界模型將走出屏幕,游戲與音樂行業迎來“范式躍遷”7月19日,在2026世界人工智能大會(WAIC)期間,昆侖萬維舉辦“世界模型與多模態范式躍遷”專場論壇。會上,昆侖萬維董事長兼CEO方漢正式宣布2026年為“世界模型元年”,並集中發布了Matrix-Game 3.5世界模型與Mureka v9.5&O3音樂模型的升級。這標志著昆侖萬維在多模態賽道上,正推動AI從單純的“內容生成”向“理解物理世界”與“深度情感交互”邁進。
Matrix-Game 3.5:Patch級記憶注入,突破實時交互瓶頸
作為開源多模態世界模型,Matrix-Game 3.5在本次升級中實現了Patch級記憶注入與系統級性能優化。Skywork首席科學家成宇介紹,該模型在5B參數規模下,即可實現720p分辨率單卡20FPS的實時生成,並具備1分鐘記憶能力。
在技術架構上,Matrix-Game 3.5創新性地將歷史幀切分為帶有3D坐標的Patch Memory。推理時,系統根據當前相機視錐檢索可見Patch並重新投影,作為Memory Token注入DiT模型,從而實現長期一致性的Patch級空間記憶。這一設計有效解決了傳統Frame-level FOV Memory的痛點,帶來了更准確的空間檢索、更穩定的相機運動生成以及用戶可自由編輯記憶塊的可控能力。
此外,通過“減少模型吞吐+DiT模型優化+VAE剪枝”三重推理加速手段,Matrix-Game 3.5真正具備了實時交互能力。成宇指出,世界模型是具身智能的“無限數據引擎”。該模型構建了自動化數據生產管線,目前已積累超500萬高質量視頻切片、超1萬有效訓練小時數,覆蓋1200余個游戲場景,為下一代世界模型提供了堅實的數據底座。
Mureka v9.5&O3:告別“AI味”,開啟音樂版本化制作時代
在AIGC創作賽道,Mureka v9.5&O3的發布引發了廣泛關注。v9.5版本首次打出“最沒有AI味的AI音樂模型”標簽,不再依賴聲部堆砌制造復雜的聽感,而是在真實的音樂框架中,以克制的方式處理編配、人聲與情緒,讓音樂表達更自然、真誠。
基於v9.5底座,O3模型通過test-time scaling擴展了MusicCoT的推理過程。它能夠在生成過程中持續審視當前表達,回看偏差並進行自我修正,使音樂思維鏈逐步收斂。評測數據顯示,Mureka O3在情感表達得分上達到7.88,在編曲結構上達到7.20,全面領先同類競品。
更為重要的是,Mureka已從單一生成工具演進為“版本化制作”平台。用戶可通過自然語言調用整曲生成、單軌生成、Remix等全鏈路能力﹔同時推出的Character功能,僅需一段聲音或一張照片即可生成專屬歌手角色,貫穿歌曲與MV創作。正如昆侖萬維所倡導的,AI音樂正升級為一種自我表達的語言,大幅降低了創作門檻,釋放了大眾的深層創作力。
行業影響與高管觀點:AI重塑文娛與物理世界
方漢在論壇上系統闡述了三大產業預判:第一,世界模型將走出屏幕進入物理世界,成為具身智能在陌生環境下“看得懂、做得對”的底層能力﹔第二,游戲行業將率先被世界模型改變,開放世界將隨玩家行動實時生長﹔第三,AI音樂、視頻等工具將促進AIGC的深層發展。
這一趨勢在圓桌對話中得到了印証。愛奇藝高級副總裁楊海濤透露,平台每日收到超3000部AI短劇,AI在特效制作上已實現超50%的提效。
從Matrix-Game 3.5的開源生態構建,到Mureka打通音畫創作閉環,昆侖萬維正以全模態技術重塑文娛與物理世界的交互范式。在“世界模型元年”的起點,昆侖萬維不僅交出了全球領先的模型答卷,更為AGI時代的下一場多模態范式革命按下了加速鍵。(來源:央廣網)
(責編:董童、李源)
關注公眾號:人民網財經
頁:
[1]
