7 月 19 日,在 2026 世界人工智能大会(WAIC)期间,昆仑万维举办 " 世界模型与多模态范式跃迁 " 专场论坛。会上,昆仑万维董事长兼 CEO 方汉正式宣布 2026 年为 " 世界模型元年 ",并集中发布了 Matrix-Game 3.5 世界模型与 Mureka v9.5&O3 音乐模型的重磅升级。这标志着昆仑万维在多模态赛道上,正推动 AI 从单纯的 " 内容生成 " 向 " 理解物理世界 " 与 " 深度情感交互 " 迈进。

昆仑万维董事长兼 CEO 方汉
Matrix-Game 3.5:Patch 级记忆注入,突破实时交互瓶颈
作为世界首个开源多模态世界模型,Matrix-Game 3.5 在本次升级中实现了 Patch 级记忆注入与系统级性能优化。Skywork 首席科学家成宇介绍,该模型在 5B 参数规模下,即可实现 720p 分辨率单卡 20FPS 的实时生成,并具备 1 分钟记忆能力。

Skywork 首席科学家成宇
在技术架构上,Matrix-Game 3.5 创新性地将历史帧切分为带有 3D 坐标的 Patch Memory。推理时,系统根据当前相机视锥检索可见 Patch 并重新投影,作为 Memory Token 注入 DiT 模型,从而实现长期一致性的 Patch 级空间记忆。这一设计有效解决了传统 Frame-level FOV Memory 的痛点,带来了更准确的空间检索、更稳定的相机运动生成以及用户可自由编辑记忆块的可控能力。
此外,通过 " 减少模型吞吐 +DiT 模型优化 +VAE 剪枝 " 三重推理加速手段,Matrix-Game 3.5 真正具备了实时交互能力。成宇指出,世界模型是具身智能的 " 无限数据引擎 "。该模型构建了自动化数据生产管线,目前已积累超 500 万高质量视频切片、超 1 万有效训练小时数,覆盖 1200 余个游戏场景,为下一代世界模型提供了坚实的数据底座。
Mureka v9.5&O3:告别 "AI 味 ",开启音乐版本化制作时代
在 AIGC 创作赛道,Mureka v9.5&O3 的发布引发了广泛关注。v9.5 版本首次打出 " 最没有 AI 味的 AI 音乐模型 " 标签,不再依赖声部堆砌制造复杂的听感,而是在真实的音乐框架中,以克制的方式处理编配、人声与情绪,让音乐表达更自然、真诚。
基于 v9.5 底座,O3 模型通过 test-time scaling 扩展了 MusicCoT 的推理过程。它能够在生成过程中持续审视当前表达,回看偏差并进行自我修正,使音乐思维链逐步收敛。评测数据显示,Mureka O3 在情感表达得分上达到 7.88,在编曲结构上达到 7.20,全面领先同类竞品。
更为重要的是,Mureka 已从单一生成工具演进为 " 版本化制作 " 平台。用户可通过自然语言调用整曲生成、单轨生成、Remix 等全链路能力;同时推出的 Character 功能,仅需一段声音或一张照片即可生成专属歌手角色,贯穿歌曲与 MV 创作。正如昆仑万维所倡导的,AI 音乐正升级为一种自我表达的语言,大幅降低了创作门槛,释放了大众的深层创作力。
行业影响与高管观点:AI 重塑文娱与物理世界
方汉在论坛上系统阐述了三大产业预判:第一,世界模型将走出屏幕进入物理世界,成为具身智能在陌生环境下 " 看得懂、做得对 " 的底层能力;第二,游戏行业将率先被世界模型改变,开放世界将随玩家行动实时生长;第三,AI 音乐、视频等工具将促进 AIGC 的深层发展。
这一趋势在圆桌对话中得到了文娱界人士的印证。演员王珞丹坦言,创作者始终是表达的核心,AI 能带来超出想象的流动性;中国电影家协会副主席黄晓明表示,AI 生成的细节已难以分辨,他不仅认可其创作价值,更表达了投资 AI 相关项目的意愿;爱奇艺高级副总裁杨海涛透露,平台每日收到超 3000 部 AI 短剧,AI 在特效制作上已实现超 50% 的提效。
从 Matrix-Game 3.5 的开源生态构建,到 Mureka 打通音画创作闭环,昆仑万维正以全模态技术重塑文娱与物理世界的交互范式。在 " 世界模型元年 " 的起点,昆仑万维不仅交出了全球领先的模型答卷,更为 AGI 时代的下一场多模态范式革命按下了加速键。


登录后才可以发布评论哦
打开小程序可以发布评论哦