本报讯 (记者李乔宇)7月17日至7月20日,2026世界人工智能大会(WAIC2026)在上海举办。WAIC2026期间,昆仑万维科技股份有限公司(以下简称“昆仑万维”)举办“世界模型与多模态范式跃迁”专场论坛。
在论坛主旨演讲环节,昆仑万维董事长兼CEO方汉表示,2026年为“世界模型元年”。他表示,过去两年AI行业的核心命题是“生成”——生成文字、图像、视频、音乐。从2026年开始,AI的核心命题将转向“理解”与“交互”——让AI真正理解物理世界的运行规律,并能与真实环境进行闭环互动。世界模型正是实现这一跨越的关键技术底座。
方汉在演讲中系统阐述了他对AI产业发展趋势的三大预判。第一,世界模型将走出屏幕,进入物理世界。机器人将在行动前先进行环境推演——预判动作后果、评估环境变化、及时调整应对策略。
第二,游戏行业将率先被世界模型改变。他认为,开放世界游戏不再依赖数百人团队数年的手工搭建。未来三到五年,世界模型将成为游戏行业的基础设施,刷新内容生产方式,国产模型已在这一赛道领跑全球。
第三,AI音乐、AI视频等工具将从技术试验变成大众创作工具,促进AIGC(人工智能自动生成内容)的深层发展。Mureka等音乐生成模型将进一步降低创作门槛,改变音乐乃至整个AIGC产业的创作生态。
此次论坛上,昆仑万维集中完成了核心模型的重磅升级。Skywork首席科学家成宇在论坛上正式发布了昆仑万维最新迭代的Matrix-Game3.5世界模型。Matrix-Game3.5聚焦可交互世界模型技术,在720p分辨率下可实现单卡20FPS实时生成,具备1分钟记忆能力。
在此次论坛上,昆仑万维同时发布Murekav9.5与O3音乐大模型。Murekav9.5不再依赖声部堆砌和复杂编配,而是在真实的音乐框架中,以更为克制的方式处理编配、人声、情绪与Prompt意图,让音乐表达更自然、更真诚。O3让模型在生成过程中持续审视当前表达,确认局部旋律是否仍服务全曲目标,编配是否掩盖人声,情绪是否提前透支,结构是否正在偏离最初意图。
Mureka此次的迭代升级,也把音乐与视频MV接进了同一条创作链路。用户可以从一张图、一段视频开始,让系统理解画面的节奏、人物、空间和情绪,再生成与之匹配的音乐;也可以从一首歌开始,让智能体理解歌词叙事、节拍编曲和情绪起伏,继续生成角色与MV的视觉方案。
同时,Mureka已从单一的音乐生成工具演进为完整的“版本化制作”平台,同一创意可快速生成多版本,支持在旋律、人声、结构等维度进行局部保留与替换;MurekaAgent能通过自然语言一次对话调用整曲生成、单轨生成、Remix、延伸、MIDI导出、声音克隆等全部能力,全程无需切换界面。
(编辑 鲍鹏宇 张昕)