一、由清华背景的顶尖世界模型团队创立
PrimalVerse(元昊动力)是一家专注于第五代多模态4D世界模型基模研发的AInative公司,由清华背景的顶尖世界模型团队创立。
公司以原生4D世界表征为核心,构建覆盖动态世界重建、生成、仿真与智能体训练的统一模型体系,并率先在具身智能、游戏影视、自动驾驶、医疗手术等场景中推进应用,致力于打造物理AI时代的通用世界模型基座。
投资界(ID:pedaily2012)7月23日消息,近日,4D世界模型公司「PrimalVerse」(元昊动力)宣布完成数亿元种子轮融资,由联想之星、银杏谷资本、啟赋资本、卓源亚洲等知名财务投资机构联合参与,手术机器人领域头部产业方精锋医疗战略投资。
1、模型需要进一步回答
据悉,本轮融资将主要用于4D世界模型基模研发及团队扩充,并持续推进其在具身智能、游戏影视、自动驾驶、医疗手术等垂直场景中的应用验证。
大语言模型让AI学会了预测下一个词,视频模型让AI开始预测下一帧画面。
但随着AI深入机器人、自动驾驶等真实物理世界的场景,模型需要进一步回答:一次行动之后,世界将发生什么?
二、回看基础模型的发展
回看基础模型的发展,第一代以GPT等语言大模型为代表,主要解决语言理解、推理与对话(文本Token );
第二代融合了图像Token和文本Token,以Nano Banana、GPT Image2.0为代表,实现图文理解与图像生成;
第三代以Sora、Seedance等为代表,引入了视频Token,开始处理时间动态与动作连续性。
1、基础模型需要进一步把空间与时间
前三代模型主要建模语言与二维视觉内容,尚未真正进入三维物理世界。
而第四代带有3D token的原生多模态大模型将开始表示几何结构和物理属性;
下一阶段,基础模型需要进一步把空间、时间、物理规律与动作交互纳入统一表征。
三、PrimalVerse团队提出
1、PrimalVerse团队提出
基于这一判断,PrimalVerse团队提出:第五代多模态大模型,将是以原生4D World Token为核心的世界模型基模( 4D = 3D +时间)。
4D World Token可以理解为模型理解物理世界的 “新语言”:它不只记录某一帧画面,还需要持续表示场景中的物体是什么、位于哪里、如何运动、具备何种材质和物理属性,以及在动作作用下将如何变化。
当语言、图像、视频、3D/4D世界状态能够在同一模型中联合训练,AI学习的将不再只是世界的视觉表象,而是世界本身的结构、规律与动作后果。
2、模型也将从 “生成一段视频”
模型也将从 “生成一段视频”,进一步走向 “运行和推演一个世界”。
PrimalVerse创始人表示:“ 4D不是世界模型的一项附加能力,而是物理世界本身的基本表达。
世界模型的第一性问题,是能否准确刻画世界从一个状态走向下一个状态,而这需要同时理解空间、时间、物理属性与交互关系。
四、判断模型是否真正理解物理世界
1、判断模型是否真正理解物理世界
我们相信,判断模型是否真正理解物理世界,最终应当与4D表征对齐;
只有先构建出原生4D世界模型,才能为不同技术路径提供统一、可信的物理世界基准。”
2、长期深耕4D世界模型关键技术
PrimalVerse希望直接从底层构建原生4D世界状态,在统一模型中同时学习空间、时间、物理与交互,并将几何、材质、运动、接触和物理属性纳入状态变化过程,定义真正面向物理AI的4D世界模型范式。
PrimalVerse核心团队来来自清华、北大、上海交大等顶尖高校,长期深耕4D世界模型关键技术,已经在4D世界模型的各个核心环节形成国际领先成果。
据悉,未来PrimalVerse将从垂直场景中的训练、仿真和内容生产需求切入,逐步构建跨场景、跨行业迁移的通用4D世界模型,成为物理AI理解、训练和推演世界的基础模型入口。

远见网
