「PrimalVerse」(元昊动力)完成数亿元种子轮融资,清华背景团队打造4D世界模型基模

一、由清华背景的顶尖世界模型团队创立

PrimalVerse(元昊动力)是一家专注于第五代多模态4D世界模型基模研发的AInative公司,由清华背景的顶尖世界模型团队创立。

公司以原生4D世界表征为核心,构建覆盖动态世界重建、生成、仿真与智能体训练的统一模型体系,并率先在具身智能、游戏影视、自动驾驶、医疗手术等场景中推进应用,致力于打造物理AI时代的通用世界模型基座。

投资界(ID:pedaily2012)7月23日消息,近日,4D世界模型公司「PrimalVerse」(元昊动力)宣布完成数亿元种子轮融资,由联想之星、银杏谷资本、啟赋资本、卓源亚洲等知名财务投资机构联合参与,手术机器人领域头部产业方精锋医疗战略投资。

1、模型需要进一步回答

据悉,本轮融资将主要用于4D世界模型基模研发及团队扩充,并持续推进其在具身智能、游戏影视、自动驾驶、医疗手术等垂直场景中的应用验证。

大语言模型让AI学会了预测下一个词,视频模型让AI开始预测下一帧画面。

但随着AI深入机器人、自动驾驶等真实物理世界的场景,模型需要进一步回答:一次行动之后,世界将发生什么?

二、回看基础模型的发展

回看基础模型的发展,第一代以GPT等语言大模型为代表,主要解决语言理解、推理与对话(文本Token );

第二代融合了图像Token和文本Token,以Nano Banana、GPT Image2.0为代表,实现图文理解与图像生成;

第三代以Sora、Seedance等为代表,引入了视频Token,开始处理时间动态与动作连续性。

1、基础模型需要进一步把空间与时间

前三代模型主要建模语言与二维视觉内容,尚未真正进入三维物理世界。

而第四代带有3D token的原生多模态大模型将开始表示几何结构和物理属性;

下一阶段,基础模型需要进一步把空间、时间、物理规律与动作交互纳入统一表征。

三、PrimalVerse团队提出

1、PrimalVerse团队提出

基于这一判断,PrimalVerse团队提出:第五代多模态大模型,将是以原生4D World Token为核心的世界模型基模( 4D = 3D +时间)。

4D World Token可以理解为模型理解物理世界的 “新语言”:它不只记录某一帧画面,还需要持续表示场景中的物体是什么、位于哪里、如何运动、具备何种材质和物理属性,以及在动作作用下将如何变化。

当语言、图像、视频、3D/4D世界状态能够在同一模型中联合训练,AI学习的将不再只是世界的视觉表象,而是世界本身的结构、规律与动作后果。

2、模型也将从 “生成一段视频”

模型也将从 “生成一段视频”,进一步走向 “运行和推演一个世界”。

PrimalVerse创始人表示:“ 4D不是世界模型的一项附加能力,而是物理世界本身的基本表达。

世界模型的第一性问题,是能否准确刻画世界从一个状态走向下一个状态,而这需要同时理解空间、时间、物理属性与交互关系。

四、判断模型是否真正理解物理世界

1、判断模型是否真正理解物理世界

我们相信,判断模型是否真正理解物理世界,最终应当与4D表征对齐;

只有先构建出原生4D世界模型,才能为不同技术路径提供统一、可信的物理世界基准。”

2、长期深耕4D世界模型关键技术

PrimalVerse希望直接从底层构建原生4D世界状态,在统一模型中同时学习空间、时间、物理与交互,并将几何、材质、运动、接触和物理属性纳入状态变化过程,定义真正面向物理AI的4D世界模型范式。

PrimalVerse核心团队来来自清华、北大、上海交大等顶尖高校,长期深耕4D世界模型关键技术,已经在4D世界模型的各个核心环节形成国际领先成果。

据悉,未来PrimalVerse将从垂直场景中的训练、仿真和内容生产需求切入,逐步构建跨场景、跨行业迁移的通用4D世界模型,成为物理AI理解、训练和推演世界的基础模型入口。

来源: 投资界-首发快讯
产业标签 AI中国/大模型与AI Agent
赞(2) 支持本站
分享到

支持本站持续更新

如果这篇内容对你有帮助,欢迎扫码支持。

支付宝扫一扫

微信扫一扫

登录

找回密码

注册