
非生成式路线(JEPA 系):以 Meta 为代表,只在抽象表征空间做预测,不还原画面。优点是避免像素冗余、训练效率高、适合长期规划;缺点是可视化难度大、产业落地样本较少。 生成式路线:以 OpenAI、Google DeepMind、英伟达等为代表,直接生成未来画面或视频。内部又分为两种实现路径——


JEPA(联合嵌入预测架构) :在抽象表征空间做预测,避免像素级冗余,是 LeCun 认定的通往自主智能的核心路径。 扩散模型 :通过迭代去噪生成高质量视频,天然处理多种可能的未来,是当前生成式世界模型的主流实现之一。 自回归 Transformer :将画面切分为视觉 token 逐个预测,适合实时交互和无限延续场景。 多模态融合与世界状态建模 :从单一视觉预测走向视觉、语言、动作、物理状态的统一建模,支撑更复杂的决策和规划 
● END ●
北京元梦翼科技有限公司创立于2023年,以自主研发为核心,依托中科院体系研发团队,专注AI算法与物理仿真前沿技术。打通数字世界与物理世界的技术壁垒,助力实体经济实现数智化升级。业务深度布局工业安全数智实训、公共安全数智宣教、职业教育仿真实训、文旅文博数字沉浸四大板块,提供全链路、自主可控的虚实融合解决方案,赋能产业数智化转型。
夜雨聆风