FUURAA AI 前沿知识库
已经发生科研前沿当下

视频预训练可以学习世界的预测性结构

V-JEPA 2 从大规模视频和图像中学习运动表征、动作预判与规划能力,重点是在学习到的表示空间中预测,而不是重建每一个可见像素。

Meta AI Research2025 年 6 月 11 日复核于 2026 年 7 月 26 日
视频预训练可以学习世界的预测性结构FUURAA 原创概念视觉

现有证据说明什么

对原始来源的简明整理

V-JEPA 2 从大规模视频和图像中学习运动表征、动作预判与规划能力,重点是在学习到的表示空间中预测,而不是重建每一个可见像素。

FUURAA 编辑解读

为什么这项变化值得关注

在标注机器人示范稀缺的领域,以观察为主的训练可能成为获得物理理解的重要路径。

如何理解本条信息

已有公开依据的发展

相关事件、报告或研究结论已经公开,但其未来影响仍可能存在不确定性。

编辑说明

本页面属于教育性编辑内容,不构成法律、医疗、财务或投资建议。FUURAA 的解读独立于原始来源,不代表背书、合作关系或任何产品已经具备相应能力。