facebookresearch

vjepa2

facebookresearch

PyTorch code and models for VJEPA2 self-supervised learning from video.

AI 简介

V-JEPA 2 是一个基于视频的自监督学习框架,用于训练高质量、时序一致的视频表征模型。其核心采用密集预测损失、多层深度自监督、多模态分词器及模型/数据扩展等技术,支持从原始视频中无监督地学习时空语义特征;衍生模型V-JEPA 2-AC进一步支持机器人动作规划与操作任务。适用于视频理解、动作预测、世界建模及具身智能等需要强时序建模能力的研究场景。

Python
MIT License
4.4k
Stars
549
Forks
48
Watchers
72
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分60.22
默认分支main