gulucaptain

Camera-Transformer-1

gulucaptain

🎬 Tell the camera where to go: CT-1 understands your intent and generates videos with precise, spatially-aware camera control.

AI 简介

CT-1 是一个面向相机可控视频生成的视觉-语言-相机联合模型,旨在根据图像与文本输入精准推断物理合理的相机运动轨迹,并驱动视频扩散模型生成空间感知的高质量视频。其核心技术包括基于扩散Transformer的相机轨迹预测架构、频域小波正则化损失函数,以及专为训练构建的大规模数据集CT-200K(含4700万帧)。项目适用于需自动化、语义对齐相机运镜的场景,如影视预演、虚拟制片、AI内容创作及三维场景可视化。

308
Stars
60
Forks
39
Watchers
1
Issues

Star 增长

今日0
近 7 天0
近 30 天0
综合评分5.36
默认分支main