Preprint
Aug 2026
UniMoCa: Unifying Motion and Camera Controls as Visual Proxies for Faithful Human Video Generation
UniMoCa, a representation-driven framework that unifies motion and camera controls in visual space, achieves substantial gains in human motion control, camera control, temporal consistency, and camera-aware robustness with minimal additional complexity.
Liming Tan, Ye Chen, Hao Zhang et al.
· 0 citations