Preprint
Sep 2026
M3GD: Multi-Modal Multi-View Geometric Diffusion for Camera--LiDAR Novel View Synthesis
M3GD is presented, a Camera--LiDAR multimodal representation for generative NVS that composes independently pretrained 2D image and 3D point-cloud foundation models without separately pretraining a cross-modal translator.
Yang Zhou, Jiuhong Xiao, Shi-Zhao Ye et al.
· 0 citations