GAP-MLLM: Geometry-Aligned Pre-training for Activating 3D Spatial Perception in Multimodal Large Language ModelsPublished in ECCV 2026, 2026Share on Twitter Facebook LinkedIn Previous Next