多视图立体视觉(MVS)利用已知的相机位姿,从多张图像中恢复密集的3D形状。本文系统地阐述了照片一致性这一核心原理,以及平面扫描和基于图像块的两种经典方法(PMVS),以MVSNet为代表的深度学习方法,以及通过深度图融合进行网格划分的方法,并结合公式和图表,探讨了这些方法与立体相机和深度相机的关系。