核心要点

  • 定义深度:单目估计 vs 立体/结构光

  • 说明在机器人、AR、自动驾驶中的作用

  • 了解双目视差、SfM、深度网络

  • 指出尺度模糊与传感器融合:回答时要先解释它的含义,再补一句适用场景或工程例子,避免只背名词。

简要回答

深度感知恢复场景三维结构,使机器理解物体距离与空间布局。双目视差、结构光、ToF 与单目深度估计网络(MiDaS)支撑机器人避障、AR 遮挡、自动驾驶路径规划与抓取。

标准回答

一、为何重要

2D 图像丢失距离信息;深度使系统能判断障碍物远近、场景几何、真实尺度,是物理世界交互的前提。

二、获取深度方式

  1. 双目立体:视差 $d$,深度 $Z = fB/d$(基线 B、焦距 f)
  2. 结构光 / ToF:主动投射图案或测量飞行时间
  3. 运动结构 SfM:多视角三角化
  4. 单目深度估计CNN/Transformer 学先验(尺度模糊)

三、应用场景

  • 自动驾驶:可行驶区域、障碍物距离、融合激光雷达
  • 机器人:抓取规划、SLAM、避障
  • AR:虚实遮挡、平面检测、锚定
  • 工业:体积测量、缺陷三维形貌

四、挑战

  • 单目尺度不确定
  • 透明/反光/无纹理表面
  • 室外远距离精度
  • 实时性与标定维护
    工具:RealSense、OpenCV StereoBM/SGBM、PyTorch 深度模型。详见 三维视觉

回答思路

  • 【定义】用一句话说清「深度感知在计算机视觉应用中有何意义」

  • 【原理】讲清关键机制或步骤(2~3 点)

  • 【例子】举一个真实项目、论文或产品中的例子

  • 【对比】与易混淆概念或替代方案比较(如有)

  • 【收尾】总结适用场景 + 一个局限或风险

延伸学习

延伸阅读:三维视觉与深度。术语:语义分割CNN。工具:OpenCV

常见误区

⚠️ 常见踩坑

误区一:容易答偏的地方:认为单目深度绝对准确;不说立体视觉基线限制;忽略与 IMU/LiDAR 融合。

追问

追问 1单目深度为何尺度模糊?

同样投影大小可能是近处小物或远处大物。网络靠绝对尺寸先验(车、人高度)猜尺度,换域需微调或用已知参考物标定。

追问 2LiDAR 和视觉深度互补吗?

LiDAR 稀疏但度量准确;相机稠密带语义。融合(BEV、点云投影)是自动驾驶主流,互补天气与距离盲区。

追问 3NeRF 和深度图关系?

NeRF 隐式建体积密度,可渲染新视角并导出深度;适合物体重建,实时 SLAM 仍多用传统/深度网络深度图。

🔗 相似问题

同一考点的不同问法,换着练更稳

没找到想看的面试题?把你想看的告诉我们 →

延伸学习

按主题分类的相关资源,便于系统复习