商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > MIT团队实现“穿墙透视”,用的是你手机里就有的传感器

MIT团队实现“穿墙透视”,用的是你手机里就有的传感器

  发布于2026-05-22 阅读(0)

扫一扫,手机访问

2012年,麻省理工学院Ramesh Raskar教授的团队在《自然-通讯》上发表了一项开创性研究:他们利用飞秒激光和精密光学平台,首次实现了对拐角后方物体的三维形状重建。这套系统的代价不菲——造价高达50万至100万美元,并且需要占据一整间实验室。

谁曾想到,仅仅十四年后,来自同一个实验室的博士生Siddharth Somasundaram,用一颗批量售价仅3.6美元的商用传感器,就实现了近乎相同的目标。

这项里程碑式的研究于今年5月20日登上了《自然》杂志。研究团队的核心硬件,是一颗意法半导体的VL53L8CX飞行时间传感器芯片。这颗边长仅6.4毫米的芯片,集成了940纳米垂直腔面发射激光器和一个单光子雪崩二极管探测器阵列,能以每秒30帧的速度捕获深度信息。整套演示系统的硬件成本被控制在100美元以内,无需任何额外校准,却能稳定探测到视线之外的隐藏物体。


图丨消费级非视距成像(来源:Nature)

这种听起来颇具科幻色彩的技术,其背后的物理原理其实相当直观。它依赖于激光脉冲在场景中的多次反射:光从传感器发出,先打到可见的墙面上,其中一部分光子会继续弹射到墙后隐藏的物体上,再反射回墙面,最终被传感器捕获。通过精确测量这些“曲折旅行”后抵达的光子的飞行时间,系统就能反推出隐藏物体的位置与轮廓。在这个过程中,那面可见的墙,本质上充当了一面“虚拟的镜子”。

这项技术被称为非视距成像,在学术界已耕耘了十多年。2018年,O'Toole等人在《自然》上提出的光锥变换方法,曾将重建算法的效率提升了三个数量级。然而,硬件的高门槛始终是阻碍其走向实用的最大绊脚石。

实验室级别的系统依赖灵敏度极高的单光子探测器和皮秒级的时间分辨率,才能从极其微弱的多次反射信号中提取有效信息。消费级传感器则面临多重限制:出于人眼安全考虑,激光功率必须很低;为了适应动态场景,曝光时间必须很短;空间分辨率也有限。其结果就是,单帧数据中的信噪比远远不足以完成重建。

那么,Somasundaram团队是如何突破这一瓶颈的呢?他们的核心思路是放弃从单帧中寻找答案,转而寻求大量帧数据的“合力”。团队提出了一个名为“运动诱导孔径采样”的创新模型。这个模型的巧妙之处在于,它将隐藏物体的形状、物体的运动以及相机自身的运动,统一到了一个连贯的测量框架之中。

其灵感来源其实是两项非常成熟的技术:一是智能手机相机通过连拍多张照片进行合成,以提升画质和动态范围;二是合成孔径雷达通过综合多个天线位置的信号,来等效获得一个大口径天线的分辨率。MAS模型所做的正是类似的事情——它利用手持相机时不可避免的自然微小晃动,来等效扩大观测的“虚拟孔径”;同时,利用多帧数据之间的冗余信息,显著提升整体信噪比。


图丨运动诱导孔径采样模型(来源:Nature)

正如Somasundaram所解释的:“一旦我们开发出能够跨多次测量合并信息的算法,那些原本被噪声淹没的隐藏信号,就开始清晰地浮现出来了。”

在论文中,团队成功演示了该系统的三项核心能力。

首先是三维重建。只需让相机在墙面前自然移动,系统便能重建出墙后静止物体的三维点云形状。

其次是实时物体追踪。在已知物体大致形状的前提下,系统可以实时追踪其在三维空间中的运动轨迹,甚至能同时追踪多个目标。研究团队还展示了一个有趣的应用:用户戴上特制的回射材料手套后,系统可以稳定追踪被完全遮挡的双手位置。

第三项能力是利用隐藏物体进行自身定位。这对于机器人或自动驾驶系统颇具意义。当机器人面对一面缺乏纹理特征的白墙时,传统的视觉里程计往往会失效。但如果知道墙后有某个已知物体,那么分析非视距信号反而能帮助机器人精准确定自身的位置。

值得注意的是,这三项能力都实现了实时在线处理。以追踪任务为例,系统采用了粒子滤波算法,用1000个粒子来表征物体位置的概率分布,并在每秒30帧的速率下,完成粒子的运动预测、数据权重评估与重采样全过程。

当然,必须清醒认识到,目前的效果距离科幻电影中的“透视”画面还有巨大差距。Somasundaram也坦率指出,系统恢复的只是微弱信号中极其稀疏的几何和运动信息,与手机摄像头拍摄的百万像素级清晰图像不可同日而语。

系统目前依赖于几个较强的先验假设:隐藏物体的形状和运动在连续帧之间需要保持相对一致,这样才能将大量微弱测量累积成强信号。如果目标突然剧烈改变姿态,或者被部分遮挡导致外形突变,亦或相机发生剧烈抖动,这些假设就会失效,导致性能下降。

论文也指出,面对真实世界中复杂的反射特性,手工设计的评分函数可能难以稳健工作。未来的改进方向,很可能需要借助机器学习来学习更优的信号匹配策略。

此外,系统对普通漫反射物体的效果,远不如对专门的回射材料。虽然论文证明了MAS模型在漫反射条件下依然有效,但由于光强遵循四次方衰减定律,且存在大量非共焦路径的干扰,信号质量会显著降低。

话说回来,这项研究能登上《自然》,或许并非因为某一项具体指标达到了极致,而在于它标志着一个重要的范式转换。过去的非视距成像研究,往往始于搭建一个价值数万美元、需要数小时精密校准的实验平台。而Somasundaram团队的工作证明,一颗量产的、现成的SPAD传感器,就足以完成有意义的追踪和定位任务,且无需物理校准或额外硬件。研究团队已在GitHub上开源了全部代码。

“我们认为这项工作最重要的意义在于技术的民主化,”Somasundaram强调,“当一项技术变得人人可及时,人们往往会发掘出远超原始研究者想象的应用场景。”

潜在的应用方向已经可以窥见一斑:自动驾驶汽车在盲区路口提前感知行人或车辆;仓储机器人在杂乱环境中避开拐角后的障碍;AR头显更精准地追踪用户的身体姿态……但这些可能只是冰山一角。正如研究者所言,真正革命性的应用,或许正来自他们此刻还未曾想到的领域。

参考资料:
1.https://www.nature.com/articles/s41586-026-10502-x
2.https://spectrum.ieee.org/smartphone-grade-lidar

本文转载于:https://www.163.com/dy/article/KTIAV9UG05119734.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注