4.3亿听障人士的福音,哥大团队研发脑控助听器,最高增益12分贝
哥伦比亚大学等机构研发的脑控助听器取得突破。该系统通过解码大脑听觉皮层的注意力信号,实时识别并放大用户关注的目标人声,同时抑制背景噪音,在嘈杂环境中可将目标语音信噪比提升最高约12分贝。初步测试表明,该技术能有效减轻听障患者的认知负荷,提升语音理解准确率,展现。
在嘈杂的鸡尾酒会上,我们总能从交织的人声中精准捕捉到好友的低语。这种大脑与生俱来的选择性听力,被科学界称为“鸡尾酒会效应”,堪称人类听觉系统最神奇的能力之一。
然而,对于机器而言,从混杂声音中分离并识别单一声源却异常困难,这就是经典的“鸡尾酒会问题”。想想看,传统的助听器只会无差别放大所有声音,结果杂音与对话同步轰鸣,用户在复杂环境下依然听不清、听得累,体验大打折扣。
最近,事情有了突破性转机。来自哥伦比亚大学、加州大学旧金山分校等机构的联合团队,成功研发了一套实时闭环脑控听力系统。它直接解码大脑的注意力信号,实时放大目标人声、压制背景杂音,让人在嘈杂环境中真正做到“想听谁就听清谁”。这项彻底打破传统助听器技术瓶颈的研究,已发表于《自然·神经科学》期刊。
这项研究的核心,在于揭示了大脑如何在“鸡尾酒会”场景下,有选择性地重构目标谈话者的声谱特征。通讯作者尼玛·梅斯加拉尼(Nima Mesgarani)教授长期深耕于此,其团队此前的工作不仅证实了听觉皮层会为关注的声音产生独特的神经“标签”,更开发了一系列先进的语音分离与刺激重建模型,为从微弱神经活动中还原清晰语音奠定了坚实的理论基石。

(来源:上述论文)
传统助听器的困境与大脑的智慧
听力障碍是全球最常见的感官缺陷之一,世界卫生组织数据显示,全球有超过4.3亿人存在不同程度的听力损失。
传统助听器的核心逻辑很简单:麦克风收集所有声音,然后统一放大。但这种模式恰恰忽略了人类听觉的核心需求——选择性关注。我们的大脑天生就是一位高效的“声音导演”:你关注的人说话,大脑会强化其神经信号;无关的杂音,则会被自动抑制。传统助听器却反其道而行,把目标对话、旁人闲聊、餐具碰撞、环境噪音一股脑儿全部放大,导致原本微弱的目标声音反而被淹没在更强的噪声里。用户不得不费力分辨,久而久之,听觉疲劳、焦虑感随之而来,甚至有人最终选择放弃佩戴。
因此,一个根本性问题困扰了科学家多年:能否让助听器像大脑一样,只放大用户想听的声音,自动过滤杂音?
从“脑波解码”到“实时操控”
早在20世纪50年代,科学家就发现了“鸡尾酒会效应”背后的神经机制。基于此,“听觉注意力解码(AAD)”技术应运而生:通过分析脑电图(EEG)等信号,来识别用户当前正关注哪个说话者。
而这项新研究,将AAD推向了一个全新的高度——实时闭环控制。整个系统的工作流程堪称精妙:
首先,系统通过植入的高分辨率电极,从患者大脑听觉皮层实时采集神经信号。接着,利用线性回归模型,根据这些大脑信号快速“翻译”并重建出患者正在关注的那段声音的波形。
关键判定步骤来了:系统会将这段由大脑信号复刻出的“声音模板”,与环境中麦克风捕获的多个竞争音源进行快速相关性比对。谁的相关性最高,谁就被判定为当前的注意力焦点。
锁定目标后,系统立即行动:自动将目标音源的音量提升最高可达9分贝,同时压低其他声音。为了让音量过渡自然,避免突变带来不适,团队还引入了马尔可夫模型进行平滑处理。
三项严苛测试,证明“所想即所听”
理论很完美,实际表现如何?为了验证这套系统,研究人员招募了4名因治疗需要已在颅内植入高精度电极的癫痫患者(他们自述听力正常),进行了三项逐步升级的测试。
测试一:基础聆听。 模拟嘈杂环境,患者同时听两段对话,系统在中途开启。结果令人振奋:系统开启后,患者对目标语音的理解准确率显著提升,信噪比平均改善了12分贝。在高达75%到95%的试次中,患者明确表示更喜欢系统开启后的听觉体验。
更直接的生理证据来自瞳孔测量:患者的瞳孔扩张程度显著降低。在神经科学中,瞳孔变小通常意味着认知负荷减轻——大脑不需要费那么大劲去处理信息了,这证明系统确实让“听”这件事变得省力。

(来源:上述论文)
测试二:注意力切换。 现实中,我们随时会切换谈话对象。实验中,当患者按指令将注意力从左侧发言者转到右侧时,系统表现出了极高的灵敏度,平均仅需5.1秒就能识别出这种转变,并自动切换放大对象。
测试三:自由聆听。 这是最贴近真实生活的场景:不给任何外部指令,让患者随心所欲地切换关注对象。即便如此,系统依然能稳定捕捉这种自发的、无规律的注意力转移,精准放大目标声音。
为何不用更简单的眼神追踪?
或许有人会问:为什么不直接给助听器装个摄像头,用眼神追踪来判断用户在关注谁呢?研究团队明确指出,脑控听力比眼神追踪靠谱得多。
原因有三:其一,当两个说话人距离很近,或者听广播、公开演讲时,眼神根本无法精确区分目标。其二,现实中常有“眼神看A、耳朵听B”的情况,比如开会时眼睛看着同事,耳朵却在听邻座聊天,眼神并不能真实反映听觉注意力。其三,依靠眼神或转头来判断,长时间下来会带来额外的疲劳感。而脑波解码是全自动、无感的,用户无需任何额外动作。
迈向临床应用的希望之光
这项技术的潜力远不止于实验室。研究团队进行了一项极具人文关怀的额外测试:他们邀请了40名真实的听障患者,聆听这套系统处理后的音频。结果显示,相比于听力正常者,听障人群从中获得的理解力提升更为显著。这有力地证明了,该技术不仅在原理上可行,在解决真实世界的听力困境上,也展现出巨大的临床应用潜力。
参考文献:
Choudhari, V., Nentwich, M., Johnson, S. et al. Real-time brain-controlled selective hearing enhances speech perception in multi-talker environments. Nat Neurosci (2026). https://doi.org/10.1038/s41593-026-02281-5
Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















