商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > 科大讯飞公布人机交互口音控制专利

科大讯飞公布人机交互口音控制专利

  发布于2026-08-17 阅读(0)

扫一扫,手机访问

最近,科大讯飞在语音交互领域又放了个大招——一项关于“人机交互对话系统的口音与风格控制方法及装置”的专利正式公布。从专利摘要来看,这事儿其实挺有意思的:它瞄准的正是当前智能语音系统在口音和风格动态调控方面的短板。

简单梳理一下核心逻辑。系统首先会接收用户的对话请求,然后判断这个请求里是否包含了口音和风格的控制需求。根据判断结果,系统会设置对应的“口音槽值”和“风格槽值”并存储起来。接下来,在对话推进的过程中,系统会根据当前轮次以及用户的实际需求,对这些槽值进行更新或继承。最后,系统根据对话意图生成文本回复,再调用对应的TTS(语音合成)模型,按照当前的口音和风格设定,把文本回复合成为带有特定腔调的语音输出给用户。

这套方案解决的痛点非常明确:过去的口音与风格控制方式,要么动态调控能力太弱,要么在多轮对话中无法继承之前的状态——比如用户上一轮说“用四川话回答”,下一轮系统可能又切回标准普通话了。此外,场景适配性不足、系统扩展成本高也是老问题。科大讯飞这次把“口音”和“风格”独立出槽位进行管理,相当于给语音交互系统装了一个可随时切换的语气调节器,实用性值得期待。


本文转载于:https://www.163.com/dy/article/L18FM24A0539ARRF.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注