CN116259320B 基于语音的车辆控制方法及装置、存储介质、电子装置 (重庆长安汽车股份有限公司)_第1页
CN116259320B 基于语音的车辆控制方法及装置、存储介质、电子装置 (重庆长安汽车股份有限公司)_第2页
CN116259320B 基于语音的车辆控制方法及装置、存储介质、电子装置 (重庆长安汽车股份有限公司)_第3页
CN116259320B 基于语音的车辆控制方法及装置、存储介质、电子装置 (重庆长安汽车股份有限公司)_第4页
CN116259320B 基于语音的车辆控制方法及装置、存储介质、电子装置 (重庆长安汽车股份有限公司)_第5页
已阅读5页,还剩35页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

基于语音的车辆控制方法及装置、存储介本发明提供了一种基于语音的车辆控制方2采用预设声纹模型识别所述语音信号的发音对象,并识别所述语音信查找与所述声音强度匹配的控制权限类型,其中,所述控制权基于所述发音对象和所述语义信息生成所述控制权限类型的其中,所述发音对象为多个,基于所述发音对象和所述采用预设声纹模型识别所述语音信号的发音对象为主驾驶用户;采用预设声纹模型识别所述语音信号的发音对象为副驾驶用户;采用预设声纹模型识别所述语音信号的发音对象为后排宾客用户。采用预设声纹模型识别所述语音信号的第一计算所述语音信号到车辆麦克风阵列中每个麦克风的传输时选择传输时间最短的目标麦克风,并判断所述目标麦克风的布局位置是若所述目标麦克风的布局位置与所述第一发音对象的驾驶位匹确定车辆麦克风阵列中每个麦克风的声音到达时刻t,以及每个麦克风接受到的声音;3若所述目标强度区间在第一区间,为所述声音强度匹配对所述多个离散片段的波形分别进行快速傅里叶变换,以将所述多个离采用预构建的隐马尔可夫链模型对观察序列进行语义解析,得到识别模块,用于采用预设声纹模型识别所述语音信号的发生成模块,用于基于所述发音对象和所述语义信息生成所述控制程序被设置为运行时执行所述权利要求1至6任一9.一种电子装置,包括存储器和处理器,其4的日常驾驶需求,同时代替部分辅助按键操作(对象和所述语义信息生成所述控制权限类型的车5为声压分贝因子系数,Lpi为第i个麦克目标声纹分量;根据所述目标声纹分量的语义信息生成所述控制权限类型的车辆控制指6信号的发音对象为后排宾客用户。目标麦克风对应驾驶位的第二发音对象输出为所述预设声纹模型的i为第i个麦克风的声音到达时刻,tmin为所有麦克风的最小声音多个声纹分量分别计算每个发音对象的控制优先级,并输出优先级最高的目标声纹分量;生成单元,用于根据所述目标声纹分量的语义信息生成所述控制权限类型的车辆控制指7[0022]本申请实施例还提供了一种包含指令的计算机程序产品,当其在计算机上运行的驾乘体验。员在没有做出创造性劳动前提下所获得的所有其他实施例,都应当属于本申请保护的范8处理器102(处理器102可以包括但不限于微处理器MCU或可编程逻辑器件FPGA等的处理装发明实施例中的一种基于语音的车辆控制方法对应的车载终端程序,处理器102通过运行[0038]传输设备106用于经由一个网络接收或者发送数据。上述的网络具体实例可包括[0039]在本实施例中提供了一种基于语音的车辆控制方法,图2是根据本发明实施例的[0042]图3是本发明一个实施场景中麦克风和驾驶位的分布示意图,在车内不同位置布9[0050]图4是本发明实施例中多麦克风阵列定位的原理图,判断参数为不同麦克风接受中无法获得声音信号发出时刻t0和原始幅值Lp0,进行声音源定位前需对t1,t2,t3,t4以及同麦克风探测到的声音时刻ti与距离Li成线性负相关,距离声音源越近的麦克风探测到的[0053]原始声音的幅值分贝数Lp可根据公式(2)计算,其中小于40dB的原始声音被认为声纹对应的分贝数定义为Lp1,副声纹对应的分贝数定义为Lp2,宾客声纹的分贝数定义为[0058]式中Lpi为第i个麦克风探测的声压分贝数,Li为第i个麦克风距离声源的空间距[0059]依托公式(4)定义双因子声源探测模型,双因子系数Di为综合考量传播时间和声本实施例的一个实施方式中,采用预设声纹模型识别语音信号的发音对象包括以下之一:号的发音对象为副驾驶用户;采用预设声纹模型识别语音信号的发音对象为后排宾客用户。音频频率信号进一步去噪,对预处理后的语音信号根据公式(5)对声音信号进行快速傅里型可按需更新。智能手机普遍具备麦克风以及高运算能力的SoC处理器等录制声纹的必备[0070]考虑到车内的噪音来自四面八方,且语音信号在时域和在车辆使用初期实现较高的准确率,本发明采取声纹模型+多麦克风阵列定位结合的方式[0072]当车机内置的特异性/非特异性声纹模型完成对主驾驶、副驾驶和宾客位置的声音源为副驾驶位置发出,则该声音源则被车机系初次识别结果和多麦克风阵列模型的二次校验结果的匹配结果同步传输至智能手机终端,不断丰富特异性声纹模型的声音源数据库并通过双向通信定期完善车机系统的特异性声声纹分量的语义信息生成控制权限类型的车象的分量语义信息对应的控制目标是否相同(如都是为了控制空调,都是为了控制音量000[0083]依据表1对各声纹赋予的权重对语音信息进行分析,对于被解读为直接影响车辆和宾客声纹的语义被判断出来为同一指令,则将该指令发送给车机并快速执行对应操作。果来标定数值参数的行为均可实现本实施例的户特异性声纹(主/副声纹)的匹配结果,以及托厂家的非特异性声纹模型的定期OTA更新来[0091]图8是根据本发明实施例的一种基于语音的车辆控制装置的结构框图,如图8所信号的发音对象为后排宾客用户。目标麦克风对应驾驶位的第二发音对象输出为所述预设声纹模型的i为第i个麦克风的声音到达时刻,tmin为所有麦克风的最小声音多个声纹分量分别计算每个发音对象的控制优先级,并输出优先级最高的目标声纹分量;生成单元,用于根据所述目标声纹分量的语义信息生成所述控制权限类型的车辆控制指该计算机程序被设置为运行时执行上述任一项方有计算机程序,该处理器被设置为运行计算机程序以执行上述任一项方法实施例中的步[0124]所述集成的单元如果以软件功能单元的形式实现并作为独立的产品销售或使用或者说对现有技术做出贡献的部分或者该技术方案的全部或部分可以以

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论