CN119452668A 检查游戏情景以确定用户的话音命令的方法 (索尼互动娱乐股份有限公司)_第1页
CN119452668A 检查游戏情景以确定用户的话音命令的方法 (索尼互动娱乐股份有限公司)_第2页
CN119452668A 检查游戏情景以确定用户的话音命令的方法 (索尼互动娱乐股份有限公司)_第3页
CN119452668A 检查游戏情景以确定用户的话音命令的方法 (索尼互动娱乐股份有限公司)_第4页
CN119452668A 检查游戏情景以确定用户的话音命令的方法 (索尼互动娱乐股份有限公司)_第5页
已阅读5页,还剩24页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

2024.11.21PCT/US2023/0188402023.04.17WO2023/235064EN2023.12.07检查游戏情景以确定用户的话音命令的方法提供了一种用于执行视频游戏的会话的方2记录参与所述视频游戏的所述会话的游戏进分析所述视频游戏的所述会话的所述执行所产生的游戏使用所述游戏进行的识别的情景和语音辨识模型分析记录的将识别的文本内容应用为针对所述视频游戏的所述会话的游识别所述记录的语音的所述文本内容是基本实时对所述游戏状3.根据权利要求1所述的方法,其中所述游戏进行的所述识别的情景包括所述视频游4.根据权利要求1所述的方法,其中所述游戏进行的所述识别的情景包括由所述视频游戏的所述会话的所述执行定义的虚拟环境中的识别5.根据权利要求1所述的方法,其中所述游戏进行的所述识别的情景包括所述视频游6.根据权利要求1所述的方法,其中分析所述游戏状态包括辨识所述游戏进行中发生预测的未来游戏进行至少部分地定义所述游戏进行的记录参与所述视频游戏的所述会话的游戏进使用语音辨识模型分析记录的语音,所述模型识别多个候接收来自所述玩家的选择输入,将所述候选单词中的一个识别为9.根据权利要求8所述的方法,其中呈现所述多个候选单词是响应于所述语音辨识模游戏的所述会话生成的视频中呈现所述候选315.一种在上面体现程序指令的非暂时性计算机可读介质,所述程序指令在由至少一记录参与所述视频游戏的所述会话的游戏进分析所述视频游戏的所述会话的所述执行所产生的游戏使用所述游戏进行的识别的情景和语音辨识模型分析记录的将识别的文本内容应用为针对所述视频游戏的所述会话的游16.根据权利要求15所述的非暂时性计算机可读介质,其中所述方法是基本实时执行17.根据权利要求15所述的非暂时性计算机可读介质,其中所述游戏进行的所述识别18.根据权利要求15所述的非暂时性计算机可读介质,其中所述游戏进行的所述识别19.根据权利要求15所述的非暂时性计算机可读介质,其中所述游戏进行的所述识别20.根据权利要求15所述的非暂时性计算机可读介质,其中分析所述游戏状态包括辨4[0006]本公开的实现方式包括涉及检查游戏情景以确定视频游戏中的用户的话音命令记录的语音的所述文本内容是基本实时对所述游戏状态的变来游戏进行至少部分地定义所述游戏进行的5[0024]图2概念性地示出了根据本公开的实现方式基于改变的游戏情景对语音辨识模型[0025]图3概念性地示出了根据本公开的实现方式玩家提供有关视频游戏的游戏进行期[0026]图4概念性地示出了根据本公开的实现方式用于改善视频游戏的游戏进行期间的[0027]图5概念性地示出了根据本公开的实现方式在视频游戏期间应用语音辨识的方[0029]本公开的以下实现方式提供了用于检查游戏情景以确定视频游戏中的用户的话6[0033]在所示实现方式中,用户/玩家100参与由计算装置102执行的视频游戏的交互式本公开的原理可应用于可以由计算装置102执行并且用户100可以与之交互的其他类型的122以及渲染视频游戏的虚拟环境的视频和音频。视频呈现在显示器104(例如电视、监视7是在其它实现方式中,视频游戏和语音辨识中的任一个或两个可由通过网络130访问的云[0042]图2概念性地示出了根据本公开的实现方式基于改变的游戏情景对语音辨识模型[0047]图3概念性地示出了根据本公开的实现方式玩家提供有关视频游戏的游戏进行期8[0050]在操作304处,玩家100可以通过指示选择候选中的一个作为正确解译来做出响[0052]图4概念性地示出了根据本公开的实现方式用于改善视频游戏的游戏进行期间的游戏状态数据预测未来的游戏进行活动和情景,并且该未来的游戏进行活动/情景还可用模型)可以预测玩家未来的游戏情景将包括虚拟环境410的区域416内的虚拟位置。该数据[0056]图5概念性地示出了根据本公开的实现方式在视频游戏期间应用语音辨识的方执行的会话的游戏状态。在方法操作506处,将确定的游戏进行的情景应用于语音辨识过9[0061]在本文描述的一些实现方式中,游戏情景的分析和语音辨识由单独的模型执练并配置第一语音辨识模型以辨识在视频游戏的第一阶段/场景期间发生的语音,并且训和任选地操作系统的中央处理单元(CPU)602。CPU602可以由一个或多个同构或异构处理具有微处理器架构的一个或多个CPU来实施其他实施方案,所述微处理器架构特别适合于来向客户端远程流式传输玩游戏过程的许多服务器[0064]存储器604存储供由CPU602使用的应用和数据。存储装置606提供用于应用和数识姿势的跟踪装置和/或传声器。网络接口614允许装置600经由电子通信网络与其他计算输出图像的数据和/或指令可存储在存储器604和/或图形存储器618中。在一个实施方案据生成输出图像的像素数据的3D渲染能力。GPU616还可包括能够执行着色器程序的一个[0066]图形子系统614周期性地从图形存储器618输出图像的像素数据以显示在显示装使用专用服务器应用,所述专用服务器应用程序从玩家收集数据并将其分发给其他玩家。定游戏引擎片段提供与图形处理单元(GPU)相关联的虚拟机,因为它将进行大量相对简单一个或多个更高功率中央处理单元(CPU不依赖于控制器本身以外的任何附加硬件或处理的输入可以经由网络从控制器直接发送获的视频或音频,这些视频或音频可以在发送到云游戏服务器之前由客户端装置进行处以检测控制器的位置和运动,随后客户端装置会将所述位置和运动传达到云游戏服务器。[0075]在一个实施方案中,可通过头戴式显示器(HMD)使用虚拟环境来实施各种技术示是指用户与虚拟空间/环境的交互,该交互涉及通过HMD(或VR头戴式耳机)以对HMD的移动(由用户控制)做出实时响应的方式观看虚拟空间以向用户提供在虚拟空间或元宇宙中的侧并由此同样地转动HMD时,则在HMD上呈现该侧在虚拟空间中的视图。HMD可以类似于眼户的注视方向以及用户关注或有兴趣与其交互的VR场景中的特定虚拟对象和内容项相关身。使用这些不同类型的控制器或甚至仅仅使用做出的和由一个或多个相机捕获的手势,游戏。在一些实施方案中,云计算和游戏系统被配置为通过网络从HMD和界面对象接收输在执行的视频游戏的输出(诸如视频数据、音频

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论