版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
2022.08.02PCT/JP2021/0034962WO2021/157515JA2021.08.12防止数据通信命令被过度地发布到控制装置而成为过负荷,并且缩短命令的发布延迟时部,其监视计算机装置的1个以上的应用指令的间表发布的命令的受理时刻及发布时刻的状态发布的延迟时间和发布的全部命令的平均发布2行为信息输出部,其将行为信息输出到所述计算机装置,该行为信价值函数更新部,其根据由所述回报计算部计算出的回报,更所述发布时间表的修正信息包含:表示指令了所述命令的进程的优先级的进程优先所述回报计算部根据每个所述命令的所述延迟时间和所述平均发布间隔来计算每个所述机器学习装置还具有:优化行为信息输出部,其根据由所述价值函设置所述机器学习的最大试行次数来进行所述通过所述机器学习装置对所述发布时间表进行9.一种机器学习方法,用于对发行命令的的数据是在所述计算机装置上动作的1个以上的应用分别指令的数据,该状态数据至少包将行为信息输出到所述计算机装置,该行为信息包含在所述状态3根据到所述命令被发布到所述控制装置为止的每个所述命令的延迟时间和发布的全4[0011]图10是表示在作为计算机装置的个人计算机上动作的多个应用输出的命令的时[0014]专利文献1限于数值控制装置对数据请求命令返回数据的高效化,而无法实现从5[0018](1)本公开的机器学习装置的一方式是一种机器学习装置,其对发行命令的计算令被发布到所述控制装置为止的每个所述命令的延迟时间和发布的全部所述命令的平均[0021](4)本公开的机器学习方法的一方式是一种机器学习方法,用于对发行命令的计据到所述命令被发布到所述控制装置为止的每个所述命令的延迟时间和发布的全部所述6OnlyMemory,只读存储器)、RAM(RandomAccessMemory,随机访问存储器)、CMOS[0044]CPU是整体控制个人计算机30的处理器。CPU经由总线读出储存在ROM中的系统程序以及n个应用AP1-APn的程序,按照所述系统程序以及应用AP1-APn的程序控制个人计算7部302接收用于访问数值控制装置20内的数据的数据通信命令,将接收到的命令数据暂时[0046]例如,命令处理部303根据发布时间表取得储存在数据通信接口部302的缓冲器[0052]命令表CT内的“指令进程ID”是进程ID,是在进程启动时由个人计算机30的OS8[0065]通信处理部304对于本领域技术人员而言是公知的通信部,在与数值控制装置20时间表进行强化学习,该发布时间表是针对储存在数据通信接口部302的缓冲器(未图示)构进行说明。智能体(相当于本实施方式中的机器学习装置40)观测环境(相当于本实施方9佳行为价值是传播至其前一个状态下的行为价[0085]“Human-levelcontrolthroughdeepre数据通信接口部302接收到各命令的受理时刻、以及命令处理部303经由通信处理部304发[0087]机器学习装置40监视由应用AP1-APn的每一个所指令的命令,观测包含命令表CT理时刻及发布时刻。[0089]为了进行上述的强化学习,如图3所示,机器学习装置40具有:状态数据取得部行为信息输出部404以及优化行为信息输出部[0091]状态数据取得部401将取得的状态数据s输出到判定数据取得部402以及学习部[0093]状态数据取得部401可以将取得的状态数据s存储在机器学习装置40所包含的未[0097]学习部403是在某个状态数据(环境状态)s下学习选择某个行为a时的价值函数Q[0107]图4是表示由回报计算部431计算出的每个命令(命令编号)的评价值V的一例的学习中间的学习方法,是每当积攒了某种程度学习用数据时进行价值函数Q的更新的学习Td”。[0118]行为信息输出部404是对个人计算机30输出从学习部403输出的行为信息a的部[0120]价值函数存储部405是存储价值函数Q的存储装置。价值函数Q例如可以按状态s、[0121]优化行为信息输出部406根据通过价值函数更新部432进行Q学习而更新的价值函为信息输出部406根据价值函数Q生成行为信息,将生成的行为信息输出到个人计算机30。等辅助存储装置、用于储存运算处理装置执行程序时暂时需要的数据的RAM这样的主存储台搭载了这样的GPU的计算机来构筑计算机集群,通过该计算机集群所包含的多个计算机各命令的受理时刻及发布时刻。此外,最初开始Q学习的时间点的命令表CT预先由用户生将生成的新的行为信息a输出到个人计算机30。接收到行为信息的个人计算机30根据接收[0136]在步骤S15中,判定数据取得部402根据状态数据取得部401接收到的新的状态数据输出到学习部403。该判定数据例如包含按1分钟等规定时间由数据通信接口部302受理始机器学习起对步骤S13至步骤S19的处理的时间进行累积而得的时间超过了预先设定的函数Q用于生成行为信息,所述行为信息防止数据通信命令被过度地发布到数值控制装置[0144]在步骤S21中,优化行为信息输出部406取得存储在价值函数存储部405中的价值个人计算机30也可以具备机器学习装置40的一部分或与其他机器学习装置40A(k)之间进行共享(k为1至m的整数,k≠j)。如果在机器学习装置[0156]另外,机床10A(1)-10A(m)的每一个与图1的机床10对应。数值控制装置20A(1)-20A(m)的每一个与图1的数值控制装置20对应。个人计算机30A(1)-30A(m)的每一个与图1的个人计算机30对应。机器学习装置40A(1)-40A(m)的每一个与图1的机器学习装置40对[0161]个人计算机30以及机器学习装置40所包含的各结构部可以通过包含电子电路等用户的计算机来进行分发。另外,在由硬件构成时,例如可以由ASIC(Application设备)等集成电路(IC)构成上述装置所包含的各结构部的功能的一部[0162]可以使用各种类型的非暂时性的计算机可读介质(Non-transitorycomputer类型的有形存储介质(Tangiblestoragemedium)。非暂时性的计算机可读介质的示例包外,可以通过各种类型的暂时性计算机可读介质(Transitorycomputerreadable令用于访问能够通信地连接的数值控制装置20,机器学习装置40具有:状态数据取得部每个命令的发布延迟时间Tb和发布的全部命令的平均发布间隔Ta,计算针对行为信息a的命令的发布延迟时间Tb和平均发布间隔Ta来计算每个命令的评价值V,并将计算出的每个及通过机器学习装置40对发布时间表进行机器
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2025年宜宾市高县上源水务投资有限责任公司招聘考试真题
- 2025-2026学年广东省深圳市高三物理下册(一模)试卷(含答案)
- 2025年辽宁师范大学海华学院招聘真题
- 可克达拉市高校毕业生“三支一扶”计划考试真题2025
- 中国智能枕市场分析
- 特殊教育学校暂行规程实施细则
- 教育培训从业人员造成火灾隐患检讨书
- 教师家长群管理规范自查及整改措施
- 胶固粉加工项目环评报告表
- 人教版七年级语文下册第五单元评价卷含答案
- 中国电子级甲醇市场运行态势与发展战略建议研究报告
- 2026年初级消防监控证试题及答案
- 2026年度全国保密教育线上培训题库(选择+判断)及参考答案
- 2026化学高考广西考试真题及答案
- 2026年比亚迪AI视频面试题库与答题技巧
- 2026年青岛国际机场集团有限公司校园招聘笔试备考试题及答案解析
- GB/T 47235-2026地毯耐洗涤剂色牢度
- (2025年)广州市南沙区辅警考试真题及答案
- XX中学八年级生物中考实验操作考试注意事项培训会上实验员讲解
- 2025届“才聚齐鲁成就未来”山东钢铁集团有限公司高校毕业生招聘笔试参考题库附带答案详解
- 高考生物:连锁遗传类试题归类分析
评论
0/150
提交评论