- 0
- 0
- 约2.58万字
- 约 22页
- 2023-05-11 发布于四川
- 举报
本发明涉及人工智能技术,提供了一种模型训练方法、巡逻及接单推荐策略生成方法及存储介质,该方法包括:获取案件历史时空信息、查勘员历史时空信息和查勘员历史时空信息对应的动作信息,其中,动作信息包括移动信息、停留信息和接单信息;对案件历史时空信息和查勘员历史时空信息进行仿真处理,得到案件仿真时空信息和查勘员仿真时空信息;将案件仿真时空信息、查勘员仿真时空信息、动作信息和预设的奖励信息作为训练数据对深度双Q网络进行强化学习训练,得到策略推荐模型,其中,策略推荐模型用于生成巡逻及接单推荐策略,奖励信息与动
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 114580908 A
(43)申请公布日 2022.06.03
(21)申请号 202210210692.7
(22)申请日 2022.03.03
(71)申请人 平安科技(深圳)有限公司
地址 5
原创力文档

文档评论(0)