一种基于强化学习的个性化短视频推荐方法以及系统.pdfVIP

  • 2
  • 0
  • 约1.55万字
  • 约 12页
  • 2023-06-19 发布于四川
  • 举报

一种基于强化学习的个性化短视频推荐方法以及系统.pdf

本发明提出一种基于强化学习的个性化短视频推荐方法以及系统,个性化短视频推荐方法包括:收集单个用户的历史记录,得到真实数据分布和专家轨迹;将真实数据分布输入GAN‑SD算法,对用户的特征进行建模,得到用户特征分布;将用户特征分布和专家轨迹输入到MAIL算法,对用户的交互行为建模,得到用户的决策函数;得到用户特征分布和决策函数后,完成对用户的建模;建模推荐引擎和用户的马尔科夫决策过程,用TRPO+ANC算法训练推荐引擎的马尔科夫决策过程,根据得到的累积回报值确定不同动作下的短视频推荐策略,从短视频推

(19)中华人民共和国国家知识产权局 (12)发明专利 (10)授权公告号 CN 113282787 B (45)授权公告日 2022.01.04 (21)申请号 202110567524.9 (56)对比文件 (22)申请日 2021.05.24

文档评论(0)

1亿VIP精品文档

相关文档