CN120126506A VEM-Token声乐情绪多模态token化歌声和伴奏深度学习方法 (港湾之星健康生物(深圳)有限公司).docxVIP

  • 0
  • 0
  • 约3.17万字
  • 约 42页
  • 2026-07-22 发布于山西
  • 举报

CN120126506A VEM-Token声乐情绪多模态token化歌声和伴奏深度学习方法 (港湾之星健康生物(深圳)有限公司).docx

(19)国家知识产权局

(12)发明专利申请

(10)申请公布号CN120126506A

(43)申请公布日2025.06.10

(21)申请号202510609148.3

(22)申请日2025.05.13

(71)申请人港湾之星健康生物(深圳)有限公司

地址518183广东省深圳市龙华区龙华街

道清华社区龙观东路3号望成大厦926

(72)发明人丁贤根丁文丁远彤

(51)Int.Cl.

G10L25/51(2013.01)

G10L25/30(2013.01)

G06N3/09(2023.01)

G06N3/0464(2023.01)

G06N3/044(2023.01)

权利要求书4页说明书15页附图3页

(54)发明名称

VEM-Token声乐情绪多模态token化歌声和

伴奏深度学习方法

(57)摘要

CN120126506AVEM_Token声乐情绪多模态token化歌声和伴奏深度学习方法,是区别于现有的人工智能将信息分割成文字化的token词元后,再进行识别的方法。本发明将声乐文件进行频谱化,检测节拍,按照声乐节拍将频谱化的声乐文件分割成VEM_Token序列,按照歌词、歌声、伴奏、歌者情绪、伴奏情绪、视频、图像等多模态,建立VEM坐标系、VEM函数和VEM库,进行VEM_Token识别,分离出歌声流和

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档