- 0
- 0
- 约3.16万字
- 约 6页
- 2026-03-09 发布于北京
- 举报
在自我监督的音乐表示学习中平衡信息保存和解缠
JuliaWilkins,SivanDing,MagdalenaFuentes,JuanPabloBello
NewYorkUniversity,NewYork,USA
摘要—近期的自监督学习(SSL)方法的进步提供了一系列策略,可用对比技术设计目标作为解缠激励:不仅有像传统CL那样学习
以从音乐音频中捕获有用的表示而无需标记数据。虽然一些技术侧重于共性的不变性项,还有将特定性分离开来的发散项。我们在控制
通过重构保留全面细节,但其他技术则倾向于通过对比目标来突出语义
环境下通过下游音高和乐器分类任务系统地研究了不同设计选择
结构。很少有研究探讨这些范式在一个统一的SSL框架中的相互作用。
在这项工作中,我们提出了一种多视角SSL框架,用于解开音乐音频表下对比目标和重构目标之间的这种交互作用。我们的发现表明,
示,该
您可能关注的文档
- 可编程酉干涉仪中的复杂性-能量折衷.pdf
- 探索越南语性别独立语音识别的动态参数.pdf
- 如何及何处进行翻译?翻译策略在跨语言大语言模型提示中的影响.pdf
- 一种用于从临床试验的前瞻性注册中预测严重不良事件结果的新语言模型.pdf
- 探索 LLM 生成的文化特定情感人机触觉交互.pdf
- 加速和优化的不可感知颜色振荡搜索以将信息嵌入 LCD 图像中.pdf
- 语音引导的临床评估智能系统(VOICE):一种用于院前中风评估的语音 AI 代理系统.pdf
- iLearnRobot:一个基于交互式学习的多模态持续改进机器人.pdf
- 当无人出现(起初):在跨学科研究中导航参与式工作坊的不确定性.pdf
- 混合 EEG 驱动的脑机接口:个性化语言康复的大语言模型框架.pdf
原创力文档

文档评论(0)