This dissertation proposes the study of multimodal learning in the context of musical signals. Throughout, we focus on the interaction between audio signals and text information. Among the many text sources related to music that can be used (e.g. reviews, metadata, or social network feedback), we concentrate on lyrics. The singing voice directly connects the audio signal and the text information in a unique way, combining melody and lyrics where a linguistic dimension complements the abstraction of musical instruments. Our study focuses on the audio and lyrics interaction for targeting source separation and informed content estimation.


翻译:这一论文提议在音乐信号的背景下研究多式联运学习。我们始终侧重于音频信号和文本信息之间的互动。在可以使用的与音乐有关的许多文本来源(例如评论、元数据或社交网络反馈)中,我们集中关注歌词。歌唱声以独特的方式直接连接音频信号和文本信息,将旋律和歌词结合起来,其中语言内容与音乐乐器的抽象化相辅相成。我们的研究侧重于音频和歌词互动,以针对源分离和知情内容估算为目标。

0
下载
关闭预览

相关内容

《计算机信息》杂志发表高质量的论文,扩大了运筹学和计算的范围,寻求有关理论、方法、实验、系统和应用方面的原创研究论文、新颖的调查和教程论文,以及描述新的和有用的软件工具的论文。官网链接:https://pubsonline.informs.org/journal/ijoc
移动应用(APP)个人信息保护白皮书
专知会员服务
17+阅读 · 2021年10月31日
Linux导论,Introduction to Linux,96页ppt
专知会员服务
82+阅读 · 2020年7月26日
「Github」多模态机器学习文章阅读列表
专知
124+阅读 · 2019年8月15日
A Technical Overview of AI & ML in 2018 & Trends for 2019
待字闺中
18+阅读 · 2018年12月24日
Hierarchical Disentangled Representations
CreateAMind
4+阅读 · 2018年4月15日
Arxiv
0+阅读 · 2021年12月31日
Arxiv
0+阅读 · 2021年12月27日
Implicit Maximum Likelihood Estimation
Arxiv
7+阅读 · 2018年9月24日
VIP会员
相关论文
Arxiv
0+阅读 · 2021年12月31日
Arxiv
0+阅读 · 2021年12月27日
Implicit Maximum Likelihood Estimation
Arxiv
7+阅读 · 2018年9月24日
Top
微信扫码咨询专知VIP会员