arrow
返回

Spatial-temporal self-supervised learning for audio classification

delete2025-12-15
delete0
PRE
AI
M
Manal S. Alsuwat
S
Sarah Al-Shareef
M
Manal Alghamdi
M
Miada Almasre
DOI:10.1016/j.eswa.2025.130641delete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
• 探索SSL预文本任务中的多级时空注意力机制。 • 引入基于跨域验证的约束自监督训练方法。 • 采用ACAV100M这一近期大规模无标签音视频数据集。 • 对下游情感分类和阿拉伯音乐分类任务进行性能基准测试。

期刊

Expert Systems with Applications 封面图
Expert Systems with Applications
IF:
7.5
论文数:
3.0W
被引数:
10.2W

机构

K
King Abdulaziz University
学者数:
2.0W
论文数: 1.9W
被引数: 3.3W
U
umm al-qura university
学者数:
2.8K
论文数: 2.5K
被引数: 0
引用论文

引用论文

Self-Supervised Point Set Local Descriptors for Point Cloud Registration
err2021-01-12
err0
errOAAI
errYijun Yuan; Dorit Borrmann; Jiawei Hou; Yuexin Ma; Andreas Nüchter; Sören Schwertfeger
err分享
err收藏
You Said That?: Synthesising Talking Faces from Audio
err2019-02-13
err101
errOAAI
errJamaludin, Amir; Chung, Joon Son; Zisserman, Andrew
err分享
err收藏
Self-Supervised Leaf Segmentation under Complex Lighting Conditions
err2023-03-01
err15
errOAAI
errLin, Xufeng; Li, Chang-Tsun; Adams, Scott; Kouzani, Abbas Z.; Jiang, Richard; He, Ligang; Hu, Yongjian; Vernon, Michael; Doeven, Egan; Webb, Lawrence; Mcclellan, Todd; Guskich, Adam
err分享
err收藏
Novel Transfer Learning Approach for Medical Imaging with Limited Labeled Data
err2021-03-30
err0
errOAAI
errLaith Alzubaidi; Muthana Al-Amidie; Ahmed Al-Asadi; Amjad J. Humaidi; Omran Al-Shamma; Mohammed A. Fadhel; Jinglan Zhang; J. Santamaría; Ye Duan
err分享
err收藏
err分享
err收藏
Speech Emotion Recognition Using Convolution Neural Networks and Multi-Head Convolutional Transformer基于卷积神经网络和多头卷积变换器的语音情感识别
errSENSORS
IF3.5
err2023-07-07
err15
errOAAI
errUllah, Rizwan; Asif, Muhammad; Shah, Wahab Ali; Anjam, Fakhar; Ullah, Ibrar; Khurshaid, Tahir; Wuttisittikulkij, Lunchakorn; Shah, Shashi; Ali, Syed Mansoor; Alibakhshikenari, Mohammad
err分享
err收藏
学者 查看更多内容