Speech-music discrimination using deep visual feature extractors
Explore this paper's citation graph
Summary
This work investigates CNNs for the task of speech music discrimination and the first that exploits transfer learning across very different domains for audio modeling using deep-learning in general, and fine-tune a deep architecture originally trained for the Imagenet classification task.
- Type
- article
- Published
- 2018-12-01
- Cited by
- 43
- References
- 40
- OpenAlex
- https://openalex.org/W2803417255
- Semantic Scholar
- https://api.semanticscholar.org/CorpusID:52115682
Keywords
Computer science, Spectrogram, Convolutional neural network, Deep learning, Transfer of learning
References
- Speech-music discrimination from MPEG-1 bitstream
- A combination of data mining method with decision trees building for speech/music discrimination
- Speech-music discrimination: A deep learning perspective
- Long-term recurrent convolutional networks for visual recognition and description
- Music tonality features for speech/music discrimination
- A wavelet-based parameterization for speech/music discrimination
- A deep representation for invariance and music classification
- Music classification using extreme learning machines
- A deep convolutional neural network using heterogeneous pooling for trading acoustic invariance with phonetic confusion
- Speech vs music discrimination using Empirical Mode Decomposition
- Speech Emotion Recognition Using CNN
- MARSYAS: a framework for audio analysis
- Speech/music segmentation using entropy and dynamism features in a HMM classification framework
- Real-time discrimination of broadcast speech/music
- Speech/music discrimination for multimedia applications
- Unsupervised feature learning for audio classification using convolutional deep belief networks
- ImageNet: A large-scale hierarchical image database
- Spectrogram based features selection using multiple kernel learning for speech/music discrimination
- ImageNet Large Scale Visual Recognition Challenge
- A comparison of features for speech, music discrimination
Cited by
- A multi-level deep learning system for malware detection
- A Survey of Deep Learning and Its Applications: A New Paradigm to Machine Learning
- On the Complexity Analysis and Visualization of Musical Information
- Integration of Accelerated Deep Neural Network Into Power Transformer Differential Protection
- Designing a composite deep learning based differential protection scheme of power transformers
- FROM BODY TO BRAIN: USING ARTIFICIAL INTELLIGENCE TO IDENTIFY USER SKILLS & INTENTIONS IN INTERACTIVE SCENARIOS
- Music Emotion Recognition by Using Chroma Spectrogram and Deep Visual Features
- From close listening to distant listening: Developing tools for Speech-Music discrimination of Danish music radio
- Modelling Experts’ Decisions on Assigning Narrative Importances of Objects in a Radio Drama Mix
- A CNN recognition method for early stage of 10 kV single core cable based on sheath current
- Speech/Music Classification Using Features From Spectral Peaks
- A Deep Learning Approach Towards Multimodal Stress Detection
- Applying big data based deep learning system to intrusion detection
- Machine Learning Methods for Solving Scrap Metal Classification Task
- Simplified inverse filter tracked affective acoustic signals classification incorporating deep convolutional neural networks
- A Review on Voice-based Interface for Human-Robot Interaction
- Visual high dimensional industrial process monitoring based on deep discriminant features and t-SNE
- An evaluation of deep neural network models for music classification using spectrograms
- Clean vs. Overlapped Speech-Music Detection Using Harmonic-Percussive Features and Multi-Task Learning
- Analysis of influencing features with spectral feature extraction and multi-class classification using deep neural network for speech recognition system
Related papers
- Transfer and multitask learning method for buried wire detection via GPR
- XMixup: Efficient Transfer Learning with Auxiliary Samples by Cross-domain Mixup
- Multitask Learning or Transfer Learning? Application to Cancer Detection
- DL4ALL: Multi-Task Cross-Dataset Transfer Learning for Acute Lymphoblastic Leukemia Detection
- Sound Context Classification based on Joint Learning Model and Multi-Spectrogram Features
- Factors of Influence for Transfer Learning Across Diverse Appearance Domains and Task Types
- Multi-Source Transfer Learning Based on Inductive Knowledge-Leveraged for Medical Datasets
- A Multi-Task Learning and Transfer Learning-Based Model for Crop Leaf Disease Identification